概要

名古屋工業大学大学院の博士後期課程の学生です。音声処理分野において、話者ダイアライゼーションと、その学習に用いるデータ生成に関する研究に取り組んでいます。

研究分野

  • Speaker diarization
  • Speech data generation
  • Multi-talker speech processing

発表

国際会議

Multi-talker conversational speech generation for training speaker diarization model via text-to-speech

Data generation for speaker diarization by speaker transition information

国内会議

LLMと音声合成モデルを用いた文脈を保つ話者ダイアライゼーションのためのデータ生成

話者遷移確率に基づく話者ダイアライゼーションのためのデータ生成

3話者以上の話者交替情報を用いたSpeaker Diarizationのためのデータ生成

発話交替頻度を導入した実対話音声に対するSpeaker Diarizationのためのデータ生成

学歴

博士後期課程 工学専攻

博士前期課程 工学専攻

工学部第一部 情報工学科

連絡先

研究に関するお問い合わせは、メールでご連絡ください。