ポッドキャスト版「Audiostart News」も配信中!各ポッドキャストプラットフォーム「オーディオスタートニュース」で検索!

10. 音声合成

10. 音声合成

朝日新聞社の音声強調AI論文、Interspeech 2026に採択

株式会社朝日新聞社は2026年7月24日、メディア研究開発センターの論文が音声処理分野の国際会議「Interspeech 2026」に採択されたと発表しました。AIモデルを大幅に小型化しながら高品質なノイズ除去を実現する新手法「QC-GAN...
10. 音声合成

AI音声「BionicVO」始動 実在声優をライセンスし報酬還元

広告音声制作の第一人者ダン・プライス氏が、AI音声クローン・プラットフォーム「BionicVO」を発表しました。合成音声ではなく、実在するプロ声優のライセンス音声のみを使用し、声が使われるたびに声優へ報酬が支払われるロイヤリティ型を採用して...
10. 音声合成

ElevenLabs、感情を再現する吹き替えAI『Dubbing v2』APIを提供開始

音声AIのグローバルリーダーであるイレブンラボが、感情表現を忠実に再現する新しい吹き替えAIモデル『Dubbing v2』のAPI提供を開始しました。92言語に対応し、単一のAPIで多言語吹き替えの生成からセグメント編集・再生成までを一貫し...
10. 音声合成

歌声合成「VoiSona」新ボイス「メカスズカ」CF経て販売開始

株式会社テクノスピーチは、歌声合成ソフト「VoiSona」の新規バイリンガルボイスライブラリ「メカスズカ(CV:市松寿ゞ謡)」を2026年7月17日にリリースしました。市松寿ゞ謡の活動から生まれたキャラクターで、2025年12月からのクラウ...
10. 音声合成

Seed Audio 1.0|プロンプト1つで会話・BGM・効果音を生成

ByteDance Seedが開発したAI音声生成モデル「Seed Audio 1.0」が公開されました。テキストや画像、音声を手がかりに、複数話者の会話から感情表現、環境音、BGM、効果音までを1つのプロンプトでまとめて生成できます。本記...
09. 生成AI

Verbex、音声対話AIをオンプレミスや閉域接続へ対応拡大

音声対話AIプラットフォームを提供する株式会社Verbexが、金融機関や自治体・官公庁、医療機関、BPO事業者など厳格なセキュリティ要件を持つ組織向けに、音声対話AIのセキュア導入形態を拡張しました。独自のSTT/TTSモデルを基盤に、従来...
06. 音声サービス

FIXERがElevenLabsの音声AI活用、医療の記録作成を支援へ

株式会社FIXERが、イレブンラボのAI音声技術と自社のソブリンAIプラットフォーム「Sovereign GaiXer」を組み合わせ、医療をはじめとするエンタープライズ向け音声AIソリューションの開発・検証を開始しました。医療現場の文書作成...
10. 音声合成

ElevenLabsの「ElevenAgents」、SMS・Telegramに対応拡充し全チャネル一元管理へ

イレブンラボは、企業向けAIエージェント「ElevenAgents」の対応チャネルを拡充しました。新たにSMS・Telegramでの問い合わせ対応や、IntercomおよびFreshdeskとの連携を追加し、電話やチャットなど複数の顧客接点...
10. 音声合成

インプレス、書籍『AI音声API入門 クラウド時代の音声合成』を発行

インプレスグループの株式会社インプレスは、書籍『AI音声API入門 クラウド時代の音声合成』(著者:前川竜希)をインプレス NextPublishingより発行します。最新の知見を発信する「技術の泉シリーズ」の6月の新刊で、AI音声合成技術...
10. 音声合成

TTSモデルの「本当の実力」を暴く!ストリーミング発音精度ベンチマーク公開

音声AI企業Asyncが公開した「TTS Pronunciation Benchmark」は、商用ストリーミングTTSモデルが数字・日付・通貨・URLなどの非標準テキストをどれだけ正確に読み上げられるかを、世界で初めて体系的に評価した公開ベ...