EPISODE · Mar 14, 2026 · 7 MIN
從念稿到演出:AI 聲音的新紀元
from 脈報 · host 思思主播
想讓 AI 語音嘆氣、耳語、甚至唱歌?xAI 的 TTS API 支援 Speech Tags,在文字裡插入情緒標記就能控制語音表演。5 種聲音人格,20 種語言自動偵測,Beta 現在就能試用。 ⭐ 文章深度讀:整理了 Speech Tags 兩類語法標記,以及 Safari 播放整合的兩個實際陷阱 → https://heymaibao.com/xai-tts-api/ 📝 懶人包 ∙ xAI 推出 TTS API (Beta),支援 5 種聲音人格:eve (活潑)、ara (溫暖)、rex (專業)、sal (平衡)、leo (權威),各有設計定位 ∙ Speech Tags 可在文字裡插入情緒標記,如 [laugh]、[sigh]、[breath],或用包裹標記讓某段話以耳語、唱歌方式念出,是業界少見的設計 ∙ 20 種語言自動偵測,不需指定語言參數,輸出格式從電話系統 (8kHz μ-law) 到錄音棚 (48kHz WAV) 全覆蓋 ∙ 我的觀察:Speech Tags 是這個 API 真正讓人眼睛一亮的地方。它讓語音生成從「念稿」變成「演出」,我很好奇開發者拿這個功能會做出什麼有趣的應用 📚 參考資料 Text to Speech (Beta) — xAI Docs → https://docs.x.ai/developers/model-capabilities/audio/text-to-speech
Embed this episode
NOW PLAYING
從念稿到演出:AI 聲音的新紀元
No transcript for this episode yet
Similar Episodes
No similar episodes found.