Text to Speech Avatar

建立可在鏡頭前朗讀您腳本的文字轉語音虛擬人物。輸入文字、選擇虛擬人物和聲音,即可在數分鐘內製作出精緻的真人講解風格影片,毋須拍攝或剪輯。

Text to speech avatar reading a script on camera.
164,014,555已生成影片
140,843,037已生成頭像
23,570,248已翻譯影片
company logo 1
company logo 2
company logo 3
company logo 4
company logo 5
company logo 6
company logo 7
company logo 8
company logo 9
company logo 10
company logo 11
company logo 12
company logo 13
company logo 14
company logo 15
company logo 16
company logo 17
company logo 18
company logo 19
company logo 20
company logo 21
company logo 22
company logo 23
company logo 24
company logo 25
company logo 26
company logo 27
company logo 28
company logo 29
company logo 30
company logo 31
company logo 32
company logo 33
company logo 34
company logo 35
company logo 36
全球數百萬用戶信賴我們,將他們的故事變為現實。
主要功能

文字轉語音虛擬人物功能

輸入腳本,即可生成會說話的虛擬人物

貼上您的腳本,虛擬人物便會以自然的口型同步和配合內容的表情演繹。文字轉影片引擎可在數分鐘內將文字製作成完整的說話影片,讓您只需修改文字即可編輯,無須重新錄製任何一句。

Avatar speaking a pasted script with natural lip-sync.

1,100+ 個虛擬人物及 300+ 種 AI 語音

從超過 1,100 個逼真虛擬人物中選擇一位主持人,再配合 AI 語音生成器提供的 300 多種聲音。為虛擬人物配對合適的聲音,調整語調和語速,讓整段影片的每個場景都保持一致的面孔和演繹方式。

Gallery of realistic AI avatars paired with voice options.

以 15 秒短片製作自訂虛擬人物

只需一段 15 秒影片,即可在 Avatar V 建立您的數碼分身,毋須填寫資格表格或預約 Studio。此模型能在遠景、中景及特寫鏡頭中保持您的樣貌和聲音一致,讓您的自訂虛擬人物在任何場景都維持一致。

Custom digital twin created from a 15-second clip.

Talking avatars in 177+ languages

只需輸入一次,即可使用 177 種以上語言及方言生成同一個會說話的虛擬人物,並透過語音複製,讓每個版本都保留您的語調。地區口音及音素級口型同步技術,讓每種語言聽起來都像母語錄音,而非機械式配音。

One avatar speaking the same script across many languages.

Direct gestures and long scripts

只需以簡單英語指示虛擬人物望向鏡頭、靠近鏡頭或保持冷靜,便可讓演繹方式配合訊息內容。單次生成即可製作長達 30 分鐘的連續人物講解影片,即使處理較長的腳本,外貌和聲音亦能始終保持一致,不會出現偏差。

Avatar following plain-English gesture direction on a long script.
使用案例

文字轉語音虛擬人物的應用方式

手提電腦螢幕上顯示由虛擬人物主持的培訓單元。

培訓及入職影片

傳統培訓影片拍攝需要租用 Studio,而且每次修改都要重新拍攝。只需將腳本製作成由虛擬人物講解的培訓單元;當政策或產品詳情有變時,更新文字並重新生成即可,毋須預約拍攝團隊。

設有螢幕上主持人的直向社交媒體短片。

適用於 TikTok 和 X 的社交媒體短片

每天拍攝短篇內容非常耗時。使用 AI 虛擬主播,持續在 TikTok、Instagram 和 X 發佈風格一致的短片,並沿用同一位出鏡主持,讓您的頻道建立辨識度,而您無需親自上鏡。

One avatar video localized into multiple languages.

為全球團隊製作多語言影片

Localizing footage means re-recording for each market. Generate one avatar video, then use the AI video translator to ship it in 177+ languages, so global teams hear the message in their own language.

產品操作示範旁的說話虛擬人物。

產品示範及操作教學解說影片

單靠螢幕錄影難免顯得平淡。將會說話的虛擬人物加入產品導覽,逐步講解各項功能;當介面或價格更新時,即可重新生成講稿,確保每個示範都緊貼最新內容。

向指定潛在客戶發送的個人化推廣影片。

個人化銷售及客戶開發影片

為每位潛在客戶重複錄製相同的推銷內容,難以大規模擴展。只需撰寫一段訊息,替換姓名或其他資料,即可大量發送個人化虛擬人物影片,讓外展溝通如同一對一交流,無需花費數小時面對鏡頭。

AI 主持人以新聞報道形式提供最新消息。

用於新聞及最新消息的 AI 主播

由真人主播報道例行更新會佔用幕前人才的時間。廣播及媒體團隊可編寫虛擬人物主持的講稿,按需要播報新聞環節或本地化天氣預報;當新聞內容有變時,只需更新影片,毋須重新佈置場景拍攝。

How it works

How to make a text to speech avatar

只需 4 個步驟,即可將腳本製作成完整的文字轉語音虛擬人物影片,毋須使用攝影機、咪高峰或編輯時間軸。

step icon

步驟 1:撰寫或貼上您的腳本

直接輸入文字或貼上現有腳本,然後設定您想要的語調和節奏。

step icon

步驟 2:選擇虛擬人物及語音

從超過 1,100 個虛擬人物及 300 種語音中選擇,或選用您專屬的自訂數碼分身。

step icon

步驟 3:預覽並微調

Generate a preview, adjust gestures and delivery, and translate into any of 177+ languages.

step icon

Step 4: Export and share anywhere

Render in HD or 4K, then download the MP4 or publish it straight to your channels.

文字轉語音虛擬人物常見問題

甚麼是文字轉語音虛擬人物?它如何運作?

A text to speech avatar is a digital presenter that reads your typed script aloud on screen with synced lip movement. You enter text, choose an avatar and voice, and the tool renders a talking video, with no filming or voice recording.

Do text to speech avatars look realistic or robotic?

HeyGen uses natural lip sync, facial expressions, and motion controls to make text to speech avatars speak and move like on-camera presenters. Results depend on the selected avatar, voice, script, and motion settings.

我可以免費製作文字轉語音虛擬人物影片嗎?

可以。您可使用 HeyGen 的 Free 計劃開始製作文字轉語音虛擬人物影片,毋須信用卡。發佈前,請瀏覽 HeyGen 定價頁面,了解目前的使用限制、所包含的功能及匯出選項。

如何將我的腳本製作成虛擬人物說話影片?

貼上您的腳本,選擇虛擬人物及 300 多款語音之一,然後生成影片。您可用簡單英語指示動作,並透過精準的 AI 口型同步調整演繹效果,之後再匯出影片。如需後期編輯,只需修改文字,毋須重新錄製。

Can I build a custom avatar with my own face and voice?

Yes. Record a 15-second source video to create a digital twin, then select or create a voice for the avatar. Available avatar and voice options depend on your current HeyGen plan and workflow.

Why choose HeyGen for text to speech avatar videos?

大多數虛擬人物工具只會提供照稿讀出的預設主持人。HeyGen 則在同一平台提供只需 15 秒即可建立的自訂數碼分身、支援 177 種以上語言的語音複製、以簡單英文指示動作,以及一次生成長達 30 分鐘的連續影片。

How many languages can a text to speech avatar speak?

HeyGen 虛擬人物支援 177 種以上的語言及方言,並透過語音複製,讓您的語調在每個版本中保持一致。您只需撰寫一次腳本,即可生成本地化影片,讓同一個虛擬人物面向幾乎任何市場的觀眾,無需重新錄製。

文字轉語音虛擬人物真的能為創作者節省時間嗎?

Yes. Educator Anton Voroniuk reported saving 15.5 hours a week and cutting production costs 40x after switching to HeyGen avatars, while reaching over 1M students. Scripting and regenerating replaces filming, editing, and reshoots.

Can I make an animated or non-human talking avatar?

可以。除了逼真的真人虛擬人物外,HeyGen 的 Avatar IV 還可將相片、卡通及 2D 或 3D 角色製作成會說話的主持人。上載圖片或選擇風格,加入您的講稿,角色便會配合口型說出內容。

有沒有 API 可讓我在應用程式中生成虛擬人物影片?

可以。HeyGen 的 API 支援以程式方式將文字生成虛擬人物影片。如需互動式實時虛擬人物,請使用 HeyGen 的 Live Avatar 服務。請查閱最新的開發者文件及 API 定價,了解支援的模型、限制及收費。

Explore more AI powered tools

Bring any photo to life with hyper‑realistic voice and movement using Avatar IV.

立即開始使用 HeyGen 創作

利用 AI 將您的創意轉化為專業影片。

CTA background