免費開始

用 AI 打造 PNGTuber 與 VTuber 直播素材包

用 AI 打造 PNGTuber 與 VTuber 直播素材包 – AI Art Create 部落格文章
PNGTuber 頭像生成
VTuber 素材
Twitch 表情
Recraft V4
OBS

2026年9月18日 • 8 分鐘 閱讀

最後更新於 2026年9月18日

好用的 PNGTuber 套件需要兩個彼此吻合的頭像狀態,而不是一張精修到底的單圖。先做出嘴巴閉合的中性肖像,再從同一張參考圖衍生說話狀態,並用同一套色盤延伸表情與頻道圖。

AI Art Create 負責產出視覺素材。麥克風偵測、狀態切換,以及 Live2D 或 VRM 綁骨仍在專用的直播軟體裡完成。

完整的 PNGTuber 直播套件該包含什麼?

入門 PNGTuber 套件通常有:靜音頭像、說話頭像、數種情緒,以及一小組頻道圖。每個素材在實際顯示尺寸下都要清楚可讀,且像同一個角色。

實用的第一版套件可包含:

  • 中性頭像,嘴巴閉合
  • 說話頭像,嘴巴張開
  • 開心、驚訝、不爽、想睡等反應
  • 四到八個 Twitch 或 Discord 表情
  • 訂閱徽章或頻道圖示概念
  • Starting Soon、Be Right Back、Just Chatting 背景

別第一天就全部生成。靜音與說話這兩個狀態決定核心 illusion 能不能成立。

該怎麼設計 PNGTuber 基礎頭像?

基礎頭像要讓人一眼認出。清楚的輪廓、穩定的頭部位置、好讀的眼睛,以及簡單背景,比複雜衣料紋理更重要。

使用像 FLUX.2 這類肖像生成器時,採正面或略偏的三四分身裁切:

Original PNGTuber character, chest-up portrait, centered.
Round face, dark green eyes, short copper hair, black cat-ear headset.
Navy hoodie with one mint drawstring, clean cel-shaded illustration.
Neutral friendly expression, mouth closed, even lighting.
Plain transparent-style green background, no text, no extra objects.

在 AI Art Create 中,FLUX.2 每次請求 6 點數,並可接受來源圖。先生成一小批,核准一張肖像,之後每個狀態都沿用這張圖。

如何做出吻合的說話與靜音狀態?

說話狀態只改嘴巴,並稍微增加一點臉部活力。若頭部角度或裁切改變,麥克風一啟動頭像就會像「跳一下」。

使用受控的編輯 prompt:

Preserve the character, crop, head position, eyes, hair, headset,
hoodie, palette, lighting, and background.
Change only the mouth to an open speaking shape.
Keep the jaw and face proportions unchanged.

以相同尺寸比對兩張圖,快速交替檢視。注意頭部外輪廓、肩膀、耳機與眼睛位置。反覆切換時,小差異會非常明顯。

步驟 1:準備影像檔

將兩種狀態裁成相同畫布尺寸,對齊眼睛與肩膀。若直播版面需要透明背景,記得去背。

目前目錄中並非每個模型都保證透明點陣輸出,必要時請預留去背流程。

步驟 2:設定 reactive 切換

將靜音與說話圖片匯入 PNGTuber 應用(例如 Veadotube Mini),或使用其他相容 OBS 的 reactive 頭像方案,並在該軟體內設定麥克風閾值。

反應時間取決於直播軟體、音訊緩衝、麥克風處理與電腦效能。檔案匯出後,AI Art Create 不再參與 live 切換迴圈。

步驟 3:在真實直播場景中測試

在遊戲、提醒、瀏覽器來源與語音處理同時運行時測試。在空白桌面表現良好的閾值,在降噪與繁忙場景下可能閃爍或延遲。

檢查三種情況:正常說話、句尾較輕、以及笑聲。調整麥克風閾值,直到說話狀態不會在字與字之間閃動。

如何製作仍清晰可讀的 Twitch 表情?

先以最小顯示尺寸設計 Twitch 表情。Twitch 常見顯示為 28×28、56×56 與 112×112 像素。細手指、細描邊與小字在 28 像素時通常會消失。

Recraft V4 是目前目錄中針對可編輯 SVG 與 flat 插畫的模型,每次請求 6 點數。請求單一表情、粗輪廓、少量色塊,且不要文字:

Vector chat emote of the same copper-haired cat-ear character laughing.
Head and hands only, thick clean outline, five flat colors,
exaggerated readable expression, centered, no text, no background.

若需修正曲線或鎖定品牌色,可在 Illustrator 或 Figma 中開啟結果。Recraft 支援明確色票指令,當頭像與頻道圖需共用色盤時特別有用。

直播場景該生成什麼?

場景要留空間給遊戲畫面、聊天、提醒與頭像。滿版精美插畫若每個角落都很 busy,作為 overlay 仍可能失敗。

Starting Soon 先標出標題與倒數位置。Just Chatting 為主播與聊天面板保留大片平靜區域。遊戲直播時,裝飾細節放在邊緣而非中央。

常見桌面直播版面使用 16:9 畫布。背景與文字分開生成,拼字與未來檔期變更就不必整張重畫。

AI Art Create 能生成 Live2D 或 VRM 模型嗎?

AI Art Create 目前不會生成已綁骨的 Live2D 模型、3D mesh 或 VRM 檔。它產出來源圖、向量圖與短影片素材,可支援 VTuber 或 PNGTuber 工作流程。

這項限制很重要。VRoid Studio、Live2D Cubism 與專門綁骨工具解決的是不同問題。用 AI Art Create 定調角色方向並產出配套素材,需要可形變動畫時再進入綁骨軟體或與繪師合作。

如何加入短反應動畫?

以窄而聚焦的 image-to-video prompt 為已核准的反應 still 加動態。Wan 2.2 以 45 點數生成 5 秒片段。Kling 以 100 點數提供較高保真度的 5 或 10 秒動態。

只請求一個動作,例如眨眼與微笑。若片段要在遊戲視窗旁 loop,避免鏡頭移動。匯出的影片可能需要在編輯器中裁切與整理 loop。

先做好真正重要的兩個狀態

在擴充套件前先完成靜音與說話肖像。開啟 PNGTuber 與 VTuber 素材工作流程 以比較推薦模型。首次生成免費,無需信用卡。

A

作者: AI Art Create

AI 影像與影片生成專家

AI Art Create 的創作者與 AI 工作流程作者,專注於實用的影像、影片與直播製作流程。