你想用 AI 製作動畫或短片。
和幾年前相比,現在更容易踏出第一步。
過去常見的難題包括挑選生成工具、註冊多個服務,以及讓角色在不同鏡頭中保持相同的臉孔。
如今的工具能從文字生成影片、讓圖片動起來、讓角色開口說話,並把多個鏡頭組成故事。
大家好,我是 Ny@Tech。
我的本業是網路行銷。從 2024 年起,我也開始測試圖片與影片生成工具,了解它們在實務上的用途。
Pollo AI 是其中一個引起我注意的服務。
Pollo AI 將 Google 的 Veo、Kling AI、Runway、Seedance 等模型與影片製作工具整合在同一平台。
這篇指南面向剛接觸 AI 影片的讀者,介紹 Pollo AI 的點數制度、基本流程,以及包括代理工具在內的主要功能。
文中也會示範 DomoAI 的工具,說明如何將它們用於影片製作。
先了解基本操作,以及各項服務能協助你製作哪些內容。
什麼是 Pollo AI?
Pollo AI 是一個整合圖片與影片生成的平台,也能在同一服務中進行對嘴等處理。
Pollo AI 的公司位於哪裡?
Pollo AI 由位於新加坡的 COCOSOFT TECHNOLOGY PTE. LTD. 開發與營運。
使用海外服務時,你可能會關心它如何處理資料,以及是否支援所需語言。
Pollo AI 提供日文網站介面,方便日語使用者操作。
此外,營運公司所在的新加坡,也透過《個人資料保護法》(PDPA)建立了處理個人資料的法律制度。
對於使用海外服務時難免產生的不安,我認為有一定的法律基礎,也能讓人感到安心。
也有日文文章與影片分享這項服務的操作方式和生成成果。
從多種 AI 模型中選擇
Pollo AI 的主要特色,是能用同一個帳號使用多種圖片與影片模型。
下圖說明這和分別使用各項服務有何不同。

如此一來,就能依用途與想製作的影片風格,從以下主要模型中選擇。
| 模型 | 開發者 | 特色 |
|---|---|---|
| Google Veo 3 / Veo 3.1 | 除了逼真的影像表現,也支援同時生成影像與聲音的原生音訊生成 | |
| Kling AI,包括 Kling 3.0 與 Kling V3 Omni | Kling/相關開發團隊 | 擅長生成人物、物體動作與鏡頭運動等影片,也支援複雜的動態表現 |
| Runway | Runway | 可生成宛如電影場景的影像,並加入動態鏡頭運動 |
| Seedance 系列 | ByteDance | 以場景連續性、自然動作及依照提示詞生成影像為特色 |
| HappyHorse 1.0 | Alibaba 相關開發團隊 | 支援結合影像與聲音的生成,以及多鏡頭影像表現 |
| Wan 系列 | Alibaba/Wan 模型團隊 | 可用於維持角色一致性的影像,以及多鏡頭的敘事影片製作 |
平台也列出 Sora、MiniMax Hailuo、Luma Dream Machine、Pollo 自有模型、GPT Image、FLUX 等選項。
同一段提示詞在不同模型中,可能產生不同的質感、動作與鏡頭表現。
請依目標選擇模型,例如寫實影片、動畫,或某種特定動作。
透過同一平台試用多種模型,有助於初學者比較結果,不必為每項服務分別維持訂閱。
價格與商業使用
Pollo AI 採用點數制,會依訂閱的方案,每月提供固定數量的點數。
截至 2026 年 8 月的收費方案如下。
| 項目 | Free | Lite | Pro | Ultra |
|---|---|---|---|---|
| 月繳價格 | $0 | $15.00 | $29.00 | $139.00 |
| 月費(年繳、適用 50% 折扣時) | — | $7.50 | $14.50 | $69.50 |
| 提供點數 | 20 點 | 300 點 | 800 點 | 5,000 點 |
| 同時進行的生成任務 | 1 | 2 | 3 | 6 |
| 商業用途 | 否 | 是 | 是 | 是 |
※ 價格、折扣率及方案內容可能因價格調整或促銷活動而變更。 ※ 官方網站表示 Free 方案提供 20 點,但我實際註冊時並未獲得點數。
不同模型單次生成所需的點數,可能相差很大。
例如,若將上述提供的點數全部用於同一模型,預計可生成的影片或圖片數量如下。
| 模型與生成條件 | Free | Lite | Pro | Ultra |
|---|---|---|---|---|
| Pollo 2.5:720p,每 5 秒消耗 5 點 | 4 支影片 | 60 支影片 | 160 支影片 | 1,000 支影片 |
| Pollo 2:720p,每 10 秒消耗 10 點 | 2 支影片 | 30 支影片 | 80 支影片 | 500 支影片 |
| Seedance 2 Fast:720p,每 5 秒消耗 60 點 | 無法使用 | 5 支影片 | 13 支影片 | 83 支影片 |
| Pollo Image 2.0:每張圖片消耗 2 點 | 10 張圖片 | 150 張圖片 | 400 張圖片 | 2,500 張圖片 |
| Pollo Image 1.6:每張圖片消耗 4 點 | 5 張圖片 | 75 張圖片 | 200 張圖片 | 1,250 張圖片 |
| GPT Image 2:每張圖片消耗 1 點 | 20 張圖片 | 300 張圖片 | 800 張圖片 | 5,000 張圖片 |
模型、時長與解析度的選擇,會大幅影響同一份點數能產出多少內容。
消耗較高的影片設定可能很快用完點數,尤其是在一次生成多個版本時。
先用消耗較低的模型或設定測試構圖與動作,方向確定後,再為需要的鏡頭選擇更高品質的設定。
選擇方案時,也要確認商業使用條件。
如上表所示,Free 方案無法用於商業用途,Lite 以上的付費方案則可商用。
若要用於營利 YouTube 影片、廣告、企業社群帳號或客戶專案,請選擇條款涵蓋預定用途的方案。
Pollo AI 的基本流程與主要工具
Pollo AI 支援日文介面。
不過,從搜尋結果點進網站時,可能會開啟英文版本。
若要切換語言,可捲動至頁面底部,在語言選單中選擇日文。

下方連結會直接開啟日文首頁。
如何製作基本影片
雖然平台有許多工具,基本的影片製作流程並不複雜。
先從以下四個步驟開始。
- 選擇影片生成方式。
- 選擇模型,例如 Pollo 2.5、Seedance 2.0,或目前提供的 HappyHorse 版本。
- 用提示詞描述影片,或上傳圖片。
- 設定時長、解析度與長寬比,然後按下 Generate。

等待幾分鐘後,影片就會完成,即可下載或分享。
下圖是我測試製作的影片轉成 GIF 後的版本。

2026 年 8 月的原文介紹了以下生成模式。
文字或圖片轉影片
用提示詞描述想要的畫面,或上傳圖片讓它動起來。這是適合初次嘗試的起點。
參考素材轉影片
這個模式會根據人物、角色、商品等參考圖片,在維持外觀一致性的同時生成影片,適合讓同一角色在多個場景中登場。
關鍵畫格轉影片
提供開始與結束畫格等關鍵圖片,引導兩者之間的轉場。這讓你能指定鏡頭的起點與終點。
行銷影片
製作用於廣告、社群貼文與行銷活動的影片。
商品影片
用商品圖片製作介紹功能或特色的影片,例如用於網路商品頁、社群貼文或廣告。
虛擬試穿影片
利用服裝或配件圖片,生成模特兒穿戴它們的畫面。這能呈現搭配構想,但生成影片無法證明實際的穿著合身程度。
除了文字轉影片,Pollo AI 也提供角色參考、廣告、商品示範與虛擬試穿的製作流程。
使用 AI Image Shots Generator 製作多角度畫面
生成影片之前,先決定需要哪些場景與構圖。
如果只做一個短鏡頭,可能不需要太多規劃。
但若你想製作這樣的連續動作:
看著商品 → 拿起商品 → 對鏡頭微笑,
分別生成每個鏡頭,可能導致臉孔、服裝或背景出現變化。
AI Image Shots Generator 能協助你先準備可供選擇的構圖。
它會根據參考圖片,產生多種攝影機角度與取景方式的畫面。
先準備同一人物或商品的正面、側面、特寫與較寬廣的畫面,規劃連續鏡頭時就有素材可以挑選。
要開啟這項工具,請先選擇左側選單的 Tools。
再選擇上方的 AI Image Tools,接著開啟 AI Image Shots Generator。

當 AI 圖片分鏡生成功能的畫面出現後,上傳一至四張原始圖片,並輸入提示詞,說明想製作什麼樣的圖片。
接著選擇鏡頭數量。
不過,分鏡數量並非越多越好,各自有以下特色。
- 9 個分鏡:故事發展稍弱,但較容易重視畫質與細節,畫面錯誤也較少。
- 25 個分鏡:較容易重視故事發展,但圖片清晰度稍低,畫面錯誤也較多。
這個示例中,我選擇了九個鏡頭。

這個 AI 圖片分鏡生成功能,應該就是先前以 Pollo Shots 名稱提供的功能。
2026 年 8 月,開啟舊的 /app/shots 網址會重新導向 Image Shots 頁面。
挑選需要的圖片,讓它們動起來,再使用 Adobe Premiere 等編輯工具組合生成的片段。
使用 AI Lip Sync 讓人物或角色說話
對嘴是另一種擴展影片表現的方法。
它會調整人物或角色的嘴部動作,使其與音軌相配。
Pollo AI 可上傳影片,搭配文字轉語音或事先準備的音訊,讓片中的主體說話。
基本操作很簡單。
先選擇左側選單的 Tools。
再選擇上方的 AI Video Tools,開啟 AI Lip Sync。
上傳人物或角色的影片,以及想使用的音訊檔案。

若使用英文,則不需要預先準備音訊檔案,只要以文字輸入台詞,就能讓系統朗讀。
不過,截至本文撰寫時,文字轉語音功能尚未支援日文。
因此,若想讓人物說日文,就必須事先準備日文音訊檔案並上傳。
想讓效果更自然,請從臉孔與嘴部都清楚可見的影片開始。
明顯的側臉、遮住嘴巴的手,或快速動作,都可能增加同步難度。
先選擇正面或略微側向的主體,讓臉孔在畫面中占有足夠大小。
使用 Pollo Agent 規劃製作流程
Pollo AI 也提供影片代理工具 Pollo Agent,操作方式和單一片段生成不同。
一般生成流程是先用提示詞製作一個片段,再產生其他鏡頭,最後依需求組合。
另一方面,使用 Pollo Agent 時,只要說明想製作什麼樣的影片,AI 就會安排所需的製作流程,並直接製作出完整影片。
輸入可以包括想法、圖片、商品網址、腳本與參考資料,在同一段對話中處理多個階段。
例如,你可以從商品網址發展廣告、從腳本製作故事,或建立 UGC 風格的廣告。
2026 年 8 月的原文列出以下 Pollo Agent Skills。
- Photo to Video Ad(照片轉影片廣告)
- URL to Video Ad(網址轉影片廣告)
- Script to Video Ad(腳本轉影片廣告)
- UGC Video Ad(UGC 影片廣告)
- Clone Video Ad(參考廣告仿製)
- Story Video(故事影片)
整個流程不只是在一段提示詞後生成單一片段。
當專案需要多個步驟時,Pollo Agent 會整理提供的資訊,並擬定計畫。
製作中可以要求更換場景或圖片、調整方向,不一定要重新開始整個專案。
這個流程大致分成三個步驟。
- 提供目標與來源素材。
- 讓代理工具分析需求。
- 檢查並修改結果。
以下是我使用代理工具製作示例影片的方式。
首先,我在左側選單選擇 Agent。
接著選擇 Photo to Video Ad,並上傳三張作為虛構商品準備的絨毛玩具圖片。
我用提示詞描述想製作的影片,然後按下 Generate。

代理工具分析商品圖片後提出可能的方向,因此一開始不必指定所有細節。

隨著製作進行,它會詢問預期畫面的細節,我再按照想要的方向回答。
下方影片是這次示例的成果。
可以把一般工具理解為「選擇模型、製作個別片段」,而 Pollo Agent 則讓你透過對話推進整個製作。
由於不必詳細考慮模型選擇或影片結構就能進行製作,即使是第一次製作 AI 影片的人,也容易使用這項功能。
代理專案所消耗的點數,可能高於單次影片生成。
生成與修改時請留意餘額,尤其是在測試多個版本的情況下。
對我而言,這種引導式流程是 Pollo AI 的吸引力之一:不必先熟悉所有製作工具,也能開始創作。
DomoAI 的操作流程與主要功能
除了 Pollo AI,DomoAI 也在 AI 影片創作者之間獲得高度評價。
DomoAI 提供以文字或圖片生成影片、影片轉影片,以及將真人影像轉換成動畫風格等功能。
它也提供對嘴流程,讓人物或角色的嘴部動作配合音訊。
以下示例介紹基本操作與幾項可用功能。
DomoAI 圖片與影片的基本製作流程
先在介面中選擇生成方式,再提供該流程需要的輸入素材。
一般步驟如下。
- 在側欄選擇 AI Image 或 AI Video。
- 輸入提示詞,或上傳所需的圖片、影片。
- 選擇模型或生成方式。
- 設定長寬比、解析度與其他可用選項。
這個示例中,我先製作圖片,再用它們生成影片。
首先準備影片需要的圖片。
在 DomoAI 側欄選擇 AI Image,再從上方選單選擇 Image Editing(圖片編輯)。
我選擇 GPT Image 2,並輸入描述目標圖片的提示詞。
設定長寬比與解析度後,按下 Generate。

我重複操作,製作了三張圖片:一名女性、對話框與標誌。
使用 Seedance 2.0 從圖片生成影片
Seedance 2.0 是這個 DomoAI 示例使用的影片模型之一。
在 DomoAI 的 Image to Video(圖片轉影片)中,可以選擇 Seedance 2.0,以及重視生成速度的 Seedance 2.0 Fast。
我用 Seedance 2.0 為一家虛構的人力招募公司製作廣告。
影片使用的是前一節準備的三張圖片。

提示詞將 image1 視為前景圖層,讓它像自動門一樣從中央向左右打開,同時淡出,露出後方的 image3。
示例也使用了 Seedance 2.0 的音訊生成功能。我把台詞放在提示詞的引號內,要求隨畫面生成旁白。
我先向 ChatGPT 說明想要的動作與結構,藉此準備提示詞。
若要依照圖示流程操作,請在側欄選擇 AI Video,再從上方選單選擇 Image to Video。
選擇 Seedance 2.0,輸入描述影片與動作的提示詞。
設定長寬比、時長、解析度與音訊選項,再按下 Generate。

這樣就產生了前面展示的示例。
2026 年 8 月,更進一步的 Seedance 2.5 也加入了 DomoAI,讓使用者能生成最長 30 秒的影片。
不過,目前它是透過 Omni Reference 提供,因此與在 Image to Video 中使用的 Seedance 2.0,操作方式有所不同。
從 Scenarios 的使用情境開始
DomoAI 也提供 Scenarios(情境範本),協助你開始影片專案。
這些範本依想達成的結果分類,不只是用來撰寫腳本的工具。
Scenarios 頁面提供音樂影片、動漫角色影片、AI UGC 廣告與 AI 分鏡等選項。

選擇符合目標的情境,再提供所需的圖片、影片或其他輸入素材。
部分情境也能調整提示詞、對白或影片內容。
對初學者而言,決定要做什麼,可能和學習撰寫提示詞一樣困難。
觀看情境範本的示例成果,有助於理解可以做出哪些效果。
先用範本製作第一支短片,熟悉流程後,再替換來源圖片或提示詞。
使用 Talking Avatar 讓角色說話
DomoAI 的 Talking Avatar 可生成配合音軌的嘴部動作。
把圖片或影片與音訊結合,就能製作人物或角色的對嘴影片。
基本流程如下。
- 開啟 Talking Avatar,例如從首頁的快捷工具進入。
- 上傳人物或角色的圖片或影片。
- 上傳想使用的語音音訊。
- 需要時,在提示詞中描述表情或身體動作。
- 設定可用的時長選項,然後生成。

Talking Avatar 既可以從單張靜態圖片開始,也可以使用影片。
此外,若想生成原生音訊,也可以使用 Text to Speech(文字轉語音)功能,輸入文字來製作聲音。
當然,它也支援日文,能製作出相當自然的聲音。
這些流程提供多種起點,不必先學會完整的製作工具組,也能開始製作影片。
製作 AI 影片時的注意事項
Pollo AI、DomoAI 等工具帶來創作可能,也需要考慮來源素材與產出內容的使用方式。
其中有兩個面向值得特別留意。
確認既有作品與角色的權利
使用容易辨識的動漫或遊戲角色時,尤其是用於廣告,請謹慎確認權利。
生成新影片,不會消除原作品、圖片或角色特定視覺表達所涉及的權利。
並不是 AI 製作的內容就能自由使用。如果輸出的結果與既有著作物相似,可能被認定為侵害著作權。
日本文化廳在 「AI 與著作權」 頁面提供相關指引。
其指引以既有的相似性與依據既有作品創作等考量,說明如何評估 AI 產出內容。
若用於企業網站、廣告、營利影片或客戶交付,請評估素材是否適合預定的公開方式與商業用途。
避免利用臉孔與聲音誤導他人
對嘴技術可能被濫用,讓真人看似說出從未說過的話。
將他人的臉部照片或影片輸入 AI 進行加工,再發布到社群平台,可能構成嚴重的隱私侵犯,或侵害肖像權、公開權,並可能面臨法律行動。
據報導,日本法務省已於 2026 年 4 月設立專家研討會,研議針對 AI 未經授權使用聲音與臉孔所造成的權利侵害制定新規則,預期未來相關規範會更加明確。
同人創作或沒有收費的社群貼文,也不會自動豁免這些考量。
規劃製作時,可以遵循以下原則。
- 未取得許可,不要使用真人的臉孔或聲音製作對嘴內容。
- 使用自己的素材,或已明確授權該用途的他人素材。
- 依內容情境適當標示 AI 生成畫面。
- 不要捏造可能誤導他人或散布錯誤資訊的發言。
AI 影片工具能協助創作。
創作者仍需要了解來源素材的條件,並審慎決定如何呈現成果。
Pollo AI 與 DomoAI 常見問題
以下回答關於這兩項服務的常見疑問。
Q1. Pollo AI 可以免費使用嗎?
A1. 截至 2026 年 8 月的官方收費頁面顯示,Free 方案提供 20 點。不過,我實際註冊帳號時,不知為何並未獲得這 20 點。 因此,註冊後請確認點數餘額,看看是否能免費試用;若想正式製作影片,也可以考慮付費方案。
Q2. 可以免費試用 DomoAI 嗎?
A3. 是的,DomoAI 可以免費試用。 DomoAI 提供免費試用,根據 2026 年 8 月的官方說明,註冊時會獲得 25 點。可以使用這些點數,嘗試圖片生成、影片生成等功能。 不過,免費使用次數有限。若想持續使用 DomoAI 製作影片,或使用 Seedance 2.0 等消耗較多點數的模型,可以考慮付費方案。DomoAI 提供 Basic、Standard、Pro 等付費方案。
Q3. 這兩項服務支援日文嗎?
A3. 兩項服務都可以使用日文介面與提示詞,但複雜指令不一定每次都能產生預期結果。必要時可把提示詞譯成英文,並比較兩者產出。英文不保證更好;改變措辭或語言,只是可能改變模型對指令的理解方式。
Q4. 可以生成日文對話或旁白嗎?
A4. 可以,但支援情況會依使用的功能與 AI 模型而有所不同。 DomoAI 的 Text to Speech 支援日文,可以製作日文旁白。此外,Seedance 2.0 能同時生成影像與原生音訊。 Pollo AI 也提供支援日文音訊的聲音生成模型與對嘴功能。不過,並非所有影片生成模型或聲音功能都支援日文,選擇模型時請確認是否支援日文音訊。
Q5. 商業使用前要確認什麼?
A5. 請閱讀服務與模型條款,並確認輸入素材的權利。AI 生成不會自動授權你使用既有動漫、遊戲角色或真人照片。用於廣告、企業網站、營利內容與客戶專案前,請同時確認來源圖片、影片、音訊的權利,以及方案的商用條件。
Q6. 只靠 AI 就能製作長影片嗎?
A6. 這兩項服務都沒有像影片剪輯軟體那樣,可透過時間軸進行完整剪輯的功能。因此,需要先製作數秒至十幾秒的片段,再用影片剪輯軟體將它們串接起來。
Q7. 初學者該選擇哪個服務?
A7. 請依需要的流程選擇。Pollo AI 提供多種圖片、影片模型,以及透過對話推進製作的代理工具。DomoAI 則提供圖片動畫、影片風格轉換、Talking Avatar、Scenarios 等依任務分類的選項。各挑一個小型代表任務試作,再依目標比較介面與成果。
這些問題涵蓋入門時需要考慮的主要選擇。
兩項服務都提供將文字與視覺素材轉成影片的方法。
先從短篇專案開始,比較可用工具與模型,逐步建立符合創作目標的流程。


