浪花科技 Roamer Tech浪花科技 Roamer Tech
聊聊需求 ↗
roamer-tech/article.mdCUSTOM SYSTEMS + AI
~/blog/claude-opus-5-5-launch-video-cases.md
AI 自動化與智慧應用 ·

Opus 5.5 做產品發表影片可行嗎?12 個網友實測與一句 prompt 沒說的事

Eric,浪花科技創辦人 / AI 架構師
浪花科技創辦人 · AI 架構師
Opus 5.5 做產品發表影片可行嗎?12 個網友實測與一句 prompt 沒說的事
☰ 目錄 table-of-contents.md
font-size:

下週三新功能要上線,行銷同事希望官網和社群能放一支三十秒的發表影片。問了合作的動態設計師,檔期最快排到下個月;自己打開剪輯軟體,又不知道該從哪一格開始。9 月 22 日 Anthropic 發布 Claude Opus 5.5 之後,X 上突然冒出一整排「用 Opus 5.5 做的發表影片」,很多人看完的第一個念頭大概都一樣:這件事是不是可以自己來了?

我們把這一週有來源可查的案例整理了一輪。答案是可以,但跟貼文標題寫的不太一樣。Opus 5.5 本身不會輸出影片,它寫的是一段會動的網頁程式,再交給 Remotion 或 HyperFrames 這類工具逐格渲染成 MP4。做得好的案例,幾乎都先讓它讀過產品的程式碼、官網或品牌素材,還給了一支參考影片;節奏太快、配樂授權、字卡重疊這幾件事,最後還是人在收尾。手上有網站或 App 程式碼的團隊,幾個小時做出能用的初稿很實際,要拍品牌形象片就還是找專業的人。

Opus 5.5 不會「做影片」,它寫的是會動的程式

先把官方說法和社群說法分開。Anthropic 在 Opus 5.5 官方頁強調的是成本與工作能力:多數工作達到 Claude Fable 5.1 的水準,執行成本比 Opus 5 低約四成,API 牌價每百萬 token 輸入 4 美元、輸出 20 美元。整份公告沒有任何一句提到影片或動畫,最接近的一句是某位測試者讓幾個 Claude 模型用同一句 prompt 做遊戲,Opus 5.5 在畫面與完成度上的得分最高。

模型規格頁也寫得很清楚:它接受文字與圖片,只輸出文字。所以網友口中「Opus 做的影片」,實際流程是它寫出 HTML、CSS 與 JavaScript,或是 React 元件、GSAP 時間軸,再由渲染工具一格一格截下來,用 ffmpeg 接成影片。我們在〈Codex 可以生成圖片嗎〉裡說過,程式碼代理人是工頭,不是畫師;影片也是同一件事,只是這次工頭指揮的是瀏覽器。

Opus 5.5 製作發表影片的流程圖:產品程式碼、品牌素材與參考影片交給模型寫程式,經分鏡靜態圖、抽格自檢到渲染成 MP4,最後由人工收尾節奏、配樂授權與繁中字卡

這一週最常出現的渲染工具有兩個。Remotion 用 React 寫影片,官方整理了一套給 Claude Code、Codex 這類代理使用的 skill;HeyGen 開源的 HyperFrames 走「寫 HTML、渲染成影片」的路線,強調同樣的輸入一定得到同樣的畫面。兩家都沒有專為 Opus 5.5 寫的說明,大家用的都是通用 skill。skill 是什麼、為什麼能讓代理照著一套做法工作,我們在〈把同事煉化成技能包〉介紹過。

「影片就是程式」有個實際的好處,我們做自己的官網時就體會過。浪花科技首頁那幾段情境動畫,每一幕的字幕、步驟和數字都寫在一份設定檔裡,由自己寫的 JavaScript 動畫引擎播放;想改一句字幕,改的是設定檔裡的一行,不用重新剪輯。發表影片寫成程式之後也是一樣,改數字、重新渲染,不必回到時間軸上重拉。代價是每改一次都要重新渲染,這點後面會再講。

這一週的 12 個案例:誰做了什麼、改了幾輪

下面這張表只收有原始貼文或程式庫可查的案例。「來回與時間」一欄是作者自己說的,沒有說就寫未公開;最後一欄是讀這個案例時要記得的前提。

案例做了什麼工具來回與時間讀的時候要記得
Shotbase(Miguel)58 秒 App 發表片HyperFrames自稱一次完成,不到 20 分鐘作者是 HyperFrames 的開發者
BridgeMind 帽T30 秒商品發表片Remotion,沒裝 skill未公開商品圖來源沒說明
Social SDK(Leo)56 秒開發工具發表片Remotion 改 HyperFrames,難段落換 Fable 5.1很多輪作者逐段指定要演什麼
20 秒廣告(@twoclipping)卡 120 BPM 節拍的廣告單一 HTML、Playwright、ffmpeg未公開,prompt 全文公開畫面素材是作者自己的影片
頁讀(王也弱)中英文宣傳片共 8 支Remotion,旁白用 Gemini TTS返工三到四次用掉 20 美元方案一週額度的 22%
Stream(Jurgen Ploeger)48 秒發表片重製給原片與 Figma 檔改了好幾輪作者說節奏還是太快
Dictus(Pivi)32 秒手繪風宣傳片Remotion,參考影片一個工作階段模型自己抓出重複的角色
Browser Use18 秒口播發表片自家的 video-use剪輯那一步 2 分鐘、0.9 美元工具是作者自家產品
三模型對比(yrzhe)同一份官網素材做三版Remotion 或 HyperFramesOpus 版渲染了四次標題重疊的問題沒修掉
動態設計師 Kris12 秒宣傳片Opus 操作 After Effects三到四輪評語是還需要很多功夫
LaunchVideo.io貼網址產出 20 到 40 秒影片Opus 寫 HTML,Playwright 渲染每支約 10 萬 token留言嫌畫面動得太快
OpusClip 實驗室34 個動態元件盲測重製Remotion每個中位數 15 分鐘、自我檢查 5 輪廠商自己測、自己公布

發布當天就爆紅的兩支

第一支幾乎是跟著官方公告一起出現的。HeyGen 的產品工程師 Miguel 在 Opus 5.5 發布後大約 25 分鐘,貼出一支 58 秒的 Shotbase 發表影片,說是用 HyperFrames「一次生成」、花不到 20 分鐘。幾個小時後,BridgeMind 貼出 30 秒的帽T 商品片,用 Remotion 做,作者說沒有裝任何 skill,還補了一句:轉場、節奏和品牌感,比他用 Fable 5.1 或 GPT-6 Astra 做出來的都好。

兩支都好看,讀的時候要記得一件事:Miguel 本身就在開發 HyperFrames,兩位都沒公開 prompt,產品畫面與商品圖從哪裡來也沒說。這一週最紅的幾支片,有不少出自有利害關係的人,後面會再回來談。

把做法攤開的人

比起爆紅的成品,更值得看的是那些把過程寫出來的人。做開源社群 API 套件的 Leo,貼完 56 秒的 Social SDK 發表影片後,又補了七條心得。他先用 Remotion,後來換到 HyperFrames,說後者「不完美、還有一堆 bug」;比較難的段落改用 Fable 5.1;讓代理直接在產品程式碼裡工作,另外給它一套動畫元件庫,再加上官網與品牌素材當參考。七條裡他唯一用全大寫寫的是「DO NOT LET THE AGENT CHOOSE WHAT TO PUT」,要演哪一段、先後順序是什麼,都是他逐段指定,例如「第一段要有一串像 Slack 的對話」。

Social SDK 發表影片畫面:示範 App 同時把一則貼文發到 X 與 Threads 並顯示已發布

圖:Social SDK 發表影片的一格畫面,作者逐段指定要演什麼,並讓代理直接讀產品程式碼與元件庫(截圖來源:Leo(@leodev))

另一個被大量轉用的是 @twoclipping 公開的完整 prompt。它不是一句話,而是分成輸入、方向、結構、製作、常見陷阱幾個區塊的工作說明書:先向使用者要產品名稱、三到五個介面畫面、一個主色、10 到 20 段自己拍的直式影片和一首可商用的音樂;寫程式之前,先交出一份每個鏡頭都對齊節拍格的分鏡;正式渲染前,先抽 20 格以上的畫面檢查。裡面還有一份禁用清單,震波光圈、粒子爆炸、RGB 錯位、鏡頭晃動、鏡頭光暈、霓虹光、格線地板和彈跳緩動全部不准用。最後那支 20 秒廣告卡在 120 BPM 的節拍上,作者說配樂、音效和每一格都是 Opus 自己完成的。

20 秒廣告畫面:三則廣告開場文案依 hook 分數 94、91、88 排序

圖:按 120 BPM 節拍切鏡的 20 秒廣告,完整 prompt 公開,連禁用特效清單都寫進去(截圖來源:@twoclipping)

在 Substack 寫實作筆記的 Danny Stuart 也公開了兩支宣傳片的 prompt,他的結論很務實:介面畫面清晰、時間點準到每一格,任何修改都只是重新渲染而不是重新剪輯;最大的問題是每次重新渲染要等。他在第二支片的 prompt 裡加了一句「寫程式之前先把分鏡規劃好」,並把分鏡這一步列為整個流程裡最不能省的一關(原文)。

跟人工版本正面比

最有參考價值的一組對照來自 Stream 的設計工程師 Jurgen Ploeger。他半年前手工做過一支聊天套件的發表片,這次把原片和 Figma 檔交給 Opus 5.5,讓它用程式重建每一幕並對齊音樂,再把兩個版本上下並排貼出來。構圖、裝置畫面和配色幾乎對得起來,但他也直說,節奏仍然很難抓,很多時候感覺太快,是他給了好幾輪意見才調到對的速度(原貼文)。

Stream 發表片上下對照:上方是設計工程師手工製作的原版,下方是 Opus 5.5 依原片與 Figma 檔重製的版本

圖:上:半年前手工做的 Stream 發表片;下:Opus 5.5 依原片與 Figma 檔重製,作者說節奏仍太快、改了好幾輪(截圖來源:Jurgen Ploeger(@JurgenPloeger))

自介曾在 Apple 擔任十年內部創意主管的動態設計師 Kris,拿同一份分鏡分別交給 MiniMax H3、GPT-6 Astra 搭配 After Effects、Opus 5.5 搭配 After Effects 做一支 12 秒的宣傳片。Opus 那一版改了三到四輪,他的評語是「成果不錯、相當驚艷」,後面接著一句「還需要很多功夫」;而且 Opus 版沿用了 GPT 那次拆好的分層底稿,不是從零開始。

AI 產品經理 yrzhe 用同一份官網素材、同一段簡單說明,讓 Opus 5.5、Fable 5.1 和 OpenAI 的模型各做一支 40 秒宣傳片。他比較喜歡 Opus 的版本:設計感較強、場景銜接順,還會主動刪掉官網上與故事矛盾的範例數字;但他也寫明,片中已知的標題重疊問題最後沒有修掉,交付前哪些問題一定要改,還是得由人說清楚。

規模最大的一組測試是 OpusClip 旗下實驗室做的(這家影音公司的名字剛好也叫 Opus,跟 Claude 無關)。他們只給文字規格、不給原始程式碼,讓 Opus 5.5 盲測重製 34 個原本用 GPT-6 做的發表片動態元件。公開紀錄顯示,每個元件的製作時間中位數 15 分鐘,自我檢查中位數 5 輪。這是廠商自己測、自己公布的結果,沒有第三方評分,當成「做得出來」的證據可以,當成「比較好」的證據就不夠。

OpusClip 實驗室盲測對照海報:左邊是 GPT-6 版本的手持 App 畫面,右邊是 Opus 5.5 只看文字規格重製的版本

圖:OpusClip 實驗室的盲測:只給文字規格,Opus 5.5 重製 GPT-6 版的手持 App 展示鏡頭(右),這是廠商自測結果(截圖來源:Opus Labs(opus-video-studio))

中文圈的案例

目前找到最完整的中文案例,是獨立開發者王也弱替閱讀 App「頁讀」做的宣傳片。他讓 Claude Code 在 App 自己的程式碼裡工作,畫面、轉場、配樂和音效全部用 Remotion 寫成程式,只有旁白交給 Gemini 的語音合成;四支片各做中英文兩版,共 8 支,前後返工三四次,用掉 20 美元方案一週額度的 22%。

閱讀 App 頁讀的宣傳片畫面:手機顯示紅樓夢人物卡,旁邊是簡體中文標語

圖:中文獨立開發者用 Opus 5.5 與 Remotion 替閱讀 App 做的宣傳片,8 支片用掉 20 美元方案一週額度的 22%(截圖來源:王也弱(@WangYeruo))

另一個對照組在 linux.do 論壇:有人只用一句中文 prompt,請 Opus 5.5 用 Remotion 自己畫圖、替他的開源專案做宣傳片。成品的配樂和完成度被稱讚,但留言也說「看不到重點的感覺」,作者自己回:簡單一句話試了一下,雖然確實沒什麼重點(討論串)。這兩個案例放在一起看,差別就在有沒有給它產品本身。

「一句 prompt」的貼文,背後先給了什麼

有人把 X 上 168 個 Opus 5.5 影片案例逐一核對,整理成一份獨立稽核清單。結論是多數「一句 prompt」的案例,背後都有參考影片、現成的 skill、既有的素材、先前的專案脈絡,或是一路按「繼續」的對話。這不代表那些作品是假的,只代表標題省略了準備工作。

看幾個公開 prompt 就懂了。Sherwood 的共同創辦人那句 prompt 確實只有一行,但裡面寫著「可以直接拿官網或 App 的品牌與元件來用」,而且是在網站的程式庫裡執行;Wrapscribe 的作者請它「看完整個程式庫了解功能」;jack friks 那支 9 比 16 的小豬送情書短片,用的是新分支上已經畫好的角色素材。一行字的背後,是一整個專案。

參考影片為什麼比形容詞好用,Anthropic 自己的 Opus 5.5 提示寫作指南有一段講得很直接:沒有給設計方向時,它會退回幾種預設風格;只說「避免 AI 感」多半只是把一種預設換成另一種;明確點名要避開哪些做法,效果才好。@twoclipping 那份禁用特效清單,就是這段話的實作版。

自我檢查是另一個分水嶺。Dictus 的作者 Pivi 讓 Opus 5.5 先把一支參考影片下載下來,用 ffmpeg 切成一張張縮圖格,分析筆觸、抖動的線條和轉場;做完之後,再把每一幕的四到七個關鍵影格拼成一張檢查圖。它自己在檢查圖上發現有個角色重複出現、對話框位置歪掉,然後修好轉場。

Dictus 手繪風宣傳片畫面:月球表面上的手機與吉祥物,標語寫著可以離線使用

圖:Dictus 手繪風宣傳片:Opus 5.5 先拆解參考影片,再把每一幕的關鍵影格拼成檢查圖,自己抓出重複角色並修正(截圖來源:Pivi(@pivi___))

這個「先定方向、每一關都能檢查」的做法,跟我們做網站設計的經驗一模一樣。我們在〈AI 怎麼幫你設計網站〉寫過,直接叫 AI 一步到位做完整個網站幾乎都會失敗,拆成架構、多版設計、定稿、往下長子頁幾關,每一關都有驗收點,成品才控制得住。影片把「一關」換成「分鏡、靜態畫面、抽格檢查、正式渲染」,道理相同。做簡報也有類似的轉念,〈AI 做的簡報總是很醜?〉那篇有完整過程。

還有一件事要放在心上:這一週被轉最多的幾支片,不少出自利害關係人。HeyGen 有兩位參與 HyperFrames 的員工貼了爆紅案例,Anthropic 的 Claude Code 團隊成員也貼了預告片,Browser Use 的創辦人示範的是自家工具,OpusClip 公布的是自家實驗。立場比較中立的專業意見,例如前面那位動態設計師和 Stream 的設計工程師,評價都是正面但保留:做得出來,還要花功夫。

最後還是要人收尾的地方

十二個案例看下來,被提到最多次的人工修改是節奏。Jurgen 覺得太快、改了好幾輪;LaunchVideo 在 Hacker News 的討論串裡,最多人抱怨的也是畫面動得太快;HeyGen 的 Jake Moran 乾脆在 prompt 裡寫「鏡頭推拉維持一點五到三秒、柔和的緩入緩出,速度抓你預設的一半」。如果只能在 prompt 裡多寫一句話,寫節奏。

聲音是第二個坑。Opus 5.5 可以寫程式合成簡單的配樂與音效,Dictus 和小豬短片都是這樣做的;但它能檢查波形與音量,沒辦法真的「聽」,所以旁白與正式配樂多半外包給 ElevenLabs、Gemini 語音合成或 Suno。授權更要小心:@twoclipping 的 prompt 特別寫了只能用可商用的音樂與音效;前陣子很紅的 motion-ad 範本採用 CC BY-NC 4.0 授權,明文禁止商業使用,公司拿來做產品廣告就踩線了。

繁體中文字卡目前沒有公開案例可以參考。我們找到唯一的中文案例是簡體,字型、斷行和字卡停留秒數都沒有繁中的實測。自己做的話,字型要選能嵌入又可商用的,例如採 SIL OFL 授權的思源黑體(Noto Sans TC),標點避頭尾和每張字卡的停留時間,渲染完都要有人從頭看一遍。

最後是時間。Danny Stuart 說整個流程最卡的是重新渲染;一位獨立開發者讓它跑了一整晚,電腦還因為同時開太多工作階段而當機,他估計如果直接走 API,成本會在 50 美元以內。token 的花費通常不是瓶頸,渲染與人看片的時間才是。

台灣團隊該自己做,還是找人做

把案例的條件攤開,判斷其實不難。關鍵不在會不會寫 prompt,在於手上有沒有「產品本身」可以餵給它。

情境建議理由
SaaS 或 App 的新功能上線短片,手上有程式碼與官網可以自己做初稿這一週做得最好的案例都是這種條件
只有一段產品介紹,沒有畫面素材先補素材再做一句話版本常被說看不到重點
品牌形象片、電視或戶外廣告找專業團隊專業動態設計師的評語是還要很多功夫
大量繁中字卡或中文旁白自己做要預留人工檢查沒有公開的繁中案例,字型、斷行、配音都要驗
想直接套熱門範本或 skill先看授權有熱門範本是 CC BY-NC,不能商用

成本方面,公開數字多半是訂閱額度而不是帳單。除了頁讀那 8 支片用掉 20 美元方案週額度的 22%,有人重製官方那支 20 秒發表片花了 14 分鐘、3.98 美元;LaunchVideo 公開的數字是每支片約 10 萬 token,其中輸入約 9 萬、輸出約 1.5 萬,照官方牌價換算約 0.66 美元,這是我們自己算的,不是廠商報價。網路上常被轉貼的「找人做要 8,000 到 10,000 美元、三到四週」,出自一位個人品牌顧問的自述,不是動態設計師的報價,別拿來當比較基準。同時用 Opus 和 Fable 分工的做法,其實就是模型路由,〈LLM 帳單越用越貴怎麼救〉有整理怎麼算。

還沒用過 Claude Code 這類程式代理的團隊,建議先看〈三大 AI Coding Agent 完整比較〉,挑一個工具熟悉之後再來做影片,會少走很多冤枉路。GPT-6 Astra 那邊的實際表現,我們在〈GPT-6 Astra 強在哪裡〉寫過另一個角度。如果想要的不是做一支片,而是讓系統每次發版都自動從更新紀錄產出功能介紹短片,那就是把 Agent 接進發布流程的題目,可以參考我們的 AI Agent 開發。

整體看下來,Opus 5.5 把「做一支像樣的發表影片」的門檻,從找人排檔期降到一個下午,前提是先把產品、素材和方向準備好,並且願意自己當導演,把節奏和細節一輪一輪講清楚。

資料來源與查證日期

本文案例、價格與規格查證於 2026 年 9 月 27 日。社群貼文的觀看數與作者說法可能變動,以原貼文為準;各案例作者的說法未經我們重現,引用時已註明是否為自述或廠商自測。

延伸閱讀

// FAQ

常見問題

Opus 5.5 可以直接生成影片檔嗎?
不行。官方模型規格寫明它只接受文字與圖片、只輸出文字。網友做的發表影片,都是它寫出 HTML、React 或 GSAP 程式,再由 Remotion、HyperFrames 或無頭瀏覽器加 ffmpeg 渲染成 MP4,旁白與正式配樂多半另外用別的工具。
真的一句 prompt 就能做出發表影片嗎?
有人做到,但幾乎都先讓它讀過產品程式碼、官網或品牌素材,或裝了現成的 skill。沒有素材的一句話版本,常見評語是畫面漂亮但看不到重點。我們做 AI 網站設計的經驗也一樣:先定方向與分鏡、每一關都能檢查,來回次數最少。
用 Opus 5.5 做一支發表影片要花多少錢?
公開案例多半用訂閱額度計算:一位中文開發者做 8 支宣傳片,用掉 20 美元方案一週額度的 22%;LaunchVideo 每支約 10 萬 token,照官方牌價換算約 0.66 美元。真正花時間的是重新渲染與人工看片,品牌形象片仍建議找專業團隊。
繁體中文字卡會不會有問題?
目前找不到公開的繁中品牌案例,唯一找到的中文案例是簡體。渲染用的字型要能嵌入且可商用,例如採 SIL OFL 授權的思源黑體;標點避頭尾與字卡停留秒數,渲染完都要有人從頭看一遍,正文有整理要檢查的項目。
#Opus 5.5 #產品發表影片 #Remotion #HyperFrames #AI 動畫 #Anthropic
~/roamer-tech/newsletter FREE
// newsletter

訂閱免費電子報

把 AI 自動化、企業系統設計與 WordPress / Laravel 開發的真實案例和可直接照做的技巧,整理成電子報寄給你。只寄精選內容、不灌垃圾信,一鍵就能退訂。

$ whoami
$ subscribe
⑂ mainarticle.mdLn 1UTF-8