AI UGC 廣告生成器

一位說出你那句話的創作者,在一間看起來就是廚房的廚房裡,拍得像手機拍的。那張臉、那個房間、那個念法,還有聲音,全部在同一次生成裡到位——沒有另一位演員要約,沒有嗓音要複製,也沒有事後要補的對嘴。
你的第一支免費。不用綁卡。

把廣告寫出來

0 / 7000

This run spends credits — the free clip is 4s · 768P · 16:9.

Sign up free and your first MiniMax H3 clip renders 4s · 768P · 16:9, with sound. A plan raises the ceiling to 15s, 2K and four at a time — the free clip is a size, not a different model.

  • 比例在上面那顆按鈕上設。在提示詞裡寫「9:16 vertical」沒有用——下面五支廣告有三支寫了,回來還是橫的
  • 把要說的話放進引號裡,控制在大約每秒三個字。十個字塞不進兩秒的鏡頭
  • 每一顆鏡頭都給一個起點和一個終點,用秒。一段散文換到的是氣氛;一個鐘換到的是一刀
  • 下週還要用同一位創作者,就附一張臉。一個名字加一段描述在同一支片子裡守得住,跨兩支就守不住

不用綁卡:這一頁上的每一支廣告都不用帳號就能播,而免費帳號可以跑一支你自己的——4 秒、768P,帶聲音,沒有浮水印,可以下載,也可以商業使用。

五支創作者風格的廣告,每一支背後的完整提示詞都在。每一張卡都能打開全文。

AI UGC 廣告:一位創作者在明亮的走廊裡把一瓶精華液舉到手機鏡頭前,直接對著鏡頭說話

整段提示詞就是一個調性

左邊是腳本。右邊是回來的東西。

五支 UGC 廣告,完整提示詞照登,不是摘要

整段提示詞就是一個調性16:9 · 15 秒 · 純文字,沒有參考圖

這裡最短的一段,也是唯一完全沒有分鏡表的一段——一長串關於「看起來要怎樣」的形容詞。它有效,而代價是節奏:刀切在哪裡是模型決定的,而你沒辦法再要一次同樣的安排。想要一塊會動的情緒板的時候有用;當 brief 寫著「鉤子要在第二秒落地」的時候沒用。

UGC-style skincare video featuring a realistic young woman speaking directly to the camera in front of a bathroom mirror while holding a premium facial serum bottle. She smiles naturally, talks about her skincare routine, and demonstrates applying the serum to her face. Authentic, conversational presentation with genuine facial expressions and hand gestures, natural morning light, casual home bathroom setting, clean skincare aesthetic, healthy glowing skin, minimal makeup, smartphone-shot look, candid lifestyle beauty content, soft depth of field, luxury beauty brand feel, vertical 9:16, social media ad quality, highly realistic natural skin texture, not overly retouched.

AI UGC 廣告:一位創作者在明亮的走廊裡把一瓶精華液舉到手機鏡頭前,直接對著鏡頭說話
九個拍點,每個都掛著鐘16:9 · 15 秒 · 純文字——它要了兩張從來沒收到的圖

九個拍點,每一個都有起點、終點,以及她在裡面說的那句話。這就是該抄的形狀。動手之前有兩件事值得注意:它開頭就要 9:16 vertical format,回來卻是橫的,因為畫面形狀是一個控制項而不是一個句子——而且它寫著 use her facial features exactly as shown in her reference photo,卻沒有附任何照片,所以模型乾脆自己編了一位創作者。她在整整十五秒裡都撐住了。她撐不到明天那支廣告。

CHARACTER & WORLD LOCK + FULL 15-SEC MASTER PROMPT A 15-second continuous UGC-style vlog in 9:16 vertical format. Jessy, a woman in her mid-20s — use her facial features exactly as shown in her reference photo, keep everything else about the scene freshly designed — wears an attractive pastel-colored dress (soft lavender, mint, or buttery yellow) that visually pops in contrast against the bubblegum-pink Olipop can. Location: a bright, clean modern kitchen/countertop with soft natural daylight. Product: a can of Olipop Blackberry Vanilla — pastel pink can, magenta blackberry illustration, white vanilla flower, dark green "Blackberry Vanilla" wordmark, "Supports Digestive Health" text near the top, "A New Kind of Soda™" tagline (use the uploaded product photo as the exact visual reference for the can). Style: authentic smartphone UGC vlog, natural handheld feel, realistic skin texture, no over-retouched look. She speaks casual, upbeat, conversational English directly to camera with natural lip-sync. The video follows this exact beat sheet, with clean cuts between each moment: 00:00–00:02 — Front-camera selfie, slight handheld sway, Jessy fans herself lightly in the kitchen, looking for something refreshing, smiles at camera: "Okay I need something fun to drink right now." 00:02–00:04 — Eye-level medium shot, she opens the fridge and pulls out the pink Olipop can, face lighting up with delight: "Ooh, Blackberry Vanilla Olipop — yes please." 00:04–00:06 — Close-up on her hands slowly turning the can, label details ("Prebiotics, Botanics, Plant Fiber") visible: "Prebiotics AND it tastes like dessert? Sold." 00:06–00:08 — Tight macro shot, her fingers pop the tab, condensation and a light fizz mist visible: "Listen to that fizz." 00:08–00:10 — Slow-motion macro shot, pink soda pouring over ice into a clear glass, bubbles rising: "Look how pretty that color is." 00:10–00:12 — Close-up on her face as she sips, eyes lighting up with genuine, pleasantly surprised reaction: "Wait... that's actually so good." 00:12–00:13 — Macro hero shot of the can alone on the counter, condensation dripping, soft bokeh kitchen background, slow subtle push-in, no dialog. 00:13–00:14 — Medium shot, she smiles at camera, can raised slightly at chest height: "Blackberry vanilla was the right call." 00:14–00:15 — Close front-camera selfie, can held beside her face, warm bright smile into the lens: "Go grab an Olipop, seriously." Continuous natural ambient kitchen sound, subtle upbeat pop background music underneath, her voice clear and casual throughout. Consistent face, outfit, and setting across every beat. No text overlays, no captions, no watermarks, no horizontal framing, no changes to the can's design or branding.

AI UGC 廣告:一杯粉紅色的益生元汽水在廚房裡倒進冰塊,剪自一段九拍的 vlog 腳本
十五秒裡八個跳接16:9 · 15 秒 · 1 張參考圖

十五秒裡八顆編了號的鏡頭,等於每 1.9 秒切一刀,再加上一張指名的商品圖,披薩必須照著它長。三句短對白,沒有旁白。片尾卡沒有活下來:第 8 顆鏡頭要一個 Logo 特寫,上面壓著 pizza night = solved,然後切黑;回來的東西還停在她的臉上。最後一秒的字,是該用後製合成的拍點,不是該生成的。

VIDEO PROMPT — "Pizza Night Vlog" (UGC iPhone Style) Duration: 15 seconds | Aspect Ratio: 16:9 | Style: Authentic UGC / iPhone selfie-vlog, handheld, natural light, slight motion blur, TikTok/Reels energy — NOT cinematic, NOT overly polished. Feels like a real creator filmed this on their phone. Product Reference: Use the uploaded Domino's Pepperoni Pizza image as the only product reference. Keep crust thickness, cheese texture, bake color, pepperoni placement, and proportions identical in every cut — no redesigning the pizza. Camera: iPhone 15 Pro front + back camera switching, handheld, natural wobble, autofocus hunting slightly (realistic), vertical-style framing cropped to 16:9, occasional finger near lens edge, natural room lighting + phone flash reflections on the pizza box. Character Description Name (for reference): Mia Awoman in her mid-20s, naturally attractive and beautiful with an approachable, girl-next-door charm — not overly done up. Wavy sandy-blonde hair pulled back loosely, light natural makeup, wearing a cozy oversized cream sweater. Warm, genuine smile, expressive eyes, casual energetic personality like a real lifestyle vlogger. Sits in a softly lit modern kitchen/living room. Shot Breakdown SHOT 1 (0–2s) — The Grab Selfie-angle, she's mid-laugh holding up the Domino's box to camera. Quick jump cut. Dialogue: "Okay so it's officially pizza night—" SHOT 2 (2–4s) — The Open Cut to overhead handheld shot, box flips open, steam rising off the pizza, slight camera shake as she leans in. SHOT 3 (4–6s) — The Zoom Quick zoom-punch into the pizza, phone camera autofocus adjusts naturally, cheese and pepperoni in focus, ambient kitchen sounds. SHOT 4 (6–8s) — The Pull Cut to her hands lifting a slice, natural cheese pull, filmed from a slightly low candid angle like a friend filming across the table. SHOT 5 (8–10s) — The Reaction Cut back to selfie-cam, she takes a bite, eyes widen, quick genuine reaction. Dialogue: "Oh my god, that's so good." SHOT 6 (10–12s) — The Candid Cutaway Jump cut to a close, slightly shaky shot of the pizza box on the counter, her hand grabbing another slice off-frame, casual b-roll energy. SHOT 7 (12–14s) — The Wrap-Up Back to selfie angle, she grins at camera, holding slice up like a toast. Dialogue: "Dominos, y'all know what to do." SHOT 8 (14–15s) — End Tag Quick freeze/cut to the box logo close-up, natural handheld wobble, soft text overlay in casual font: "pizza night = solved 🍕" — cut to black. Look & Feel Warm indoor lighting, slightly grainy natural phone sensor look, imperfect framing, real reactions, minimal dialogue (3 short lines total), authentic pacing with hard jump cuts instead of smooth transitions. Negative Prompt cinematic grade, overly smooth camera moves, studio lighting, professional voiceover, staged acting, CGI look, plastic cheese, distorted pepperoni, extra fingers, warped hands, text glitches, logo distortion, overly polished commercial feel.

AI UGC 廣告:一隻手把一片臘腸披薩從盒子裡拿起來,牽出一條起司絲,拍得像手機素材
一個可以再找一次的創作者16:9 · 15 秒 · 1 張參考圖,身份鎖住

這裡唯一附了一張臉的一段,也是這一頁要把它們分開講的理由。開頭那一句——Preserve her facial identity, hairstyle, eye color, skin tone, body proportions——不是守住她的東西。上傳的那張靜圖才是。拿同一張圖再跑一次這段提示詞,你拿回同一位創作者;再跑一次汽水那一段,你拿回一個陌生人。那就是一支廣告和一個廣告帳號之間的全部差別。

Use the uploaded reference image as the exact character reference. Preserve her facial identity, hairstyle, eye color, skin tone, body proportions, and facial consistency throughout every shot. Create a 15-second ultra-realistic UGC-style beauty advertisement featuring a realistic young woman speaking directly to the smartphone camera in a bright, modern bedroom vanity area with warm morning sunlight, soft neutral décor, and an elegant illuminated mirror. She smiles naturally while holding a premium luxury lip oil with a clear glass bottle and gold cap. In a friendly, conversational tone, she shares why it has become her favorite everyday beauty essential. She opens the product, applies the lip oil with the applicator in front of the mirror, then gently presses her lips together and smiles confidently, showing the glossy natural finish. Capture authentic handheld selfie shots, over-the-shoulder mirror angles, and cinematic close-ups highlighting the crystal-clear bottle, gold cap, soft reflections, applicator, glossy texture, and luxurious packaging. End with her holding the lip oil beside her face while smiling naturally into the camera. Authentic UGC creator content, realistic facial expressions, natural hand gestures, healthy glowing skin, minimal makeup, luxury beauty aesthetic, smartphone-shot realism, subtle depth of field, premium color grading, vertical 9:16, 4K HDR, no text, subtitles, logos, or watermarks.

AI UGC 廣告:一位創作者在打了燈的梳妝鏡前塗唇油,伸長手臂自拍
那個調性是相機,不是調色16:9 · 15 秒 · 純文字

那個調性被寫成一台相機而不是一套調色:DV 16mm 磁帶攝錄機、架在健身包上、對焦慢半拍、變焦笨拙、臉偶爾被切掉。這裡每一樣都是鏡頭真的會做的事,所以它們活得過算圖——而 authenticraw 活不過。六刀、五句台詞,沒有指名任何音樂。

CAMERA: DV 16mm tape camcorder POV. CHASE films herself, occasionally propping the camera on a wall or gym bag. Natural handheld shake, imperfect framing, delayed focus, clumsy zooms, face occasionally cut off. Camcorder never visible. LOOK: Soft blurry tape aesthetic, faint tape noise, bloomed gym lights, flickering auto-exposure, muted contrast, realistic skin. STYLE: Calm post-workout gym vlog. Relaxed, reflective, slightly tired but happy. Slow pacing, natural laughs. CHARACTER: CHASE, Korean idol (20s). Long black hair loosely tied, light post-workout glow, slim athletic build. Modest long-sleeve athletic top, loose joggers/leggings, socks or shoes off, towel around neck, no jewelry. SETTING: Quiet evening gym. Stretching mat, mirror wall, gym bag, protein shake, soft lighting, mostly empty. 15s | 6 Cuts Propped medium: sits on mat, exhales. "Okay, cool-down time." Handheld stretch: hamstring stretch, laughs. "Yeah, that was a lot today." Macro: picks up protein shake, condensation visible. Ambient sound only. Medium: drinks shake, smiles. "Okay, that's actually really good." Close: overhead stretch, rates workout. "I'd give today like an eight out of ten." Selfie: grabs bag and shake, waves. "Alright, I'm heading out—see you guys."

AI UGC 廣告:一位創作者在傍晚空無一人的健身房裡伸展,拿起一瓶乳清,用攝錄機拍的

這是什麼,又不是什麼

一支你可以丟掉的廣告。這就是重點本身。

沒有人需要一支 UGC 廣告。一次測試要的是同一個賣點下的六個鉤子,而贏的那個一定是你猜不到的那個。這個迴圈之所以貴,從來不是剪輯——是每多一個版本,就要演員再演一次。
所以問題不是一個生成出來的創作者贏不贏得了真人。問題是一個版本要多少錢,以及在它不再划算之前,你可以猜錯幾次。

這個類別按席次和按支數收費,而且多半不公布。Arcads 標的是每月 $110 換十支影片——大約每支 $11——而它自己的價格頁回 404,所以你是註冊之後才看到那個數字。Creatify 是每月 $39 換大約 100 點、$99 換 300 點,如果額度用得完,大約落在每支 $1.65–$2,用不完就更貴。再往上就是一次製作:在接案平台上找一位 UGC 創作者是每支 $150–$500,還要加上寫 brief 和等待。
這裡的十五秒是 125 點數,大約 $2.75,而且沒有月費門檻。一個八秒的鉤子是 69 點數。生成失敗會自動退回——當你在測六個開場、預期其中五個會輸的時候,這才是真正算數的那個數字。

Arcads Starter——十支影片,每支約 $11
$110/月

Arcads Starter——十支影片,每支約 $11

Creatify,還沒算圖之前的一個月
$39–$99

Creatify,還沒算圖之前的一個月

給人類 UGC 創作者一份 brief
$150–$500

給人類 UGC 創作者一份 brief

這裡的十五秒,含聲音
約 $2.75

這裡的十五秒,含聲音

  • 不用在兩次測試之間一直付月費席次
  • 不用另外複製嗓音,也沒有對嘴那一趟
  • 任何一層都沒有浮水印,免費那一層也沒有
  • 直式那一版不加價

你放進去什麼

四種選角方式,看你需要幾支

它們跑的是同一個模型、同一個費率。變的是你可以把結果的哪一部分再要一次——而一旦有一個鉤子開始起作用、你需要再來九個像它的,那就是唯一算數的問題。

  • 把創作者寫出來,跑一次

    完全不用上傳。描述鏡頭前是誰,模型就替你選一個角——在那一支片子的長度裡都一致。要弄清楚一個鉤子值不值得拍,這是最快的辦法。上面五支廣告有三支走的是這條路。

    一次性測試 · 文字轉影片
  • 選好一張臉,然後留住她

    附上一張乾淨的正面靜圖,每一次跑回來都是同一位創作者。這就是一支廣告和一個廣告帳號之間的差別:十五個版本、隔一週生成,觀眾讀到的是同一個人。

    同一位創作者,再一次 · 最多 9 張圖
  • 把商品也一起交給它

    創作者在一張圖裡,商品照在另一張。單次請求九張參考圖,就是一張臉加上一輪配色——同樣的腳本、同樣的念法,每一次她手上換一個品項。

    臉 + 商品 · 9 張圖,同一個費率
  • 借一支節奏對的廣告

    給它一段你自己收藏庫裡的片子,它拿走的是切點和鏡頭的行為,不是那段素材本身。當你知道那個贏的節奏、卻描述不出來的時候有用。

    照抄剪法 · 最多 3 段片子

四種的計費完全一樣:768P 一秒 8 點數,2K 一秒 13 點,再加每支 5 點。前五張參考圖免費,第六張起每張 4 點數。每一條限制與費率,附上各自上次變動的日期

從頭到尾

四個步驟做一支 UGC 廣告

大約四分鐘,其中大半花在決定她要說什麼。下面這個順序,就是這些決定實際上必須被做出來的順序——每一個現在都便宜,等你算完九個版本之後就貴了。

  1. 一位創作者在打了燈的梳妝鏡前——每一次生成都會附上的那張靜圖

    寫下第一個字之前,先選好她

    如果這支廣告還有兄弟姊妹,現在就附一張臉。一個名字加一段描述在同一支片子裡守得住創作者,跨兩支就守不住,所以你在第一版喜歡的那段描述,到第四版就是個陌生人。一張乾淨的正面靜圖,每一次都用同一張,就是全部的解法。

    一張正面靜圖每一次跑都重複用它
  2. 一段有時間表的 vlog 腳本裡的近景拍點:手指把汽水罐轉到正標

    每一顆鏡頭都掛上一個鐘

    00:00–00:02… 00:02–00:04… 00:04–00:06… 把秒數寫出來,是決定鉤子會不會落在你要的地方的最大一根槓桿。十五秒八顆鏡頭等於每 1.9 秒切一刀,而那正是動態牆讀起來像真的的那個節奏。

    00:00–00:02大約每 2 秒一刀
  3. 一位創作者在傍晚空無一人的健身房裡,對著架好的攝錄機說到一半

    架好的中景:坐在墊子上,吐一口氣,然後說: 「好,收操時間。」只有健身房的環境音,沒有音樂。

    畫面聲音

    寫那句話,不是寫那句話的描述

    把字放進引號裡,模型就會把它們說出來——聲音是和畫面一起生成的,所以沒有嗓音要訓練,事後也沒有東西要對。抓大約每秒三個字,並且說清楚那個房間底下聽起來是什麼樣。

    一個欄位,兩個聲道大約每秒 3 個字
  4. 一支做好的披薩之夜廣告的最後一個影格,創作者還在鏡頭裡
    對白 + 房間聲 · 32 kHzHOOK-01.MP4

    用 768P 測試,贏的那一支再上 2K

    768P 一秒 8 點數,2K 是 13 點,而把一支做好的 768P 事後升上去,價錢剛好等於一開始就用 2K 算圖——所以你砍掉的那五個鉤子,比你留下的那一個便宜。生成失敗會自動退回。

    768P · 一秒 8 點數2K · 一秒 13 點數

四個步驟,不用安裝,不用綁卡。打開生成器

沒有人會告訴你的那些

五件會讓你賠掉一次算圖的事。沒有一件寫在行銷文案裡。

這幾件每一件都來自上面那五支廣告,不是來自規格表,而且每一件都能拿這一頁印出來的提示詞去核——這已經比類別龍頭願意給你的多了。我們把網路上最大那個 UGC 廣告生成器頁面的 1,596 個可見字讀了一遍:它用到錢字號零次、用到「點數」零次、用到「演員」零次,用到「揭露」也是零次。

  1. 01提示詞設不了畫面形狀

    上面五段提示詞有三段開頭就要 9:16 直式。三段回來的都是 16:9,因為比例是生成器上的一個控制項,而那句話只是多一句描述。在按鈕上設。兩種計費一樣。

    比例是一顆按鈕,不是一句話

  2. 02一個有名字的創作者,不等於一個選好的創作者

    叫她 Jessy,給她一個年紀、一件洋裝、一間廚房,她會撐住十五秒。下週再跑一次,回答同一段描述的是另一個女人。如果這個帳號需要一張認得出來的臉貫穿十幾支廣告,那張臉就必須是一個你附上去的檔案。

    身份 = 一張圖,不是一個名字

  3. 03最後一秒的字是擲銅板

    我們讀過的社群腳本有四段結在一張畫面字卡上——「pizza night = solved」「burger cravings = solved」。我們實際跑的那一段沒有交出來;到第 15 秒,畫面還停在她的臉上。生成表演,片尾卡用後製合成——那在你本來就在用的剪輯軟體裡是三十秒的活。

    片尾卡用後製合成

  4. 04十五秒是硬上限,不是軟的

    產品裡沒有三十秒這個選項,也沒有接片功能。一支必須跑 30 秒的 UGC 廣告,是兩次生成加一刀,而且除非兩邊都附上同一張參考圖,這兩半接不起來。

    4–15 秒,硬的

  5. 05把那一刀落在 8.000 秒上

    H3 在 24 影格每秒下照 17n+5 的影格格線算圖,所以多數長度回來都會長出一點零頭——15 秒其實是 15.083 秒。192 個影格,正好 8.000 秒,是這個區間裡唯一的整秒,所以它是那個能對上音樂床、又不會愈走愈偏的鉤子長度。

    192 個影格 = 8.000 秒

一個八秒的 768P 鉤子是 69 點數,大約 $1.50。六個就是一次測試。在一個每月 $110 換十支影片的方案上,六個已經是你大半的額度。

為什麼不用虛擬人物工具

聲音不是第二件商品

常見的 UGC 疊法是三筆採購:一個素材庫裡的虛擬人物、一個複製出來的嗓音,再加一趟對嘴把兩者黏起來。那正是為什麼那些結果都帶著一種特別的死氣——那張嘴在對的是一段在別的地方錄好的波形。在這裡,那句話是在畫那張臉的同一次生成裡說出來的。

  • 一次生成,兩個聲道

    她不是被配音,她是在說話

    32 kHz 立體聲和畫面一起生成:對白、房間聲、罐子的氣泡聲。沒有嗓音資料庫要授權,沒有對齊那一步,而那句話前面的那口氣,落在一口氣該落的位置。

  • 直式同一個費率

    9:16 和 16:9 一樣價

    六種形狀——21:9、16:9、4:3、1:1、3:4、9:16——全部按秒計費,因為上游按秒計費、不看畫面。每一個平台真正想要的那個版本,不加價。

  • 十二個檔案進來

    一張臉和一件商品在同一個請求裡

    最多 9 張參考圖、3 段片子和 3 個音訊檔,總共 12 個。那就是創作者、商品照、配色,再加一段收藏庫裡用來給節奏的片子,一次呼叫全帶進去。多數通往這個模型的託管入口,並不公布自己的上限。

  • 不用月費

    你付的是秒數,不是一個月

    沒有月費門檻,而且一年之內什麼都不會過期。這個類別的工具從每月 $39 起跳,配演員的那些從 $110 起;這裡是一秒 8 點數,而且一開始就送你一支真的影片。

你放棄了什麼

一個真人,以及跟著真人來的那些文件。一位生成出來的創作者沒有簽過的肖像授權書、約不到下一次,也沒辦法告訴你這個商品真的有用。如果這支廣告靠的是只有顧客才說得出口的一句主張,那就去找一位顧客。這件事取代的,是那六個你本來絕不會付錢請真人拍、只為了搞清楚哪一句開場撐得過動態牆的版本。

它實際上要多少錢

一個八秒的鉤子是 69 點數大約 $1.50。

一支片子固定 5 點數,付的是讀懂提示詞那一趟,再加上 768P 每秒 8 點數、或 2K 每秒 13 點。前五張參考圖免費,所以一張創作者靜圖加一張商品照不會多花錢。一點數就是 MiniMax 自己公布標價的一美分,也就是說整張表都能拿一個本站控制不了的頁面去核。生成失敗會自動退回——這個數字決定了一次六鉤子的測試付不付得起。

一次 UGC 測試按規格算要多少

一支 4 秒鉤子,768P
37 點數
一支 8 秒廣告,768P
69 點數
一支 15 秒廣告,768P
125 點數
一支 15 秒廣告,2K
200 點數
六支 8 秒鉤子,768P
414 點數
十支 15 秒廣告,768P
1,250 點數

完整價格 · 每一條限制與費率,附日期 · 一秒 2K 到底要多少錢

兩種繳法,每月點數一樣

  • 免費免綁卡

    一支真的 MiniMax H3 影片,帶聲音。4 秒 · 768P 之外的一切都靠點數。

    $0永遠

    從頭到尾都不用信用卡

    免費開始

    只驗機器人——不要 email

    在 MiniMax H3 上跑 1 支

    MiniMax H3 · 4 秒 · 768P · 16:9 · 帶聲音
    7 天後回來看看——37 點數,再一支

    $9.9 起的任何一個點數包,都能解鎖 MiniMax H3 AI 影片生成器——每一種輸入方式、768P 和 2K

    • 原生 2K 的 MiniMax H3只有付費
    • 聲音和畫面一起生成只有付費
    • 一支,不用綁卡
    • 一次跑 1 支
    • 跑壞的不收錢
    • 生成內容不公開
    • 任何一個點數包都能解鎖 MiniMax H3 AI 影片生成器的每一種輸入方式

    免費層跑的是另一個引擎。看方案

    速度與排隊

    排隊
    免費通道
    同時任務數
    1
    批次
    1
    紀錄保留
    24 小時 · 登入後 7 天
    支援
    社群
  • Lite省 30%

    用原生 2K 解鎖 MiniMax H3 AI 影片生成器。最小的付費方案——大多數人選的是 Pro。

    $16.9/mo$24.9

    年繳 $202.8 · 一年省 $96

    7 天退款 · 隨時取消

    750 點數 / 月 · 約 20 支影片

    4 秒 · 768P · 文字轉影片

    或 4 秒 2K 約 13 支

    月繳年繳,每月點數一樣

    • 原生 2K 的 MiniMax H3——還有原生音訊
    • 對白、音效與音樂在同一個檔案裡
    • 最長 15 秒15 秒
    • 每月約 20 支 4 秒 768P 的文字轉影片
    • 跑壞的不收錢
    • 點數沒動過,7 天內可退
    • 一次跑 1 個任務
    • 同一段提示詞批次跑 2 個版本

    包含商業使用——涵蓋範圍

    速度與排隊

    排隊
    一般
    同時任務數
    1
    批次
    2
    紀錄保留
    7 天
    支援
    Email · 48 小時
  • 多數人推薦
    Pro省 30%

    比 Lite 多 $32。每月約 47 支影片,同一個 MiniMax H3 AI 影片生成器,排隊更快。

    $39.9/mo$56.9

    年繳 $478.8 · 一年省 $204

    7 天退款 · 隨時取消

    1,775 點數 / 月 · 約 47 支影片

    4 秒 · 768P · 文字轉影片

    或 4 秒 2K 約 31 支

    月繳年繳,每月點數一樣

    • Lite 的全部
    • 每月約 47 支 4 秒 768P 的文字轉影片
    • 同時 3 個任務
    • 影片轉提示詞
    • 同一段提示詞批次跑 4 個版本
    • 紀錄保留 7 天
    • 點數沒動過,7 天內可退

    包含商業使用——涵蓋範圍

    速度與排隊

    排隊
    快速
    同時任務數
    3
    批次
    4
    紀錄保留
    7 天
    支援
    Email · 12 小時
  • Studio省 30%

    整整一個月的量、排隊排在最前面,還有一個 4 小時內回覆的真人。

    $99.9/mo$142.9

    年繳 $1,198.8 · 一年省 $516

    7 天退款 · 隨時取消

    4,425 點數 / 月 · 約 119 支影片

    4 秒 · 768P · 文字轉影片

    或 4 秒 2K 約 77 支

    月繳年繳,每月點數一樣

    • Pro 的全部
    • 每月約 119 支 4 秒 768P 的文字轉影片
    • 同時 8 個任務
    • 同一段提示詞批次跑 4 個版本
    • 紀錄保留 7 天
    • 4 小時內的優先支援
    • 我們給得出的最低點數消耗
    • 點數沒動過,7 天內可退

    包含商業使用——涵蓋範圍

    速度與排隊

    排隊
    優先——排在最前面
    同時任務數
    8
    批次
    4
    紀錄保留
    7 天
    支援
    優先 · 4 小時

你的法務會問到的那一段

一張臉、一句主張,和一條揭露規則

一支 UGC 廣告是一個人看起來在替一個商品背書,那是這個站上受規範最多的一件事。類別龍頭對這些一個字都沒說——整頁下來,肖像、揭露、授權的提及次數都是零。這裡在你花任何錢之前先把立場寫出來。

  • 商業使用包含在內,免費那一支也算。任何一層都沒有浮水印,不按支收授權費,也沒有另外要買的授權。MiniMax 對你生成的產出不主張任何權利,而本站也不自己加上任何一條。
  • 那是誰的臉模型自己編出來的創作者不是任何人,那是安全的那一種。上傳一張真人的照片、讓那些話從他嘴裡說出來,就不是了:你需要他書面同意這個用途——而且好幾個司法管轄區把未經同意的合成背書當成一項獨立的罪,而不是一場授權糾紛。
  • 標示Meta、TikTok 和 YouTube 現在都要求擬真的合成媒體必須標示,而且各自在上傳流程裡都有一個開關。一支讀起來像真人在真廚房裡拍的廣告,正好就是那些規則寫出來要管的內容。把那個框勾起來。
  • 她可以說什麼一段生成出來的見證不是見證。廣告法上關於舉證的規則,不會因為說話的人是模型畫的就放鬆,而一個觀眾會讀成「某個人真實經驗」的「效果」,就得真的是某個人的真實經驗。

完整的負責任使用

在你花任何錢之前

AI UGC 廣告生成器常見問題

一位投放操盤手把一位生成出來的創作者推到付費流量前面之前,會問的八個問題,連背後的數字一起答。

這個 AI UGC 廣告生成器免費嗎?

第一支是,而且跑的是真的模型——4 秒、768P,帶聲音,沒有浮水印,不用綁卡,而且永遠不過期。這一頁上的每一支廣告都不用帳號就能播。之後,一個 8 秒的鉤子是 69 點數,一支 15 秒的廣告是 125 點;點數從 $9.9 起賣,所以一支完整的廣告大約 $2.75。生成失敗不用錢。

我需要另外一個配音或對嘴工具嗎?

不用,而這正是選這個而不是選一套虛擬人物疊法的主要理由。把那句話放進引號裡,它就在畫那張臉的同一次生成裡被說出來——32 kHz 立體聲,房間聲也在。沒有嗓音要複製、沒有波形要上傳,也沒有對齊那一步。如果你手上是一段已經有的片子加一條新的音軌,那是另一個工具:對嘴

同一位創作者可以用在十幾支廣告上嗎?

可以,但只有把她附上去才行。描述一位創作者,只能在同一支片子裡把她攏在一起,跨兩支就不行——上面那支汽水廣告替她取了名字、描述了她,重跑一次就會選到別人。改成每一次生成都附同一張乾淨的正面靜圖。已公開的量測把兩支片子之間、以參考為條件的相似度放在大約 0.54–0.59,所以它是很強的相像,不是一把鎖;角色一致影片 講的就是那實際看起來是什麼樣。

直式會比較貴嗎?

不會。21:9、16:9、4:3、1:1、3:4 和 9:16 每秒費率完全一樣,因為上游按秒收費、不看形狀。在比例那顆按鈕上設——在提示詞裡寫「9:16」沒有用,這一頁五段提示詞裡有三段就是證明。

我可以做一支 30 秒的廣告嗎?

一次生成做不到。範圍是 4 到 15 的整秒,24 影格每秒,所以 30 秒是兩支片子加你在剪輯軟體裡的一刀——而且只有兩邊都附上同一張參考圖,兩半才接得起來。做鉤子測試的話,這個上限很少咬到你;反正付費動態牆上幾乎沒有東西撐得過第三秒。

我一定要在 Meta 或 TikTok 上標示這是 AI 嗎?

要。Meta、TikTok 和 YouTube 各自都要求擬真的合成媒體必須揭露,也各自在上傳流程裡給了那個控制項。一支創作者風格的廣告,正是那些規則描述的情況。我們這邊沒有浮水印,而且每一層都含商業使用權利;標示這件義務是你的,而且不是選配。

我可以上傳一張真人的照片嗎?

只有在他書面同意這個用途的前提下可以。模型自己編出來的創作者不是任何人,不會有肖像問題;一張真的臉說出他從沒說過的一句話,完全是另一回事,而且好幾個司法管轄區把未經授權的合成背書當成一項獨立的罪。如果你是在和一位真的創作者合作,就照你拍片時同樣的方式拿到肖像授權書。

這和 Arcads 或 Creatify 差在哪裡?

那些賣的是一整櫃已取得授權的演員表演,而且按席次收費:Arcads 標的是每月 $110 換十支影片——大約每支 $11——Creatify 則是每月 $39 到 $99 換一份用不完就作廢的額度。你拿到的是真的、已授權的臉,而且是固定的那一批。在這裡,你是把表演寫出來而不是挑出來,聲音跟著畫面一起來,而你付的是一秒 8 點數,沒有月費門檻。如果你要的是一份經過審核的演員名單,這裡比較差;如果你要的是今晚就拿到六個鉤子、而價錢只等於他們的一支,這裡比較好。

今晚六個鉤子,或者一份 brief 加兩個星期。

把鏡頭前是誰、她說什麼、什麼時候說寫出來,廣告回來的時候她的聲音已經在裡面。你的第一支免費——不用綁卡、沒有浮水印,而且可以拿去商業使用。

免費註冊 · 送 1 支 MiniMax H3

MiniMax H3 AI Video Generator 編輯團隊撰寫與維護發布於 最後更新 工具版本 2026.09.4