Générateur de vidéo ASMR IA

L’ASMR est un genre sonore auquel on a attaché une vidéo, et ce qui le casse, c’est la synchro — un craquement en retard d’un tiers de seconde se lit comme faux et le spectateur le sent. Ici le son est généré dans la même passe que l’image, donc le craquement se produit quand la coque cède vraiment. Stéréo 32 kHz, 4 à 15 secondes d’ASMR, aucune banque de déclencheurs à écumer.

Écrivez le plan

0 / 7000

This run spends credits — the free clip is 4s · 768P · 16:9.

Sign up free and your first MiniMax H3 clip renders 4s · 768P · 16:9, with sound. A plan raises the ceiling to 15s, 2K and four at a time — the free clip is a size, not a different model.

  • Le format est obligatoire pour le texte vers vidéo — adaptive n’est pas une option ici
  • La durée s’aligne sur une grille de 17n+5 images à 24 fps : 192 images (8,000 s) est la seule seconde entière
  • Écrivez `non_diegetic_music: N/A` — tout ce qui est rythmé sous un déclencheur annule l’effet
  • Nommez la matière, pas le son. « Craquement » est ambigu ; « le claquement humide d’une écorce » ne l’est pas

Sans carte : écoutez chaque exemple de cette page avec son prompt complet, puis inscrivez-vous gratuitement et votre premier clip tourne sur MiniMax H3 lui-même — 4 s · 768P, avec le déclencheur généré dans la même passe que l’image. Il n’expire pas.

Cinq clips de la bibliothèque, choisis pour leur déclencheur et non pour leur image. Au casque. Tout ce que vous entendez a été rendu avec les images.

Vidéo ASMR IA d’une extraction d’espresso en macro serrée, la crema qui se rompt sur la tasse6s · 16:9 · 768P

Extraction et tassage

Pourquoi l’ASMR IA rate d’habitude

Pourquoi l’ASMR IA rate : c’est un problème de synchro avant d’être un problème d’image

Le workflow ASMR IA habituel : générer un clip muet, trouver un son déclencheur dans une banque, empiler deux ou trois pistes, puis décaler les pics audio jusqu’à ce qu’ils tombent sur les pics visuels. Chaque étape après la première n’existe que parce que le modèle vous a rendu du silence. Et ce décalage est justement ce qui ne colle jamais tout à fait — un craquement en retard d’un tiers de seconde, le spectateur le ressent avant de savoir le nommer.

Une extraction d’espresso en macro serrée, le son rendu avec les images

Un seul prompt

Image et déclencheur, générés ensemble

Ici le son et les images sortent de la même passe avant, donc ils s’alignent par construction et non par montage. Vous dirigez une scène qui a déjà du son au lieu d’en sonoriser une qui n’en a pas. Cela ne rend pas l’audio automatique — cela déplace le travail dans le prompt, où chacune des trois couches dont le genre a besoin reçoit un emplacement nommé. La section ci-dessous démonte ce champ.

Passe pour l’image et le son
1

Passe pour l’image et le son

Stéréo, pas du mono remonté
32 kHz

Stéréo, pas du mono remonté

Banques de déclencheurs à licencier
0

Banques de déclencheurs à licencier

Clip le plus court — la plupart des sites démarrent à 5
4s

Clip le plus court — la plupart des sites démarrent à 5

  • Aucune banque d’effets à fouiller
  • Aucun pic à aligner à la main dans un éditeur
  • Aucun lit musical à faire ducker sous le déclencheur
  • Aucun filigrane à payer pour retirer

Du prompt à la vidéo

Un prompt, une passe, et le son est arrivé avec l’image

Mettez un casque avant d’ouvrir celui-ci — juger une vidéo ASMR IA sur l’image, c’est la juger sur la mauvaise moitié. L’extraction, la crema qui se rompt et la tasse posée sur la soucoupe n’ont été ni cherchées, ni placées, ni calées — elles sont sorties de la même génération que les images, et c’est pour cela qu’elles tombent sur les bonnes. La carte vous donne le prompt complet, à la durée et au format où il a été fait, pour que vous changiez la matière et le relanciez.

Plus de prompts ASMR ↗
Vidéo ASMR IA d’une extraction d’espresso en macro serrée, la crema qui se rompt sur la tasse16:9 · 6s · 768P

Le prompt complet, pas un résumé

16:9, 6 seconds, 768P. Extreme close-up of espresso pouring into a warm cup under a single soft light, crema breaking across the surface. Slow, steady, no hands in frame.

6s · 16:9

Six secondes, et le son est sur les bonnes images parce qu’il n’a jamais été un fichier séparé

Aucun n’a été tourné pour cette page — ce sont les clips de la bibliothèque au déclencheur le plus fort. Nous préférons vous en montrer cinq honnêtes que cinq mis en scène.

Ce qu’il fait

Trois façons de faire une vidéo ASMR IA

Les trois font de l’ASMR IA sur le même modèle et au même tarif. Ce qui change, c’est la part de sound design que vous écrivez vous-même — et aucune des trois ne finit dans un éditeur audio.

  • Générer une vidéo ASMR IA depuis un simple prompt

    Décrivez la matière ASMR et ce qu’elle fait. Le déclencheur, la texture secondaire et le plancher de la pièce sont trois propositions dans un seul champ.

    4 à 15 s, stéréo 32 kHz
  • Améliorer votre prompt ASMR avec l’IA

    Collez une idée ASMR brute et récupérez la structure à trois champs, avec l’ambiance découpée en couches et le champ musique rempli plutôt que laissé vide.

    Écrit les couches à votre place
  • Chaîne complète, d’un clip de référence à la vidéo

    Déposez un clip ASMR qui vous plaît et récupérez le prompt qui le produirait — y compris la façon dont son son est construit. Puis changez une matière et lancez.

    Référence → prompt → clip

Trois routes, un seul tarif — 8 crédits la seconde en 768P, et l’ASMR n’a aucune raison de quitter le 768P.

Toute la procédure

Comment faire une vidéo ASMR IA en quatre étapes

Pour l’ASMR, l’ordre est l’inverse du conseil vidéo habituel. Écrivez le son d’abord et laissez l’image le suivre, parce que l’image n’a qu’à être plausible tandis que le son doit être juste.

  1. Un croissant ouvert en deux en macro verticale

    Choisissez une matière, pas une humeur

    Verre dépoli, tissu peluché, une plaque d’acrylique, du papier bulle, les dents d’un peigne en bois. Les déclencheurs portés par la matière sont là où ce modèle est le plus solide, et c’est aussi là qu’est le volume du genre. Nommez la substance et le modèle déduit le son ; nommez le son et il doit deviner la substance.

    La matière d’abordAucun visage nécessaire
  2. Le champ d’ambiance ASMR avec les trois couches sonores écrites dedans

    Écrivez trois couches dans un seul champ

    Le déclencheur principal devant, la texture secondaire juste dessous, le plancher de la pièce sous les deux. C’est la structure que tout guide de mixage ASMR vous dit de construire dans un DAW — ici ce sont trois propositions dans le champ d’ambiance, et elles se rendent ensemble.

    DéclencheurTexturePlancher
  3. Un fouet ASMR dans un bol en céramique, sans musique dessous

    Coupez la musique volontairement

    Écrivez `N/A` dans `non_diegetic_music`. Le laisser vide n’est pas la même instruction — le modèle met de la musique quand même, et tout ce qui est rythmé sous un déclencheur annule l’effet que vous cherchez. C’est l’échec le plus fréquent.

    non_diegetic_music: N/A
  4. Du pop-corn ASMR qui s’ouvre au ralenti, chaque pop est un événement

    Rendez 8 secondes et bouclez

    L’ASMR vit de boucles courtes à fort taux de complétion, et 192 images — exactement 8,000 secondes — est la seule seconde entière que le modèle rende, donc la seule durée qui boucle sans raccord. Demandez autre chose et vous rognerez une fraction dans un éditeur.

    192 images8.000sBoucle sans raccord

Rien dans ces quatre étapes ne se passe après le rendu. La passe d’empilage et de calage que le reste de cette catégorie fait tourner dans un DAW est remplacée par un champ écrit dans le bon ordre.

L’ambiance sonore

Cinq vérifications qui décident si votre vidéo ASMR fait des frissons

Chacune tient en une proposition de votre prompt ASMR, et chacune est un échec dont ce genre parle sans arrêt. Passez-les avant de dépenser une prise.

  1. 01Il y a un plancher sous les silences

    Le silence numérique pur entre deux déclencheurs est le détail qui casse l’immersion, parce qu’un vrai enregistrement a toujours un plancher de bruit. Nommez une ambiance ténue et gardez-la sous tout le reste.

    Ambiance sous les deux couches

  2. 02Le champ musique dit N/A

    Vide n’est pas une instruction. Tout ce qui est rythmé sous un déclencheur l’annule — les guides du genre disent eux-mêmes de se passer de musique plutôt que de la mixer discrètement.

    non_diegetic_music: N/A

  3. 03Il y a deux couches de déclencheur, pas une

    Un seul son en boucle se lit comme artificiel en moins de trente secondes. Mettez la vedette devant et quelque chose d’apparenté juste dessous — le couteau qu’on repose, les doigts qui se replacent.

    Principal + secondaire

  4. 04Le son correspond à la matière à l’écran

    Des images d’une substance avec la signature sonore d’une autre cassent l’immersion instantanément. Comme les deux sortent d’une seule passe ici, la seule façon de rater est de nommer la matière vaguement.

    Nommez la substance

  5. 05Personne ne parle

    Le public ASMR veut de l’audio de déclencheur pur. Écrivez pas de parole, pas de narration, pas de voix plutôt que de le supposer — s’il y a une personne dans le cadre, le modèle ajoutera volontiers une voix.

    Pas de parole, pas de narration

Quatre de ces cinq points portent sur le son, et le cinquième sur le fait de faire concorder l’image avec lui. Ce rapport, c’est le genre.

Une compatibilité inattendue

Ce qui rend ce modèle malcommode pour l’horreur le rend juste pour l’ASMR

Nous avons mesuré sept clips officiels H3 pour une raison sans rapport — 2 340 fenêtres d’une demi-seconde — et six d’entre eux n’atteignent jamais un vrai plancher de bruit. Sur notre page horreur, c’est le problème dont parle toute la page, parce que l’angoisse vit dans les silences. Pour l’ASMR, c’est l’exigence.

  • Mesuré

    Il ne vous rendra pas de silence numérique

    Le détail qui casse l’immersion ASMR, c’est un silence où il n’y a rien. L’instinct de ce modèle, c’est du son du début à la fin : l’échec que le genre met le plus d’effort à éviter est ici un échec qu’il faut travailler pour produire.

  • Structurel

    Le prompt a un emplacement par couche

    Déclencheur principal, texture secondaire, plancher d’ambiance — la structure à trois couches que décrit chaque guide de mixage est écrite dans un champ et rendue d’un coup, au lieu d’être assemblée ensuite sur trois pistes.

  • Structurel

    La synchro n’est pas une étape

    L’attaque tombe sur l’image où l’événement a lieu parce que les deux viennent de la même passe. Rien à décaler, et rien qui dérive quand vous relancez à une autre durée.

  • Limite honnête

    L’ASMR chuchoté est le registre faible

    Ce sont les déclencheurs de matière qui tiennent. L’intimité des sons de bouche et le chuchotement de près restent le maillon faible de l’audio généré en général, et c’est vrai ici aussi — pour du parlé, partez plutôt du lip sync.

Le compromis, avant de commencer

Quinze secondes est un plafond dur : une longue séance ASMR ne se rend pas ici — vous rendez la boucle et vous la répétez. Cela convient au format court, là où le genre vit déjà, et pas à une vidéo de sommeil de trente minutes. Si c’est ce que vous faites, ce n’est pas le bon outil, et il vaut mieux le savoir maintenant.

Familles de déclencheurs

Quatre déclencheurs ASMR qui tiennent en quinze secondes

Chaque déclencheur charge un prompt de la bibliothèque à la durée et au format où il a été fait. Les quatre sont des déclencheurs de matière, le registre où ce modèle est le plus solide.

  • Déclencheur ASMR IA : un croissant ouvert en deux en macro verticale, les feuilles qui tombent
    9:16 · 15s

    Cassure nette et déchirure

    Une coque qui cède, puis l’intérieur plus doux. Deux couches dans un même événement, ce qui en fait l’endroit le plus facile pour commencer.

  • Vidéo ASMR d’un fouet en bambou traversant la poudre de matcha, en cadre carré
    1:1 · 15s

    Frottement sec sur émail

    Poudre, bambou et céramique. Presque aucun mouvement, et tout le clip porté par une texture qu’on ne trouverait pas proprement dans une banque.

  • Déclencheur ASMR IA : du pop-corn qui s’ouvre au ralenti, chaque grain est un événement
    9:16 · 8s

    Des pops distincts

    Des événements séparés avec du vrai vide entre eux — le cas où un plancher d’ambiance compte le plus, parce que les silences sont la structure.

  • Vidéo ASMR IA d’un flacon de parfum en macro serrée, le verre contre le verre
    9:16 · 15s

    Verre, métal, vaporisateur

    Des surfaces dures manipulées lentement. Le registre le plus proche du tapping ASMR classique, et celui qui supporte un clip plus long.

Remarquez ce qui manque aux quatre : un visage et une voix. Les déclencheurs de matière sont la niche de départ la plus intelligente pour l’ASMR généré, et ce sont aussi celles que l’algorithme récompense au taux de complétion.

Ce que coûte un lancement

Une boucle de huit secondes fait 69 crédits, et une boucle est ce que vous voulez

Un clip coûte 5 crédits fixes pour la passe qui lit votre prompt, plus 8 crédits la seconde en 768P. L’ASMR n’a aucune raison de quitter le 768P — l’ASMR se regarde au casque sur un téléphone, où la résolution supplémentaire est invisible et où l’audio est tout. Rendez huit secondes, bouclez-les, et mettez la différence dans une seconde matière.

Comment c’est facturé

Facturé à
la seconde produite
Seconde en 768P
8 crédits
Par clip
5 crédits, quelle que soit la durée
Boucle de 8 s en 768P
69 crédits
Rendu échoué
remboursé, sans formulaire
9:16 or 1:1
comme le 16:9

Tous les tarifs · ce que coûte un clip ASMR en 2K, et quand s’en passer.

Mêmes crédits mensuels dans les deux cas

  • GratuitSans CB

    Un vrai clip MiniMax H3, avec le son. Au-delà de 4 s · 768P, on passe aux crédits.

    $0pour toujours

    Aucune carte bancaire à aucun moment

    Commencer

    Simple vérification anti-robot — pas d’e-mail

    1 clip sur MiniMax H3

    MiniMax H3 · 4 s · 768P · 16:9 · avec le son
    7 jours de check-in — 37 crédits, un clip de plus

    N’importe quel pack à partir de $9.9 débloque MiniMax H3 — tous les modes, 768P et 2K

    • MiniMax H3 en 2K natifPayant uniquement
    • Audio natif avec l’imagePayant uniquement
    • Un clip, sans carte
    • 1 clip à la fois
    • Les clips échoués ne coûtent rien
    • Génération privée
    • N’importe quel pack débloque MiniMax H3 sur tous les modes

    Le gratuit, c’est un autre moteur. Voir les forfaits

    Vitesse et file d’attente

    File
    Voie gratuite
    Tâches simultanées
    1
    Lot
    1
    Historique gardé
    24 h · 7 jours une fois connecté
    Support
    Communauté
  • Lite−30 %

    Débloquez MiniMax H3 en 2K natif. Le plus petit forfait payant — c’est Pro que la plupart des gens prennent.

    $16.9/mo$24.9

    $202.8 facturés à l’année · $96 économisés par an

    Remboursement sous 7 jours · annulable à tout moment

    750 crédits / mois · ~20 vidéos

    4 s · 768P · de texte à vidéo

    ou ~13 en 4 s 2K

    Mêmes crédits en mensuel ou en annuel

    • MiniMax H3 en 2K natif — avec l’audio natif
    • Dialogues, effets et musique dans le même fichier
    • Jusqu’à 15 secondes15 s
    • ~20 vidéos par mois en 4 s 768P, de texte à vidéo
    • Les clips échoués ne coûtent rien
    • Remboursé sous 7 jours si crédits non utilisés
    • 1 tâche à la fois
    • 2 variantes d’un même prompt en lot

    Usage commercial inclus — ce que cela couvre

    Vitesse et file d’attente

    File
    Standard
    Tâches simultanées
    1
    Lot
    2
    Historique gardé
    7 jours
    Support
    E-mail · 48 h
  • Recommandé pour la plupart
    Pro−30 %

    $32 de plus que Lite. ~47 vidéos par mois, le même MiniMax H3, file d’attente plus rapide.

    $39.9/mo$56.9

    $478.8 facturés à l’année · $204 économisés par an

    Remboursement sous 7 jours · annulable à tout moment

    1 775 crédits / mois · ~47 vidéos

    4 s · 768P · de texte à vidéo

    ou ~31 en 4 s 2K

    Mêmes crédits en mensuel ou en annuel

    • Tout le forfait Lite
    • ~47 vidéos par mois en 4 s 768P, de texte à vidéo
    • 3 tâches simultanées
    • Extraire le prompt
    • 4 variantes d’un même prompt en lot
    • Historique gardé 7 jours
    • Remboursé sous 7 jours si crédits non utilisés

    Usage commercial inclus — ce que cela couvre

    Vitesse et file d’attente

    File
    Rapide
    Tâches simultanées
    3
    Lot
    4
    Historique gardé
    7 jours
    Support
    E-mail · 12 h
  • Studio−30 %

    Un mois entier de volume, la priorité dans la file, et un humain qui répond en 4 heures.

    $99.9/mo$142.9

    $1 198.8 facturés à l’année · $516 économisés par an

    Remboursement sous 7 jours · annulable à tout moment

    4 425 crédits / mois · ~119 vidéos

    4 s · 768P · de texte à vidéo

    ou ~77 en 4 s 2K

    Mêmes crédits en mensuel ou en annuel

    • Tout le forfait Pro
    • ~119 vidéos par mois en 4 s 768P, de texte à vidéo
    • 8 tâches simultanées
    • 4 variantes d’un même prompt en lot
    • Historique gardé 7 jours
    • Support prioritaire en 4 heures
    • Le coût en crédits le plus bas
    • Remboursé sous 7 jours si crédits non utilisés

    Usage commercial inclus — ce que cela couvre

    Vitesse et file d’attente

    File
    Prioritaire — en tête de file
    Tâches simultanées
    8
    Lot
    4
    Historique gardé
    7 jours
    Support
    Prioritaire · 4 h

Avant de publier

Ce qu’il faut vérifier avant de publier une vidéo ASMR IA

L’ASMR IA pose moins de problèmes de contenu que la plupart des genres, et un problème de transparence de plus.

  • TransparenceDites que c’est généré. Le public ASMR est particulièrement attentif à l’authenticité, et les plateformes détectent de plus en plus l’audio synthétique — un clip annoncé d’emblée n’est pas reçu comme une affirmation sur un vrai enregistrement.
  • VoixNe clonez pas le chuchotement d’un créateur. Une voix identifie, et une voix ASMR plus que les autres — c’est elle que le public suit.
  • Mains et visagesDes mains générées, aucun problème. Une personne réelle et identifiable a besoin de son accord, comme partout ailleurs sur ce site.
  • DroitsL’usage commercial est inclus dans toutes les formules, la gratuite comprise — les clips sont générés via l’API de MiniMax, et MiniMax ne revendique aucun droit sur les Sorties que vous générez.

Politique complète : usage responsable

Les questions qu’on pose vraiment

FAQ du générateur de vidéo ASMR IA

Les huit questions d’ASMR IA qui reviennent le plus, avec les chiffres derrière.

Ce générateur de vidéo ASMR IA est-il gratuit ?

En partie, et la partie gratuite est réelle — et pour ce genre cela compte plus qu’ailleurs. Un compte gratuit reçoit un vrai clip MiniMax H3 avec le son, 4 secondes en 768P, ce qui est tout l’enjeu ici : un clip ASMR muet vous montre l’image et pas le sujet. Il n’expire pas. Sept passages quotidiens rapportent 37 crédits, soit un clip de plus de cette taille. Ensuite, une boucle de 8 secondes en 768P coûte 69 crédits. Sans carte dans les deux cas, et sans filigrane sur aucun palier.

Faut-il quand même ajouter les sons déclencheurs après ?

Non, et c’est la raison d’utiliser ce modèle pour l’ASMR plutôt qu’un modèle muet. L’audio est généré dans la même passe que l’image en stéréo 32 kHz, donc l’attaque tombe sur l’image où l’événement a lieu. Rien à trouver, rien à licencier, rien à recaler.

Pourquoi mon ASMR IA sonne-t-il faux ?

Généralement l’une de trois choses, et les trois sont audio. Il n’y a pas d’ambiance sous les silences, donc le vide entre les déclencheurs est numériquement mort — un vrai enregistrement ne l’est jamais. Ou il y a un seul déclencheur en boucle au lieu d’un principal et d’un secondaire. Ou le champ musique est resté vide, donc le modèle a sonorisé la scène et quelque chose de rythmé s’est installé sous votre déclencheur.

Comment l’empêcher d’ajouter de la musique ?

Écrivez `N/A` dans `non_diegetic_music` — l’échec ASMR le plus courant. Le laisser vide n’est pas la même instruction : le modèle lit un champ vide comme à votre guise, pas comme pas de musique. Ajoutez aussi pas de parole, pas de narration, pas de voix à l’ambiance s’il y a quelqu’un dans le cadre.

Quelle durée pour un clip ASMR IA ?

Un clip ASMR devrait durer huit secondes, puis boucler. Le modèle rend 17n+5 images à 24 fps, donc la plupart des durées tombent sur une fraction — 192 images, exactement 8,000 secondes, est la seule seconde entière de la plage, donc la seule durée qui boucle sans raccord. Le plafond dur est quinze secondes : le contenu de sommeil en format long n’est pas l’usage de cet outil.

Peut-il faire du chuchotement ou des sons de bouche ?

Moins bien que l’ASMR de matière, et cela vaut la peine de le dire franchement. Les déclencheurs de matière — verre, tissu, nourriture, papier, eau — sont là où l’audio généré tient. Le chuchotement de près et les sons de bouche sont le registre le plus faible de l’audio généré en général, pas seulement ici. Si votre format est parlé, partez plutôt du lip sync.

Faut-il rendre l’ASMR en 2K ?

Il y a rarement une raison. L’ASMR se regarde au casque sur un téléphone, l’image est généralement une macro d’une seule matière, et la 2K coûte 1,625× plus cher pour un détail que ce public ne regarde pas. Rendez en 768P et mettez la différence dans une seconde matière.

Peut-il faire du vertical ?

Oui, et sans supplément — ce qui compte, puisque la plupart de l’ASMR est vertical. 9:16, 1:1, 16:9 et 21:9 coûtent la même chose, parce que la facturation se fait à la seconde produite et ignore la forme du cadre. Trois des quatre exemples de cette page sont verticaux ou carrés exactement pour cette raison.

Nommez la matière. Le son vient avec.

Huit secondes, trois couches ASMR, une passe. Inscrivez-vous gratuitement et le premier clip — avec son déclencheur — est pour nous.

Inscription gratuite · 1 clip sur MiniMax H3

Rédigé et tenu à jour par l’équipe éditoriale de MiniMax H3 AI Video GeneratorPublié le Mis à jour le Version de l’outil 2026.09.4