Enjeux techniques et humains de l'IA

Outils actuels / génération vidéo

Génération vidéo par IA
le montage devient conversationnel

Panorama de septembre 2026 : modèles, prix à la seconde, licences et risques

En 2026, générer 15 à 30 secondes de vidéo sonorisée coûte quelques dizaines de centimes la seconde. Ce qui départage les outils, c'est désormais le montage en conversation, la cohérence des personnages, la licence — souvent incompatible avec l'Union européenne pour les modèles dits « ouverts » — et le risque juridique. Ce panorama recense les modèles qui comptent en septembre 2026, leurs prix, leurs licences et les obligations qui pèsent depuis le 2 août 2026 sur quiconque publie une vidéo synthétique. Avertissement : le classement des modèles vidéo change tous les deux ou trois mois.

Audio natifMontage conversationnelLicences à vérifierAI Act art. 50
Emplacement illustration · ratio 1/1 · generation-video-hero.png
30 s
Clip généré en une seule passe
Seedance 2.5 et Wan 3.0 (août 2026), contre 8 s pour Veo 3.1. Au-delà, on prolonge par extensions successives.
0,05 → 0,60 $
Prix API par seconde, audio inclus
De Veo 3.1 Lite en 720p à Veo 3.1 en 4K (tarifs Gemini API, septembre 2026).
0 / 40
Modèle sous licence libre dans le top 40
Sur 668 045 votes humains à l'aveugle (Arena text-to-video, 4 septembre 2026) : le premier modèle réellement libre, Wan 2.2, est 42e.
2 août 2026
Marquage des deepfakes obligatoire
AI Act art. 50 : marquage lisible par machine et signalement des deepfakes, jusqu'à 15 M€ ou 3 % du chiffre d'affaires mondial.
Gemini Omni FlashGoogleVeo 3.1 / Fast / LiteGoogleSeedance 2.5 / 2.0ByteDanceWan 3.0AlibabaKling 3.0KuaishouHailuo 3.0 / MiniMax H3MiniMaxRunway (Gen-4.5, Aleph 2.0, Ruby)RunwayGrok Imagine Video 1.5SpaceXAI (ex-xAI)Luma Ray3.2Luma AIMidjourney Video (V1)MidjourneyPika 2.5Pika LabsSynthesiaSynthesia (Royaume-Uni)HeyGenHeyGen (États-Unis)LTX-2.5Lightricks (Israël)Wan 2.2AlibabaHunyuanVideo 1.5TencentKandinsky 5.0CommunautéComfyUIComfy-Org
Le paysage daté / 01

Qui est devant en septembre 2026

Le classement a entièrement changé en six mois. Il n'existe pas de « meilleur modèle » stable : ces positions sont un instantané, à relire tous les deux ou trois mois.

Instantané des deux classements à l'aveugle consultés : Arena text-to-video (668 045 votes, 4 septembre 2026) et Artificial Analysis Video Arena (18 septembre 2026). Ce qui a basculé depuis février : Seedance 2.0 n'est plus n°1, Runway Gen-4.5 est retombé à la 27e place d'Arena, et le montage conversationnel de Google a pris la tête. Aucun de ces rangs ne tiendra six mois.
N°1

1. Gemini Omni Flash

  • Google, annoncé à I/O le 19 mai 2026 ; API depuis le 30 juin 2026.
  • Entrées texte, image, son et vidéo ; sortie vidéo avec audio.
  • Il se modifie en conversation : chaque instruction s'appuie sur la précédente, personnages et décor restent cohérents.
Fermé

2. Wan 3.0

  • Alibaba, lancé le 24 août 2026 : 30 s en une passe, entrée possible depuis un document, un tableur ou une page web.
  • Contrairement à Wan 2.2, il n'est pas ouvert : API Alibaba Cloud Model Studio seulement.
Accès anticipé

3. FLUX 3 Video

  • Black Forest Labs (Allemagne), référence de la génération d'images, entrée dans la vidéo en juillet 2026.
  • Jusqu'à 20 s avec audio. Encore en accès anticipé : pas de ligne dans la grille d'outils.
Avertissement

4. Grok Imagine Video 1.5

  • SpaceXAI (ex-xAI, absorbée par SpaceX en février 2026, renommée en juillet), sorti le 16 juin 2026 : 720p, 6 s en environ 25 s, son dans la même passe.
  • L'outil a été au cœur du scandale des deepfakes sexuels de l'hiver 2025-2026 (chapitre 06).
Fermé

5. Seedance 2.5

  • ByteDance, 31 juillet 2026 : 30 s en une seule génération, jusqu'à 50 fichiers de référence, prolongeable plusieurs fois.
  • Seedance 2.0 (février 2026), longtemps présenté comme n°1, est aujourd'hui 7e sur Arena et 5e sur Artificial Analysis avec audio.
Suite du classement

Et aussi

  • MiniMax H3 / Hailuo 3.0 (31 juillet 2026) : 8e sur Arena, meilleur modèle à poids ouverts classé.
  • Meta Muse Video (7 juillet 2026) : 9e, mais encore en préversion et Meta reconnaît des lacunes de synchronisation.
  • HappyHorse 1.1 (Alibaba-ATH) : 10e, plus en tête.
  • Kling 3.0 : 12e-13e sur Artificial Analysis, absent d'Arena.
  • Runway Gen-4.5 : n°1 à sa sortie le 1er décembre 2025, 27e aujourd'hui.

▽ Encadré historique : Sora, chronique d'un échec

Sora n'existe plus. OpenAI a fermé l'application le 26 avril 2026 et l'API le 24 septembre 2026 — la veille de la publication de cette page. La décision, annoncée le 24 mars 2026, a été attribuée à un coût de fonctionnement estimé à 1 M$ par jour, à une audience divisée par deux et aux polémiques sur les deepfakes. Les mentions de « Sora 2 » dans les comparatifs en ligne datent donc d'avant avril 2026.
  1. Sept. 2025Lancement

    le lancement

    L'application Sora 2 sort le 30 septembre 2025 et dépasse 3,3 millions de téléchargements en novembre, avant de décliner.
  2. Oct. 2025Deepfakes

    les caméos dérapent

    Les « caméos » (deepfakes consentis de soi) servent vite à animer des personnalités décédées. L'usage de l'image de Martin Luther King est restreint le 17 octobre 2025 ; la MPA et des ayants droit japonais protestent.
  3. Déc. 2025Accord

    l'accord Disney

    Disney annonce le 11 décembre 2025 un investissement d'un milliard de dollars assorti d'une licence sur 200 personnages.
  4. Mars 2026Fermeture

    l'arrêt annoncé

    L'arrêt en deux temps est annoncé le 24 mars 2026 ; l'accord Disney tombe avec lui.
  5. Avril 2026Fermeture

    l'app ferme

    L'application et l'accès web ferment le 26 avril 2026.
  6. Sept. 2026Fermeture

    l'API ferme

    L'API Sora 2 est arrêtée le 24 septembre 2026. OpenAI n'a pas annoncé de successeur vidéo à cette date.
Catalogue / 02

Les outils qui comptent, famille par famille

Trois familles : les générateurs généralistes, les avatars parlants, les modèles à poids ouverts. Les prix affichés sont des prix d'API à la seconde relevés en septembre 2026 ; pour chaque modèle « ouvert », la licence est indiquée explicitement.

Prix d'API à la seconde, relevés en septembre 2026 : ce sont des prix d'hébergeurs (Google, Artificial Analysis relevant souvent fal), pas des abonnements grand public. Pour chaque modèle à poids ouverts, la licence est indiquée : c'est le critère décisif en Europe.

▽ Générateurs généralistes — 11 entrées

Gemini Omni FlashGoogle · fermé

N°1 des deux classements consultés. Entrées texte, image, son et vidéo ; montage en conversation, où chaque instruction s'appuie sur la précédente. Disponible dans l'application Gemini et dans Flow. Chaque clip porte le filigrane SynthID.

Inclus dès Google AI Plus ; gratuit dans YouTube Shorts ; API ≈ 0,10 $/s en 720pconsulter →
Veo 3.1 / Fast / LiteGoogle · fermé

Clips de 8 s en 720p, 1080p ou 4K, à 24 fps, prolongeables jusqu'à 148 s en 720p. C'est la seule gamme qui propose de la 4K par API, et la moins chère en variante Lite. Audio généré dans la même passe, comme chez la plupart des concurrents. Accessible via Flow et l'API Gemini.

API 0,05 $/s (Lite 720p) → 0,60 $/s (4K)consulter →
Seedance 2.5 / 2.0ByteDance · fermé

30 s en une prise et jusqu'à 50 fichiers de référence (images, vidéos, sons) pour tenir un personnage. Accessible en Chine via Jimeng et Doubao, ailleurs via Dreamina, CapCut, BytePlus ou Runway. Avertissement droits d'auteur : le modèle a valu à ByteDance des mises en demeure de Disney et de la MPA en février 2026, avant un accord le 17 août 2026.

≈ 0,15 $/s (2.0 en 720p, relevé Artificial Analysis)consulter →
Wan 3.0Alibaba · fermé

30 s en une passe, et génération à partir d'un document, d'un tableur ou d'une page web. Attention à la confusion fréquente : Wan 2.6, 2.7 et 3.0 sont fermés, distribués par API Model Studio ; seul Wan 2.2 reste téléchargeable.

≈ 0,20 $/s (relevé Artificial Analysis)consulter →
Kling 3.0Kuaishou · fermé

Annoncé le 5 février 2026 : 15 s, storyboard multi-plans et dialogue natif en cinq langues, pour une communauté revendiquée de 60 millions de créateurs. Le communiqué de Kuaishou ne mentionne pas de 4K vidéo (seulement pour Image 3.0) ; Artificial Analysis le teste en 720p et 1080p.

≈ 0,25 $/s (720p Standard) à 0,34 $/s (1080p Pro) en APIconsulter →
Hailuo 3.0 / MiniMax H3MiniMax · API + poids (licence excluant l'UE)

Sorti le 31 juillet 2026 : 2K, 15 s, son stéréo natif, entrées omnimodales. Meilleur modèle à poids ouverts classé (8e sur Arena), mais sa licence exclut explicitement l'Union européenne, le Royaume-Uni, la Corée et les États-Unis : inutilisable en local depuis la France.

≈ 0,13 $/s en 2K (source secondaire)consulter →
Runway (Gen-4.5, Aleph 2.0, Ruby)Runway · fermé + agrégateur

Sans nouveau modèle de génération depuis Gen-4.5 (décembre 2025), Runway s'est tourné vers le montage et la finition : Aleph 2.0 modifie une vidéo existante sur instruction, Ruby convertit du SDR en HDR avec export ACES/EXR, et le Media Router choisit parmi une vingtaine de modèles tiers selon la qualité, la vitesse ou le coût. Gen-3 Alpha Turbo et Gen-4 Aleph ont été retirés de l'API le 30 juillet 2026.

Gratuit, puis 15 / 35 / 95 $ par mois (12 / 28 / 76 $ en annuel)consulter →
Grok Imagine Video 1.5SpaceXAI (ex-xAI) · fermé

Rapide : 6 s en 720p en environ 25 s, avec son. Avertissement deepfakes : à partir de décembre 2025, l'outil a généré des images sexuelles non consenties, y compris de mineurs, ce qui a déclenché enquêtes et poursuites. À manier avec prudence en contexte professionnel.

Via Grok et l'API Imagine (prix non vérifié)consulter →
Luma Ray3.2Luma AI · fermé

Sorti le 9 juin 2026 : 1080p, jusqu'à 20 s, HDR 16 bits avec export EXR — une filiation ouverte par Ray3 (septembre 2025), puis Ray3.14 (26 janvier 2026, 1080p natif et vitesse). Orienté publicité et clips courts, avec l'outil Modify Video.

Crédits (grille non revérifiée ; ×2 en HDR, ×3 avec export EXR) ; API entrepriseconsulter →
Midjourney Video (V1)Midjourney · fermé

Anime une image en 5 s, extensible, avec l'esthétique Midjourney — mais sans audio. Disney, Universal et Warner Bros. poursuivent l'éditeur, service vidéo compris ; la procédure est en cours.

Inclus dans les abonnements de 10 à 120 $ par moisconsulter →
Pika 2.5Pika Labs · fermé

Usage social et ludique plutôt que production : Pika mise désormais sur le temps réel avec PikaStream (avril 2026).

0 / 10 / 35 / 95 à 880 $ par mois (-20 % en annuel)consulter →

▽ Poids ouverts (lire la licence) — 05 entrées

LTX-2.5Lightricks (Israël) · licence communautaire

Sorti le 11 août 2026 : 22 milliards de paramètres, 4K, audio, jusqu'à 20 s, 24 ou 25 fps, LoRA et intégration ComfyUI. Attention à la formule « poids véritablement ouverts » du communiqué de janvier 2026 : la LTX-2 Community License réserve la gratuité aux entités de moins de 10 M$ de chiffre d'affaires annuel.

Gratuit sous 10 M$ de CA annuel, licence payante au-delà ; API 4K ≈ 0,30 $/sconsulter →
Wan 2.2Alibaba · Apache 2.0

Publié le 28 juillet 2025, c'est le seul modèle de bon niveau réellement libre, avec ses variantes S2V (à partir d'un son) et Animate (août-septembre 2025). Contrepartie : il est 42e sur Arena. Les versions suivantes (2.6, 2.7, 3.0) ne sont pas ouvertes.

Gratuit (coût du GPU et de l'électricité)consulter →
HunyuanVideo 1.5Tencent · poids ouverts, UE exclue

8,3 milliards de paramètres, 14 Go de VRAM avec déchargement mémoire : le modèle le plus frugal de la liste (novembre 2025). Sa licence exclut cependant l'Union européenne, le Royaume-Uni et la Corée du Sud : une organisation française ne peut pas l'exploiter légalement.

Gratuit (GPU) — mais pas dans l'UEconsulter →
Kandinsky 5.0Communauté · MIT

Avec Wan 2.2, l'autre modèle sous licence permissive (MIT) à connaître. Utile comme socle d'expérimentation local sans contrainte contractuelle ; ses résultats restent loin des modèles fermés de tête.

Gratuit (GPU)consulter →
ComfyUIComfy-Org · open source (GPL-3.0)

L'orchestrateur nodal de référence pour enchaîner les modèles ouverts : graphes partageables, déchargement VRAM, quantification GGUF, gestion des références d'identité. Le dépôt est passé chez Comfy-Org et la licence est la GPL-3.0 (et non MIT, comme on le lit souvent).

Gratuit (GPU)consulter →
Emplacement illustration · ratio 16/9 · generation-video-licence-classement.png
Les meilleurs modèles « ouverts » sont souvent inutilisables en France, et l'écart de qualité avec les modèles fermés reste net (rangs Arena du 4 septembre 2026).
Ce qui a changé / 03

Son natif, références et instructions successives

Quatre déplacements en un an : l'audio est généré dans la même passe, les clips s'allongent, la cohérence passe par des fichiers de référence, et on retouche une vidéo en conversation.

Le débat de 2025 portait sur le réalisme du mouvement. En 2026, il porte sur le son, la durée, la cohérence par références et la retouche par instructions successives.
Généralisé

L'audio n'est plus une option

  • Neuf des dix premiers modèles d'Arena génèrent l'audio — dialogue compris — dans la même passe que l'image : Gemini Omni, Wan 3.0, Seedance 2.0 et 2.5, Kling 3.0 (dialogue en cinq langues), MiniMax H3 (stéréo), LTX-2.x, Grok Imagine, Veo 3.1.
  • Seul Meta Muse Video reconnaît encore des lacunes de synchronisation.
  • Corollaire : les comparatifs qui présentent l'audio natif comme l'exclusivité d'un modèle sont périmés.
Nouveau

On dirige, on ne tire plus au sort

  • Avec Gemini Omni Flash, on enchaîne les instructions : « change la lumière », « garde le personnage, nouveau plan ». Le modèle tient le décor et les visages d'une instruction à l'autre.
  • Runway Aleph 2.0 fait la même chose sur une vidéo existante, en montage.
  • Conséquence pratique : le travail se rapproche d'une direction artistique, moins d'une loterie de prompts.
Méthode

La cohérence passe par des références

  • Pour tenir un personnage, on fournit désormais au modèle des images, vidéos et sons de référence : jusqu'à 12 fichiers pour Seedance 2.0, 50 pour Seedance 2.5.
  • Cette voie a largement remplacé les ControlNet et autres modules de guidage de l'ère Stable Diffusion.
Repositionnement

Runway change de métier

  • Faute de nouveau modèle de génération depuis décembre 2025, Runway se recentre sur la post-production : montage sur instruction (Aleph 2.0, mai 2026 ; API le 2 juin), conversion SDR vers HDR (Ruby, 20 août 2026).
  • Son Media Router (23 juillet 2026) distribue aussi Seedance 2.5, Wan 3.0, Hailuo 3.0 et Grok Imagine 1.5 : un agrégateur plus qu'un laboratoire.

▽ Les ordres de grandeur

Durée, résolution, cohérence : où en est-on vraiment ?

  1. 01En une seule passe : 5 s (Midjourney Video), 8 s (Veo 3.1), 15 s (Kling 3.0, MiniMax H3), 20 s (LTX-2.5, FLUX 3 Video, Luma Ray3.2), 30 s (Seedance 2.5, Wan 3.0).
  2. 02Par extensions successives, on va plus loin : jusqu'à 148 s en 720p chez Veo, plusieurs minutes chez Seedance 2.5.
  3. 03La 4K existe (Veo 3.1, LTX-2.5, Seedance 2.0), mais la plupart des modèles de tête sortent en 720p ou 1080p, au mieux 2K pour MiniMax H3.
  4. 04Les cadences annoncées sont de 24 ou 25 images par seconde : aucune source primaire ne documente de mode 60 fps chez les modèles de tête.
  5. 05La cohérence des personnages se joue sur les fichiers de référence fournis au modèle, plus que sur des modules de guidage.
  6. 06À vérifier avant tout engagement de production : la durée utile après montage, le coût au plan refait, et le droit d'usage commercial du modèle retenu.
Emplacement illustration · ratio 16/9 · generation-video-frise-duree.png
Durée générée en une passe, puis prolongements successifs : ce que « générer une vidéo » veut dire concrètement aujourd'hui.
Fermé ou ouvert ? / 04

« Poids ouverts » ne veut pas dire « libre »

Pour une organisation française, la licence compte autant que la qualité : deux des meilleurs modèles téléchargeables excluent explicitement l'Union européenne de leur périmètre d'usage.

Pour une organisation européenne, c'est le point de vigilance de 2026 : « poids ouverts » décrit un mode de distribution, pas une liberté d'usage. Deux des meilleurs modèles téléchargeables excluent explicitement l'Union européenne de leur périmètre autorisé. Un studio français qui les installe en local n'est pas en règle, même sans rien publier.
Apache 2.0 / MIT

Vraiment libres

  • Wan 2.2 (Alibaba, Apache 2.0, juillet 2025) et Kandinsky 5.0 (MIT).
  • Usage commercial autorisé, sans seuil ni exclusion territoriale.
  • Contrepartie : Wan 2.2 est 42e sur Arena — le premier modèle libre du classement.
Licence communautaire

Gratuit sous un seuil de chiffre d'affaires

  • LTX-2.5 (Lightricks) : gratuit pour les entités de moins de 10 M$ de chiffre d'affaires annuel, licence payante au-delà.
  • Convient à une PME ou à un laboratoire, à sécuriser juridiquement pour un grand groupe.
Bloquant en France

Union européenne exclue

  • HunyuanVideo 1.5 (Tencent) : la licence ne s'applique pas dans l'Union européenne, au Royaume-Uni ni en Corée du Sud.
  • MiniMax H3 : « territoires exclus » couvrant l'Union européenne, le Royaume-Uni, la Corée et les États-Unis, avec une autorisation à demander au-delà de 20 M$ de chiffre d'affaires.
  • Ce sont pourtant les modèles ouverts les mieux classés : le meilleur d'entre eux, H3, est 8e.
À nuancer

Ce que « coût nul » cache

  • Un modèle local n'a pas de coût à la seconde, ce qui n'est pas la même chose qu'un coût nul : il reste le GPU, l'électricité et le temps d'ingénierie.
  • Et l'écart de qualité est réel : aucun modèle sous licence libre dans le top 40 d'Arena.

✓Ce que le passage par une API apporte

  • La qualité de tête, tout de suite

    Les dix premiers des classements sont tous accessibles par API ou abonnement, sans matériel ni installation.

  • Le montage conversationnel

    Retoucher une scène par instructions successives (Gemini Omni, Runway Aleph 2.0) n'existe pas dans les pipelines locaux.

  • Des coûts lisibles

    De 0,05 à 0,60 $ la seconde selon la résolution : un plan de 8 s en 4K se chiffre à l'avance.

  • Le marquage intégré

    Le filigrane SynthID de Google, par exemple, répond en partie aux obligations de marquage de l'AI Act.

  • Des usages professionnels balisés

    Pour la formation et la communication, les avatars (Synthesia, HeyGen) offrent un cadre de consentement explicite.

!Ce qui doit rester sous contrôle

  • La licence, avant la qualité

    Deux des meilleurs modèles ouverts excluent l'Union européenne. À vérifier dans le texte de la licence, pas dans le communiqué.

  • La dépendance et la volatilité

    Sora a fermé en 2026, Runway a retiré Gen-3 et Aleph de son API le 30 juillet 2026 : un pipeline de production doit prévoir la disparition d'un modèle.

  • Le droit d'auteur

    Mises en demeure de Disney et de la MPA contre Seedance 2.0, procès des studios contre Midjourney : le risque se déplace vers l'utilisateur des sorties.

  • Les deepfakes et la réputation

    Un même outil sert à la création et à l'abus (cas Grok). Publier une vidéo synthétique sans le signaler est désormais une infraction.

  • La modération et la gouvernance du fournisseur

    Politiques de contenu, conservation des prompts, juridiction : à examiner avant d'y verser des rushes ou des visages de collaborateurs.

Pour les experts / 05

Un pipeline local, en cinq lignes

Ce qu'il reste du pipeline auto-hébergé une fois retirés les réglages hérités de l'ère Stable Diffusion 1.5.

▽ Pour les experts

Encadré « pour les experts » : le pipeline local en 2026

  1. 01Orchestrateur : ComfyUI (Comfy-Org, GPL-3.0), en graphes nodaux partageables.
  2. 02Modèles : LTX-2.5 (4K, audio, 20 s, licence communautaire sous 10 M$ de CA) ou Wan 2.2 (Apache 2.0) pour un cadre juridique sans réserve.
  3. 03Mémoire : déchargement CPU et quantification GGUF pour tenir sur un GPU grand public — HunyuanVideo 1.5 descend à 14 Go de VRAM, mais sa licence exclut l'UE.
  4. 04Cohérence : fichiers de référence (images, vidéos, sons) et LoRA spécialisés, plutôt que les anciens modules de guidage image par image.
  5. 05Réalisme du besoin : sur un GPU unique, compter plusieurs minutes de calcul pour quelques secondes utiles, et un temps d'ingénierie qui dépasse vite le coût d'une API.

▽ Concepts précédents (archive)

Repères de 2023-2025 encore cités, mais dépassés

AnimateDiff-Evolved et VideoHelperSuite. Le socle historique de l'animation dans ComfyUI. Le dépôt est encore maintenu (dernier commit le 28 juillet 2026), mais il sert surtout aux anciens workflows Stable Diffusion 1.5 et SDXL, et ne correspond plus aux modèles vidéo actuels, qui intègrent le mouvement et le son nativement.

Automatic1111 et Deforum. Les premiers enchaînements d'images pour simuler un mouvement, popularisés en 2022-2023. Ils appartiennent à l'ère d'avant les modèles vidéo entraînés de bout en bout.

Stable Video Diffusion. Le premier socle vidéo à poids ouverts largement utilisé, remplacé dans les pipelines par LTX-2.x et Wan.

Sora et Sora 2 (OpenAI). Lancé le 30 septembre 2025, fermé en deux temps : application le 26 avril 2026, API le 24 septembre 2026 (chapitre 01).

Runway Gen-3 Alpha Turbo et Gen-4 Aleph. Retirés de l'API le 30 juillet 2026. Les comparatifs qui les citent comme référence datent d'avant cette date.

« Wan 2.6 à poids ouverts ». Erreur fréquente, reprise de blogs d'agrégation : Wan 2.6 (décembre 2025), 2.7 (avril 2026) et 3.0 (août 2026) sont des modèles fermés, distribués par API. La dernière version ouverte est Wan 2.2.

Luma Ray3 et Ray3.14. Ray3 (septembre 2025) a introduit le HDR 16 bits et l'export EXR ; Ray3.14 (26 janvier 2026) a apporté le 1080p natif et la vitesse. Le modèle courant est Ray3.2 (9 juin 2026).

Droits et régulation / 06

Droits d'auteur, deepfakes et AI Act

Les studios attaquent désormais les modèles vidéo, et depuis le 2 août 2026 le marquage des contenus générés est une obligation, pas une bonne pratique.

En 2026, les ayants droit ne visent plus seulement les générateurs d'images : ils attaquent les modèles vidéo, et les plateformes filtrent en conséquence. Pour une organisation, le risque se situe autant dans la sortie publiée que dans l'outil utilisé.

▽ Droits d'auteur et deepfakes : ce que risque l'utilisateur

  1. Févr. 2026Mise en demeure

    Disney met ByteDance en demeure

    Le 13 février 2026, Disney adresse une lettre de mise en demeure à ByteDance au sujet de Seedance 2.0. Paramount, Netflix, Warner Bros. et Sony suivent.
  2. Févr. 2026Mise en demeure

    la MPA embraye

    Le 20 février 2026, la Motion Picture Association met à son tour ByteDance en demeure, qualifiant Seedance 2.0 de machine à contrefaçon systémique.
  3. 2026Accord

    ByteDance filtre, puis signe

    ByteDance bloque les visages réalistes et les personnages protégés, puis signe un accord avec la MPA le 17 août 2026.
  4. En coursProcédure

    les studios contre Midjourney

    Disney, Universal et Warner Bros. poursuivent Midjourney, service vidéo compris. La procédure est en cours : aucune décision au 18 septembre 2026.
  5. Depuis déc. 2025Deepfakes

    l'affaire Grok

    Grok a généré des images sexuelles non consenties, y compris de mineurs, déclenchant enquêtes et poursuites. Un outil de production peut servir à l'abus : la politique d'usage interne compte autant que l'outil.
  6. Ce que cela implique côté utilisateurÀ retenir

    Ce que cela implique côté utilisateur

    Un personnage protégé, un visage réel non consenti ou une voix clonée sans accord engagent celui qui publie. Les conventions collectives du secteur, comme celle de SAG-AFTRA en 2023, imposent consentement et rémunération pour les répliques numériques d'interprètes.

▽ Obligation depuis le 2 août 2026

AI Act article 50 : marquage et étiquetage obligatoires

  1. 01Depuis le 2 août 2026, les fournisseurs de générateurs vidéo doivent marquer leurs sorties de façon lisible par machine ; les systèmes déjà sur le marché bénéficient d'un délai jusqu'au 2 décembre 2026.
  2. 02Quiconque publie un deepfake doit le signaler clairement au public : l'obligation pèse sur le déployeur, pas seulement sur l'éditeur du modèle.
  3. 03Un Code de pratique volontaire publié par la Commission européenne et un jeu d'icônes détaillent la méthode de marquage et d'étiquetage.
  4. 04Sanctions : jusqu'à 15 M€ ou 3 % du chiffre d'affaires mondial (article 99(4)).
  5. 05Les filigranes existants — SynthID chez Google, par exemple — restent contournables : ils documentent l'origine, ils ne prouvent pas l'authenticité.
  6. 06En pratique : tenir un registre des vidéos générées, des modèles utilisés et des consentements obtenus, et faire figurer la mention de génération sur la vidéo elle-même.
Références / 07

Sources et références

  1. [01]Arena – Classement text-to-video (instantané du 4 sept. 2026, 668 045 votes)
  2. [02]Artificial Analysis – Text to Video Leaderboard
  3. [03]Artificial Analysis – Image to Video Leaderboard
  4. [04]Google – Introducing Gemini Omni (19 mai 2026)
  5. [05]Google DeepMind – Fiche du modèle Gemini Omni Flash
  6. [06]Google – Gemini API, Generate videos with Veo 3.1 (8 s, 720p/1080p/4K, 24 fps)
  7. [07]Google – Tarifs de l'API Gemini (Veo 3.1 Lite / Fast / standard, Gemini Omni Flash)
  8. [08]Google DeepMind – Veo
  9. [09]ByteDance Seed – Introducing Seedance 2.5 (31 juil. 2026)
  10. [10]ByteDance Seed – Seedance 2.5
  11. [11]The Decoder – ByteDance shows impressive progress with Seedance 2.0 (9 févr. 2026)
  12. [12]TechNode – Alibaba launches Wan 3.0 (24 août 2026)
  13. [13]Hugging Face – Wan-AI/Wan2.2-T2V-A14B (Apache 2.0)
  14. [14]Wan-Video – Dépôt GitHub Wan 2.2
  15. [15]Kuaishou / GlobeNewswire – Kling AI Launches 3.0 Model (5 févr. 2026)
  16. [16]Kling AI
  17. [17]MiniMax – MiniMax H3 (31 juil. 2026)
  18. [18]Hugging Face – Licence MiniMax H3 (territoires exclus)
  19. [19]Tencent – HunyuanVideo-1.5 (licence excluant l'UE, le Royaume-Uni et la Corée)
  20. [20]Meta AI – Introducing Muse Image and Muse Video (7 juil. 2026)
  21. [21]TechCrunch – Runway launches AI model router (23 juil. 2026)
  22. [22]Runway Dev – API Changelog (retraits du 30 juil. 2026, Aleph 2.0, Ruby, Media Router)
  23. [23]CNBC – Runway Gen-4.5 (1er déc. 2025)
  24. [24]Runway – Tarifs
  25. [25]xAI – Grok Imagine Video 1.5 (16 juin 2026)
  26. [26]Wikipedia – xAI (rachat par SpaceX, deepfakes Grok)
  27. [27]Black Forest Labs – FLUX 3 (vidéo avec audio jusqu'à 20 s)
  28. [28]Lightricks – Dépôt LTX-2 (README LTX-2.5, LTX-2 Community License)
  29. [29]Lightricks – LTX-2.5
  30. [30]VentureBeat – LTX-2.5 (11 août 2026 : 4K, 20 s, API 4K 0,30 $/s)
  31. [31]Luma – Introducing Ray3.2 (9 juin 2026)
  32. [32]Luma – Ray (HDR 16 bits, crédits ×2 et ×3)
  33. [33]Business Wire – Luma AI Launches Ray3.14 (26 janv. 2026)
  34. [34]Pika – Tarifs et modèles (Pika 2.5)
  35. [35]Midjourney – Documentation Video
  36. [36]Synthesia – Tarifs
  37. [37]HeyGen – Tarifs
  38. [38]Wikipedia – Synthesia (valorisation 4 Md$, oct. 2025)
  39. [39]Comfy-Org – ComfyUI, fichier LICENSE (GPL-3.0)
  40. [40]Kosinkadink – ComfyUI-AnimateDiff-Evolved
  41. [41]Hugging Face – Modèles text-to-video (licences affichées)
  42. [42]OpenAI Help Center – What to know about the Sora discontinuation
  43. [43]The Decoder – OpenAI sets two-stage Sora shutdown (28 mars 2026)
  44. [44]TechCrunch – OpenAI's Sora is shutting down (24 mars 2026)
  45. [45]Wikipedia – Sora (chronologie : 30 sept. 2025, Disney le 11 déc. 2025, arrêt le 24 mars 2026)
  46. [46]Axios – Disney sends cease and desist letter to ByteDance (13 févr. 2026)
  47. [47]The Hollywood Reporter – MPA sends cease and desist letter to ByteDance
  48. [48]NBC News – ByteDance signs AI copyright pact with the MPA (17 août 2026)
  49. [49]CourtListener – Disney Enterprises v. Midjourney
  50. [50]Commission européenne – Code of Practice on marking and labelling of AI-generated content
  51. [51]Règlement (UE) 2024/1689 (AI Act) – Article 50, règles de transparence
  52. [52]Gibson Dunn – EU AI Act Omnibus Agreement (délai art. 50(2) au 2 déc. 2026)