L’IA chinoise a tout gagné : le TOP 1, gratuit et (presque) sans limites
Pendant que l’Occident se disputait l’attention, la Chine a avancé en silence. Qwen 3.8 Max, Kimi K3, Seedance 2.5, Vidu S1… Voici le récapitulatif complet, vérifié et corrigé de la vidéo d’Alejavi Rivera — avec le sommaire cliquable et tous les liens officiels.
L’offensive chinoise de l’IA
▶ 00:00« N’aie pas peur d’avancer lentement, aie peur de t’arrêter. » Ce proverbe résume parfaitement la stratégie chinoise dans l’IA. Pendant que l’Occident se déchirait sur la place publique, des entreprises comme Alibaba, ByteDance, Moonshot ou MiniMax ont renversé la table du jeu.
Au programme de cette veille : utiliser gratuitement l’un des meilleurs modèles du moment, générer des images avec du texte lisible, animer ces images en vidéo, créer des vidéos de plusieurs minutes… et même passer un appel vidéo en temps réel avec une IA qui n’existe pas. Le tout déjà disponible, souvent open source, et la plupart du temps sans limites.
💡 Pourquoi c’est important : ce ne sont plus des « alternatives gratuites pour tester », mais bien des modèles qui figurent en tête des classements internationaux (Artificial Analysis, LMArena / Code Arena).
Qwen 3.8 Max : le TOP 1… gratuit
▶ 01:09Alibaba vient de lancer Qwen 3.8 Max, et c’est déjà l’ébullition : les
classements internes d’Alibaba le présentent comme le meilleur modèle actuel, devant des
modèles beaucoup plus chers. Et surprise : les classements externes
(Artificial Analysis, LMArena / Code Arena) le placent également n°1 dans
certaines catégories, notamment en programmation et sur les tâches complexes.
Direction qwen.ai → Qwen Studio (disponible aussi en application
mobile). Et là, la différence qui change tout : contrairement à des modèles comme
Opus ou Fable, ici aucun abonnement payant n’existe sur la plateforme.
Le meilleur modèle d’Alibaba, accessible gratuitement.
Ses points forts en pratique : l’analyse d’images et de vidéos, et toutes ses capacités de programmation.
🎮 Exemple 1 — Recréer un jeu entier depuis une simple vidéo (04:04)
Alejavi partage l’URL d’une vidéo montrant un jeu type « worm/io » où des vers s’affrontent, se mangent et laissent des restes qui font grandir les survivants. Son unique consigne :
Voici la vidéo d'une application. Analyse-la puis reconstruis-la intégralement. Je ne veux te donner aucun indice : fais tout le travail toi-même.
Résultat du premier coup, en un seul fichier HTML : mêmes graphismes, mêmes effets, même physique, mêmes sons… et même le classement en haut à droite avec des joueurs IA. Dans la section « raisonnement » du modèle, on peut lire toutes les étapes détaillées qu’il a suivies pour extraire chaque détail de la vidéo. Zéro prompt supplémentaire.
✈️ Exemple 2 — Un site animé digne d’un pro (05:27)
Deuxième test : un prompt détaillé (sans aucune référence) pour le site d’une compagnie aérienne fictive, avec un avion qui se déplace au scroll. Là encore, du premier coup :
- 🌍 Un globe que l’avion semble parcourir pendant le scroll ;
- 🛫 Une séquence de décollage, des effets de vitesse, un cockpit visible de l’intérieur ;
- 🌀 Un cockpit qui réagit au curseur : bougez vite, et l’avion « traverse des turbulences » ;
- 🌅 Une fin de page qui file vers la lumière.
🔥 Verdict : « Je n’ai jamais obtenu un site aussi pro du premier coup. » On ne parle plus d’une alternative gratuite « pour essayer » : c’est l’un des modèles les plus solides du moment, point final.
Qwen3-TTS : des voix ultra-réalistes, open source
▶ 07:28Alibaba ne s’est pas reposé sur ses lauriers : voici Qwen3-TTS, un modèle de
conversion texte → voix qui permet aussi le clonage vocal. Et cerise sur le
gâteau : il est open source, exécutable dans vos propres outils, voire en local et en
privé. Une démo est disponible sur Hugging Face (Qwen/Qwen3-TTS) avec le
voice design : on décrit la voix, et le modèle l’incarne.
Description : narrateur paniqué, puis de plus en plus étrange
Langue : auto (détectée depuis le texte)
Texte : « Il est dans le tiroir du haut.
Attends… c'est vide ?! Impossible. »🎭 Les voix testées dans la vidéo
😰 Panique
Une voix affolée qui devient peu à peu étrange, générée en espagnol pour prouver le multilinguisme.
🎬 Suspense cinématique
« Ne fais pas de bruit… quelqu’un est de l’autre côté de la porte. » Suivi à la lettre.
📻 Vieux speaker radio
« Bonsoir mesdames et messieurs… ce soir, l’invention qui changera nos vies. »
🤖 Robot ému
Une IA qui découvre les émotions : du ton froid au ton humain. Bluffant.
Chaque résultat est téléchargeable, et vous pouvez aussi cloner votre propre voix gratuitement en vous enregistrant directement depuis l’interface.
Qwen-Image 3.0 : enfin du texte lisible
▶ 10:51Toujours chez Alibaba : Qwen-Image 3.0. Sa promesse : des contenus riches,
des détails authentiques et une compréhension profonde de chaque image. Le gros progrès ?
Le texte lisible dans d’autres langues que l’anglais et le chinois.
- 📊 Infographie futuriste en espagnol sur la course mondiale à l’IA : titres, accents et graphiques parfaitement écrits, style 3D demandé respecté ;
- 📰 Journal de 2050 sur la révolution IA chinoise : impeccable à première vue, mais quelques erreurs possibles dans les tout petits caractères — à vérifier selon vos générations ;
- Des prompts très longs et détaillés parfaitement interprétés (photo réaliste ultra-détaillée).
🖌️ Éditer sans tout régénérer
Piège à connaître : si vous demandez « rends cette femme espagnole » sans activer le mode
édition, le modèle régénère une autre image (place espagnole, café « pan con
tomate »… sympathique, mais pas votre image !). En revanche, via le bouton
edit, l’image d’origine est conservée : regard, contre-jour, grain de peau…
tout reste cohérent, même avec des changements osés comme un tatouage « Made in China ».
🎞️ De l’image à la vidéo
Un bouton Create Video anime directement l’image générée : de l’idée à la
vidéo en quelques clics, sans changer d’outil.
Manus AI : l’agent qui code vos apps web
▶ 14:57Pour transformer une idée en réalité rapidement, Alejavi présente Manus AI
(segment sponsorisé de la vidéo), capable de créer des applications web complètes à
partir d’une simple description. Test avec le modèle Manus 1.6 Max : une
application qui évalue une idée de business (score, recommandations, plan d’action).
🧱 Full-stack
Interface, backend, base de données et accès utilisateurs créés automatiquement, avec preview en direct.
📈 Analytics intégrés
Statistiques et notifications à chaque formulaire complété.
💬 Design par chat
Modifiez le design ou la logique en le demandant simplement, sans toucher au code.
🌐 Publication
Avec le « Max Mode » : mise en ligne directe depuis Manus et domaine personnalisé.
Wan 3.0 : la vidéo réaliste signée Alibaba
▶ 16:41Lancé quelques heures seulement avant l’enregistrement de la vidéo :
Wan 3.0. Au menu, des vidéos très réalistes — combat de personnages animaux avec
physique, impacts et effets sonores, ou encore une pub au rendu professionnel —
jusqu’à 30 secondes.
Sur la plateforme wan.video, attention toutefois : les modèles Wan sont
fermés (pas d’installation locale). Gratuit avec limitations (10 s / 720p), l’option
historique « sans crédits » (plus lente, avec file d’attente) vient d’être retirée, et les
vidéos de plus de 10 s (jusqu’à 30 s) sont réservées aux offres payantes. Une tendance à la
fermeture progressive, à l’opposé des modèles Qwen open source.
😮💨 Petite déception donc sur Wan… mais pas d’inquiétude : la suite du programme contient d’autres modèles vidéo, dont certains sans limites.
Vidu S1 : l’appel vidéo en temps réel avec une IA
▶ 20:13C’est sans doute le moment le plus bluffant de la vidéo. Vidu S1
(vidu.com/vidu-stream) génère de la vidéo interactive en temps réel : vous parlez à un
personnage, et il vous répond en direct, comme s’il y avait une personne derrière
l’écran. Le modèle tourne en 540p jusqu’à 42 FPS sur de simples GPU grand public, avec
personnages personnalisables.
🕶️ La démo en direct
- « Tiens-toi droit » → le personnage s’exécute instantanément ;
- « Mets des lunettes de soleil » → il les enfile en direct ;
- « Salue-moi de la main », « mets ce chapeau » → idem, sans temps de génération.
Testé aussi avec « Sia », jeune actrice fictive de Los Angeles : présentation, gestes, accessoires… tout en temps réel. On ne parle plus de vidéo générée après quelques minutes de calcul, mais d’interaction en direct avec des personnes qui n’existent pas. Demain, vos réunions en visio seront-elles avec des IA ? On s’en rapproche.
MiniMax H3 : la vidéo open source avec audio natif
▶ 22:52Vous avez sûrement vu passer ces scènes recréées de The Office, avec les mêmes
voix et les mêmes visages : c’est MiniMax H3, le premier modèle à poids ouverts
de la gamme Hailuo. Ses spécialités : jusqu’à 12 images de référence fusionnées dans
une seule vidéo, variations de style (même sur vos produits) et audio natif stéréo.
☁️ Dans le cloud (Hailuo Video)
Jusqu’à 15 s et 2K, modes avancés. Existe aussi en plateforme « MiniMax Design ».
🏠 En local (open source)
Poids sur Hugging Face : la variante ~21 Go tourne dès ~12 Go de VRAM. Support ComfyUI dès le jour J.
1. Ouvrir le template « MiniMax H3 » 2. Cliquer sur Install 3. Générer : text-to-video / image-to-video / reference-to-video → Versions communautaires allégées : 5-6 Go de RAM (vidéos ~5 s, mais 100 % locales et privées)
La technologie devient accessible même aux machines modestes : de quoi générer chez soi, en privé, sans abonnement ni crédits.
Seedance 2.5 : des vidéos IA de 3 minutes
▶ 26:24Chez ByteDance, via la plateforme Dreamina, le modèle
Seedance 2.5 fait le buzz : 30 s en mode standard et un mode « longue durée »
(bêta) jusqu’à 180 secondes — environ 3 minutes, bien au-delà des 30 s de Wan. La démo de la vidéo : une séquence de 40 s d’un seul tenant.
✂️ Monter la vidéo comme une image
Autre fonction unique : mettre en pause une vidéo générée, sélectionner un segment et l’éditer (ex. : changer la tenue d’un personnage en cow-girl) — la vidéo est modifiée parfaitement, comme on éditerait une image, mais en vidéo.
Dreamina est une plateforme premium : des crédits gratuits sont offerts, mais insuffisants
pour du 3 minutes (coût élevé). À réserver si vous visez l’une des meilleures qualités
vidéo du marché (aux côtés de Google) et que un abonnement est envisageable. Bonus :
Dreamina pousse aussi son nouveau modèle image, Image 5.0 Pro (famille Seedream),
pour des images réalistes et éditables finement.
Kimi K3 : le roi du frontend, en open source
▶ 28:59Impossible de faire l’impasse sur Kimi K3 de Moonshot : modèle open
source de 2,8 trillions de paramètres, régulièrement cité comme le n°1 du frontend
(premier modèle chinois en tête du Code Arena frontend). Trop lourd pour un ordinateur
domestique, mais utilisable sur différentes plateformes.
Alejavi l’utilise dans OpenCode (l’alternative libre à Claude Code), connecté à l’API Kimi : des crédits payés une fois, consommés jusqu’à épuisement — pratique quand les versions gratuites du site officiel sont saturées aux heures de pointe.
Crée une version 3D de Super Mario Bros : déplacements, saut, course, boules de feu, tortues, fleur de feu, effets — le tout dans un seul fichier HTML.
Résultat du premier essai : un Mario 3D jouable — caméra libre, sauts sur les tortues, fleur qui donne les boules de feu (touche K), effets soignés. Comptez parfois 40 minutes ou plus de génération pour ce niveau de qualité : la version montrée avait été préparée juste avant l’enregistrement. Incroyable, pour un simple prompt.
Le récapitulatif express
| Modèle | Entreprise | Point fort | Accès |
|---|---|---|---|
| Qwen 3.8 Max | Alibaba | Raisonnement, vision & code — gratuit | qwen.ai |
| Qwen3-TTS | Alibaba | Voix réalistes, clonage, open source | Hugging Face |
| Qwen-Image 3.0 | Alibaba | Texte lisible & édition précise | qwen.ai |
| Manus 1.6 Max | Manus | Apps web complètes par description | manus.im |
| Wan 3.0 | Alibaba | Vidéo réaliste & sonore (30 s) | wan.video |
| Vidu S1 | Vidu | Vidéo interactive temps réel (42 FPS) | vidu.com |
| MiniMax H3 | MiniMax | Vidéo open source, audio natif, 12 réf. | hailuoai.video |
| Seedance 2.5 | ByteDance | Vidéos jusqu’à 3 min, édition de segments | Dreamina |
| Kimi K3 | Moonshot | N°1 frontend, open source (2,8T) | platform.kimi.ai |
🌱 Conclusion : toutes ces fonctions avancées se démocratisent et deviennent accessibles à tous. Ce qui fera toujours la différence, c’est la manière dont vous les utilisez.
La vidéo originale & son sommaire
Revoyez la source de cet article : « La IA China Ganó TODO » d’Alejavi Rivera (32 min). Cliquez sur la miniature pour la lire directement ici, ou utilisez le sommaire pour sauter au chapitre de votre choix. 👇
▶ La IA China Ganó TODO — 32:19