Quelle configuration faut-il ?
Un PC Windows. Pour l'IA locale, une carte NVIDIA d'architecture Pascal ou plus récente, avec un pilote à jour. L'app profile ta carte et débloque ce qu'elle tient vraiment :
- Moins de 6 Go (ou CPU seul) : pas d'IA d'image ni de vidéo locale, mode Stock ou Cloud
- 6 à 8 Go : images IA locales
- 8 à 10 Go : vidéo IA possible mais très contrainte, images IA conseillées
- 10 à 16 Go (ex. RTX 3060 12 Go) : profil vidéo idéal
- 16 Go et plus : modèles lourds, jusqu'à 49 images par plan dès 24 Go
Les modèles se téléchargent au premier lancement, dans la version adaptée à ta carte :
- Moteur IA de base (script, vérification visuelle, voix) : ≈ 7,2 Go sur RTX 3060 12 Go, ≈ 11,3 Go dès 16 Go, ≈ 3,8 Go en version CPU
- Images IA : ≈ 7,6 Go sur RTX 3060 12 Go, ≈ 12,1 Go dès 16 Go
- Vidéo IA : ≈ 9,1 Go en Q8 (RTX 3060 et plus), ≈ 7,1 Go en Q4 (8 Go)
Compte ≈ 24 Go d'espace disque pour le setup complet sur une RTX 3060, ≈ 32 Go sur une carte de 16 Go ou plus. Sans carte adaptée, n'importe quel PC Windows récent suffit pour le mode Stock et le mode Studio GPU Cloud ; le montage se fait toujours en local.
Mon PC est trop juste (portable, bureautique, vieille carte) : je fais comment ?
On ne va pas te vendre du rêve : générer de la vidéo IA sur un processeur ou une vieille carte graphique prendrait des heures ou planterait, l'app ne le tente donc pas. En revanche, tu n'es pas exclu de la vidéo IA :
- Mode Studio GPU Cloud (recommandé) : crée un compte RunPod, crédite-le (10 $ pour commencer), colle ta clé. Tes plans sont générés sur des GPU cloud haut de gamme, facturés à la seconde réelle par RunPod, sans abonnement ni marge : ~0,50 $ par plan en qualité maximale. Astuce : l'IA sur l'accroche et le stock gratuit ailleurs, soit ~1 $ le short.
- Mode Stock : plans Pexels/Pixabay gratuits, vérifiés visuellement par l'IA.
Dans les deux cas, l'app installe un moteur IA local léger (≈ 3,8 Go) : le script, la vérification visuelle, la voix Kokoro et les sous-titres tournent sur ton PC, gratuitement, tout comme le montage et le mix audio.
Le mode 100% local, concrètement ?
Sur une carte RTX, tout tourne sur ton PC, sans clé API et sans rien envoyer sur Internet :
- Script, découpage et vérification visuelle des plans : Qwen3-VL en local
- Images IA : Z-Image-Turbo (~20 s par image sur RTX 3060)
- Plans vidéo IA : Wan 2.2 TI2V 5B en 704×1280 natif (25 images, ~225 s par plan sur RTX 3060)
- Voix : Kokoro, et calage des sous-titres au mot près
- Montage : FFmpeg, mix audio -14 LUFS
Coût : 0 € par vidéo. Contrepartie assumée : un short entièrement en vidéo IA demande de l'ordre de 15 à 20 minutes sur une RTX 3060, parce qu'on privilégie la netteté au chrono. En français, la voix locale est pour l'instant féminine ; les voix masculines sont en préparation (les voix Microsoft gratuites restent disponibles).
Qu'est-ce qui peut passer par des API externes ?
Uniquement ce que tu actives, avec tes propres clés (BYOK) : Kimi K3 ou Claude Sonnet 5 pour le script, RunPod pour la vidéo GPU cloud (Palier 4 FLUX + Wan 2.6, MiniMax Hailuo 02, Pruna), MiniMax Speech 02 HD ou ElevenLabs pour les voix, Pexels/Pixabay pour les vidéos stock, Microsoft pour les voix gratuites en ligne. Les clés sont stockées dans un fichier local et les requêtes partent directement chez chaque fournisseur, sans jamais passer par un serveur LastParadox. Tu paies le prix réel du fournisseur, sans marge : ~0,02 $ de script par short, ~0,50 $ par plan RunPod en qualité maximale. Le coût s'affiche avant chaque appel.
Pourquoi des plans vidéo IA si courts ?
Règle d'or : zéro compromis sur la qualité pro. Au-delà de 1 à 2 secondes sur une carte grand public, les modèles vidéo produisent des visages lissés et des mains qui fondent. L'app génère donc des plans courts en 704×1280 natif, puis les prolonge par un ralenti fluide et un zoom lent cinématique. Résultat : réaliste plutôt que « dessin animé ».
« Mon avatar » et « Mouvement », c'est pour quand ?
Les deux modes sont disponibles depuis la 1.7 (carte NVIDIA dès 12 Go, packs à installer depuis les Réglages). La mise à jour est incluse dans la licence.
- Mon avatar : une photo et un texte, et ton avatar parle avec les lèvres synchronisées (Wan 2.2 anime la photo, MuseTalk refait la bouche). Carte de 12 Go et plus.
- Mouvement : remplace une personne dans une courte vidéo (jusqu'à 5 s) à partir d'une photo, avec Wan 2.2 Animate. Carte de 12 Go et plus, 32 Go de RAM conseillés. Compte environ 15 minutes pour un clip de 2,5 s sur une RTX 3060.
Les deux demandent ton consentement (ton visage, ou l'accord écrit de la personne) et ajoutent la mention « Généré par IA » sur la vidéo.
Les vidéos m'appartiennent ? Je peux les monétiser ?
Oui. Les histoires sont 100% originales (générées, jamais copiées), les plans viennent de tes modèles locaux, de banques libres pour usage commercial (Pexels/Pixabay) ou de modèles génératifs exécutés avec tes clés (RunPod), et les voix sont libres de droits commerciaux. Pas de watermark, pas de restriction : tu monétises librement sur YouTube Shorts, TikTok et Instagram Reels.
Ça marche en français ?
Oui, nativement : scripts FR (modèle local, Kimi K3 ou Claude), voix FR (Kokoro local, Microsoft gratuites, ElevenLabs ou MiniMax HD), sous-titres accentués animés. L'anglais et les autres langues fonctionnent également.
Et si je veux mettre mes propres vidéos ou mon URL/logo ?
Tu peux ajouter tes images et clips dès la première étape : l'IA leur réserve la bonne scène dans le montage. Tu disposes aussi d'un générateur de Stamp CTA viral intégré pour incruster automatiquement un badge néon élégant avec le lien de ton site ou tes réseaux sociaux.