Google lance Gemini Omni 1.1 Flash, une version prête pour la production qui étend les vidéos jusqu’à 40 secondes et ajoute un contrôle précis par images clés.
Browsing: Vidéo IA
Alibaba lance Wan3.0 en bêta : le modèle génère désormais jusqu’à 30 secondes de vidéo à partir de texte, d’images, d’audio ou de documents entiers.
Selon une fuite exclusive de TestingCatalog, Meta testerait en bêta fermée Muse Video, un modèle de génération vidéo avec audio natif. Aucune confirmation officielle pour l’instant.
Black Forest Labs annonce la disponibilité générale de FLUX 3 Video, avec des scores Elo officiels et une grille tarifaire complète, face à Seedance 2.0 et Gemini Omni Flash.
Runway lance Media Router, un routeur de modèles qui choisit automatiquement le meilleur modèle d’image, de vidéo ou d’audio selon le coût et la qualité voulus.
Black Forest Labs lance Flux 3, son premier modèle vidéo avec son natif, déjà préféré à Runway et Luma dans des tests de préférence préliminaires.
Google DeepMind présente GenCeption, un générateur vidéo capable d’égaler des modèles spécialisés de vision par ordinateur avec 500 fois moins de données d’entraînement.
Google franchit une nouvelle étape majeure dans l’ère de l’IA générative avec Gemini Omni, un modèle capable de fusionner texte, images et audio pour produire et modifier des vidéos à la volée.
