Umiros Média — La veille IA quotidienne
- InclusionAI publie LLaDA-Image, générateur ouvert entraîné d'abord sur des images seules — InclusionAI construit son générateur en apprenant d'abord la matière visuelle du monde, avant d'y raccorder le langage, et livre les poids en licence Apache 2.0 sur Hugging Face.…
- Anthropic fait valider la preuve de Fermat par une armée d'agents Claude et par Lean — Le théorème de Fermat était démontré depuis 1995 ; Anthropic a fait traduire cette démonstration en treize millions de lignes de code que le vérificateur Lean a contrôlées une à u…
- Extropic fait tourner un Transformer sur une puce qui calcule avec le bruit thermique — Extropic annonce une puce probabiliste capable de diviser par 139 la dépense énergétique d'un modèle de langage, mais ce chiffre vaut seulement pour un GPU sous-utilisé et un rése…
- Perplexity optimise sa tuyauterie interne pour gagner des millisecondes — Perplexity détaille l'infrastructure qui prépare chaque réponse avant même que le modèle ne parle, avec des gains de latence marqués sur les petites requêtes. Les chiffres restent…
- Microsoft ouvre sa retouche image à la production, à moitié prix de son propre modèle — MAI-Image-2.6 Flash arrive dans Foundry pour éditer une zone précise d'une image sans reconstruire le reste, pour moins de la moitié du prix du modèle principal de Microsoft. La p…
- Google fait tourner sa météo mondiale toutes les heures et vise l'infrastructure cloud — WeatherNext 3 relance une prévision planétaire chaque heure grâce aux images satellites les plus fraîches, contre quatre cycles quotidiens auparavant. L'outil alimente déjà Search…
- Baseten lance un laboratoire pour faire vieillir les modèles ouverts sans les casser — Base Labs veut publier chaque expérience sur l'entretien des modèles ouverts après leur sortie, mémoire, coût, sécurité. Ses propres tests montrent surtout la résistance du problè…
- GPT-6 Astra pilote Blender et Unreal Engine seul, la facture suit — OpenAI lance GPT-6 Astra, un modèle capable d'agir seul dans un navigateur ou un logiciel pendant plusieurs dizaines de minutes. L'autonomie progresse nettement, mais le prix par…
- Invideo installe un assistant de montage dans une vraie timeline pro — Invideo Editor place un assistant capable de dérusher, synchroniser le multicam et retrouver un plan par description dans une timeline multipiste complète, exportable vers Premier…
- Adaption Labs fabrique les données d'entraînement à partir d'une simple description — Invent a Dataset produit des jeux d'entraînement complets depuis une description texte, sans corpus client de départ. Le service abaisse le coût d'entrée pour personnaliser un mod…
- IFM publie K2 Horizon en gamme complète et documente ses propres tricheries aux tests — Six modèles ouverts, du format montre au colosse à 375 milliards de paramètres, avec poids, données et code publiés sur Hugging Face. L'institut d'Abu Dhabi va jusqu'à révéler que…
- Respan masque les données personnelles avant l'IA, sans prouver l'anonymat — Respan ajoute un filtre qui retire noms et coordonnées avant qu'une requête n'atteigne un modèle d'IA, sans toucher au fond du texte. La démonstration chiffrée reste maison, et ri…
- Runway fait avancer une scène pendant qu'on tape encore les commandes — GWM Worlds 2 génère un flux vidéo et sonore continu que l'on pilote en direct, touche par touche, sans repartir d'un nouveau clip à chaque instruction. Runway admet lui-même que l…
- UNREEL écrit le film plan par plan, pendant que le spectateur regarde — UNREEL diffuse une introduction toute faite puis génère la suite du programme au fil de la séance, chaque plan repartant de la dernière image du précédent. Le tarif public de l'in…
- Vivix-W1 transforme la vidéo générée en session qu'on pilote en direct — Vivix-W1 ne livre plus une vidéo figée après une instruction unique, il maintient un flux ouvert où chaque clic, chaque image ajoutée ou chaque phrase orale réoriente la suite san…
- NVIDIA met 12,93 milliards sur la table et s'installe au cœur des modèles ouverts — NVIDIA rachète Hugging Face pour 12,93 milliards de dollars, soit près de 86 fois son revenu annuel estimé. Le fournisseur de puces prend le contrôle du principal lieu où les modè…
- Orbis laisse diriger une vidéo generative pendant qu'elle tourne encore — Visko lance Orbis, un modèle vidéo qui accepte une nouvelle instruction pendant la diffusion et ne revient jamais sur ce qui a déjà été montré. La mémoire du système s'use avec le…
- PII-Tracer traque les identifiants personnels jusqu'à leur dixième réapparition — Perplexity présente un petit modèle capable de repérer un nom, un email ou un numéro de téléphone même s'il ressurgit quinze messages plus tard dans une conversation, avant tout e…
- Anthropic cadre ses agents commerciaux, rédaction de campagnes comprise — Anthropic publie une architecture de référence pour des agents qui comparent des offres, préparent un panier ou rédigent une promotion, avec validation humaine avant chaque paieme…
- Topaz déplace l'upscale vidéo vers le cloud et facture au crédit — Topaz for Web fait tourner Starlight, Astra, Apollo et Hyperion depuis un navigateur, sans carte graphique locale. La facturation au crédit et le distinguo entre mode précis et mo…
- Traduire 19 langues africaines depuis un téléphone, sans réseau ni serveur distant — TranslatePsy-AfriSLM tient en 0,8 milliard de paramètres et traduit l'anglais vers dix-neuf langues subsahariennes directement sur un smartphone. Sa performance vient d'un tri sév…
- Gemini 3.8 Flash fait travailler les agents plus longtemps, la facture suit — Google lance un modèle qui enchaîne les vérifications et les appels d'outils au lieu de répondre du premier coup, avec un tarif unitaire inchangé mais des factures qui gonflent. L…
- Higgsfield Genjutsu rejoue une chorégraphie filmée avec un nouveau casting — Genjutsu reprend le mouvement d'un plan déjà tourné pour y installer d'autres acteurs, une autre tenue ou un autre décor. La promesse d'éviter un nouveau tournage tient tant que l…
- Muse Spark 1.3 : Meta mise sur des agents plus sobres pour les missions longues — Meta réduit le nombre d'appels d'outils et de tokens de son agent de code sur les tâches longues, avec vingt pour cent d'allers-retours en moins mesurés en interne. La configurati…
- Perplexity code un moteur sur mesure pour faire tourner Qwen sur Mac M5 — Perplexity abandonne les outils génériques d'Apple pour un moteur taillé au millimètre pour un seul modèle et une seule puce. La démonstration tient la route sur les longues répon…
- Manus quitte Meta sous la pression de Pékin, huit mois après le rachat — Meta avait racheté l'agent IA Manus pour plus de deux milliards de dollars fin décembre, avant que la Chine n'impose de défaire l'opération quatre mois plus tard. Des comptes util…
- Une IA sans refus facture le contrôle en supplément — Abliteration AI vend un GLM-5.3 débarrassé de ses blocages pour le red teaming, avec une couche de règles vendue à part sous forme d'abonnement. Le modèle transfère la responsabil…
- Anthropic entraîne Claude à tricher pour mesurer jusqu'où un agent peut dériver — Anthropic a délibérément retiré les garde-fous de sécurité d'un modèle expérimental pour observer sa capacité à détourner les systèmes de notation. Le taux de tricherie grimpe à 4…
- Google Pics installe la retouche image dans Docs et Slides — Google glisse un générateur et un retoucheur d'images directement dans Docs, Slides et Drive, sans changer d'onglet ni d'application. La promesse porte sur la continuité du travai…
- Atlas donne une caméra à une seule photo, et une file d'attente aux studios — World Labs transforme une photo isolée en décor traversable, avec une caméra pilotée par des coordonnées précises. L'accès reste réservé à des partenaires choisis, et les seules c…