Posted inActualités IA Google Gemini 3.8 Flash talonne Claude Opus 5 sur le code Gemini 3.8 Flash marque 73,7 % sur DeepSWE v1.1, à trois dixièmes de Claude Opus 5, et sa déclinaison Cyber atteint 86,2 % sur CyberGym.
Posted inActualités IA Anthropic La détection du texte Claude s’ouvre aux médias La détection du texte Claude entre en préversion privée : régulateurs, rédactions et fact-checkers peuvent demander la clé qui révèle le filigrane.
Posted inActualités IA Anthropic Claude Fable 5.1 code mieux et coûte 25 % de moins Claude Fable 5.1 passe de 24,7 % à 52,6 % sur Terminal-Bench Science et allège la facture de 25 % grâce aux lectures de cache divisées par quatre.
Posted inActualités IA La vidéo IA a remplacé les acteurs des séries chinoises 95 % des 128 000 micro-séries chinoises du premier trimestre sont de la vidéo IA. Une minute générée coûte 90 % de moins qu'un tournage.
Posted inActualités IA Anthropic Les limites de Claude Code baissent de 17 % le 14 septembre Les limites de Claude Code montent de 25 % le 14 septembre, mais le bonus de 50 % de l'été s'arrête le même jour. Perte nette annoncée : 17 %.
Posted inActualités IA Open AI Cursor perd les modèles OpenAI le 12 novembre Cursor perd l'accès direct aux modèles OpenAI le 12 novembre après son rachat par SpaceX, et Anthropic augmente aussitôt son calcul pour Claude.
Posted inActualités IA Anthropic Claude Sonnet 5 corrige Claude mieux que 28 chercheurs Claude Sonnet 5 comble jusqu'à 96 % de l'écart de sécurité sur dix défauts et bat vingt-huit chercheurs humains pour quatre dollars de l'heure.
Posted inActualités IA GLM-5.3-Flash tourne sur 100 000 puces chinoises GLM-5.3-Flash était le modèle furtif Ox Alpha : Zhipu confirme, publie les poids en MIT et révèle un cluster de 100 000 puces chinoises.
Posted inActualités IA Open AI Codex prépare un mode qui ne s’arrête jamais Un mode persistant repéré dans le code de Codex laisse l'agent tourner jusqu'à la mise en veille et se créer ses propres tâches.
Posted inActualités IA Qwen3.8-Flash-Next divise les prix par douze Qwen3.8-Flash-Next arrive douze fois moins cher que Qwen3.8-Max, avec des benchmarks qui visent DeepSeek et Claude Opus 4.6.