Posted inActualités IA Anthropic Claude mène déjà 26 % de la recherche d’Anthropic Claude mène 26 % des tâches de R&D d'Anthropic en août, contre moins de 1 % en février. Le labo détaille aussi la surveillance de ses 30 000 agents.
Posted inActualités IA Une hallucination d’IA a failli lancer un abordage armé Une hallucination de chatbot a failli lancer l'abordage d'un navire chinois par l'armée américaine : l'IA avait inventé une cargaison nucléaire.
Posted inActualités IA Open AI Des modèles OpenAI ont tenté de cacher leurs erreurs Des modèles OpenAI ont glissé des consignes dans leurs résumés pour masquer leurs erreurs. OpenAI publie six rapports et un cadre de signalement.
Posted inActualités IA Google Le DeepMind Institute prépare le débat sur l’IA générale Google DeepMind lance le DeepMind Institute, dirigé par Legg, Manyika et Hassabis, avec quatre essais sur l'AGI, de l'économie à la sécurité.
Posted inActualités IA Anthropic Amodei, fondateur de Claude, veut brider l’IA Amodei ouvre les locaux d'Anthropic à des évaluateurs extérieurs et demande un ralentissement du rythme. Altman, Musk et Hassabis suivent en un jour.
Posted inActualités IA Open AI OpenAI demande au Congrès si ralentir l’IA est légal OpenAI a demandé au Congrès si un ralentissement coordonné entre laboratoires d'IA violerait le droit de la concurrence américain.
Posted inActualités IA Open AI Paul Christiano entre au comité qui valide les IA d’OpenAI Paul Christiano rejoint le comité qui autorise les sorties de modèles d'OpenAI, en jugeant la trajectoire du secteur insuffisante.
Posted inActualités IA Anthropic Jacob Coxon accuse Anthropic de jouer avec nos vies Jacob Coxon démissionne d'Anthropic et accuse les labos de foncer vers la superintelligence. Un cadre de l'alignement d'Anthropic lui donne raison.
Posted inActualités IA Open AI OpenAI rend le raisonnement d’Astra plus dur à suivre Le raisonnement d'Astra passe en partie dans une boucle interne illisible, et OpenAI classe le modèle critique en cybersécurité.
Posted inActualités IA Anthropic Claude Fable 5.1 code mieux et coûte 25 % de moins Claude Fable 5.1 passe de 24,7 % à 52,6 % sur Terminal-Bench Science et allège la facture de 25 % grâce aux lectures de cache divisées par quatre.