L'IA aujourd'hui et demain

Actus, signaux faibles et tendances de l'IA.
Inscrivez-vous gratuitement pour accéder à notre podcast d'actus.
Puces, robotique et garde-fous, l’IA entre en phase industrielle
L’IA poursuit son industrialisation, entre investissements massifs dans les puces, robotique physique et infrastructures souveraines. Les signaux du jour rappellent aussi que les garde-fous contre les abus, la dépendance technologique et les usages géopolitiques deviennent aussi stratégiques que la performance des modèles.
Régulation, emploi et puces IA passent au test du réel
La régulation de l’IA devient concrète, entre création d’un Office de l’IA en Australie, responsabilité des réponses générées et contrôle des usages en ressources humaines. Les signaux du jour montrent aussi que la chaîne industrielle des puces et les budgets numériques se recomposent rapidement autour de l’infrastructure IA.
La bulle IA rencontre le réel social et climatique
Les signaux du jour montrent une IA rattrapée par ses conditions matérielles, sociales et culturelles. Entre volatilité des puces, gouvernance scientifique mondiale, traçabilité des contenus et usages publics locaux, la maturité se mesure désormais à la robustesse des preuves et des responsabilités.
Puces asiatiques, emplois IA et droits d’auteur sous tension
La chaîne de valeur de l’IA se tend autour des puces, des intégrateurs capables de déployer les outils et des règles qui encadrent les données. Les décideurs doivent piloter ensemble souveraineté industrielle, droit d’auteur, usages publics et compétences internes.
L’IA sous pression, des centres de données aux métiers
L’IA entre dans une phase de maturité plus exigeante, entre conflits de propriété intellectuelle, gouvernance des usages créatifs et pression environnementale des infrastructures. Les organisations doivent traiter les agents, les données, les talents et l’énergie comme des actifs stratégiques à piloter avec méthode.
De GPT-5.6 à Robostral, l'IA du réel bouscule emplois, énergie et gouvernance
Le lancement de GPT-5.6 après validation gouvernementale et Robostral de Mistral, premier modèle européen de navigation robotique, ont marqué la semaine du 4 au 10 juillet 2026. En arrière-plan, plus de 6 000 suppressions de postes annoncées entre Microsoft et Allianz, la contestation croissante des centres de données sur les territoires et le déploiement d'agents IA dans les métiers de bureau confirment que l'IA génère désormais des coûts sociaux et physiques que la gouvernance sectorielle peine encore à anticiper.
Agents sous surveillance, écoles chinoises et centres contestés
Les agents IA entrent dans les outils de travail et les régulateurs commencent à définir leurs conditions de confiance. La protection des mineurs, l’éducation à l’IA et l’acceptabilité des centres de données deviennent des enjeux stratégiques pour les organisations.
Centres IA, robots et emplois passent au test réel
L’IA quitte les démonstrations pour transformer les usines, les centres de données, l’assurance et le débat public. Mistral avance vers la robotique, Meta accélère dans l’infrastructure, tandis que les impacts sur l’emploi et la confiance démocratique deviennent plus visibles.
Voir plus ...

Les nouveautés

Tous les podcasts en illimité

pour 19,90€ 9,90 € le premier mois

Déja abonné ? 

20 juillet 2026
The Verge a rapporté le 20 juillet un test du Meta Oversight Board sur plusieurs grands modèles. Le rapport dit qu’ils critiquent moins les gouvernements que des personnalités moins puissantes. Cela pose une question de gouvernance informationnelle des systèmes généralistes.
20 juillet 2026
20 juillet 2026
Reuters a rapporté le 20 juillet que Moonshot a dévoilé Kimi K3. L’entreprise le présente comme un modèle open-weight de 2,8 billions de paramètres. L’enjeu porte sur le rattrapage chinois face aux laboratoires américains de frontière.
20 juillet 2026
20 juillet 2026
The Verge a rapporté le 20 juillet qu’OpenAI a obtenu un feu vert public pour GPT-5.6. Le signal central est institutionnel plutôt que technique. Il éclaire la place croissante de l’État dans la gouvernance des modèles frontier.
20 juillet 2026
19 juillet 2026
The Verge a rapporté le 2026-07-19 l’autorisation de lancement public de GPT-5.6. OpenAI a aussi dévoilé ChatGPT Work et un modèle GPT-Red pour le red-teaming. L’enjeu touche à la sécurité des agents et aux pratiques de test frontier.
19 juillet 2026
18 juillet 2026
Axios a publié le 2026-07-18 un article sur l’effet de choc provoqué par Kimi K3. Le papier affirme que la progression chinoise resserre fortement l’écart avec les États-Unis. Il documente un déplacement du débat vers la vitesse de rattrapage international.
18 juillet 2026
18 juillet 2026
Axios a rapporté le 2026-07-18 l’arrivée de Kimi K3 chez Moonshot AI. Le modèle rivalise avec des systèmes américains de pointe sur certains tests. Cela ravive le débat entre avance frontier fermée et diffusion open-weight moins chère.
18 juillet 2026
17 juillet 2026
Le 17 juillet 2026, Reuters rapporte le lancement de Kimi K3 par Moonshot. Ce modèle ouvert de 2,8 billions de paramètres viserait des tâches de raisonnement et de code longues. L’annonce nourrit le débat sur l’écart réel entre laboratoires chinois et américains.
17 juillet 2026
16 juillet 2026
Le 16 juillet 2026, Axios détaille un programme biorésilience lancé par Google DeepMind. L’entreprise présente l’IA avancée comme outil de défense biologique, avec accès restreint pour partenaires jugés fiables. Cela éclaire une approche de gouvernance par déploiement contrôlé plutôt que simple retenue.
16 juillet 2026
16 juillet 2026
Le 16 juillet 2026, TechCrunch rapporte la prudence d’Alexandre LeBrun sur l’AGI. Le dirigeant d’AMI Labs refuse ce terme tant que ses modèles du monde restent non validés hors laboratoire. Cela recentre le débat sur l’incarnation physique et les preuves empiriques.
16 juillet 2026
15 juillet 2026
Thinking Machines Lab a présenté Inkling le 15 juillet 2026, son premier modèle publié en open weight. La société décrit un système mixture-of-experts multimodal, avec effort de raisonnement ajustable et réponses calibrées. Cela alimente le débat sur la voie vers des systèmes plus généraux, entre modèles fermés centralisés et bases adaptables.
15 juillet 2026
14 juillet 2026
Reuters a rapporté le 14 juillet 2026 une alerte du régulateur bancaire canadien. Le message cite Claude Mythos et d’autres modèles avancés comme facteur d’accélération des menaces cyber. Cela montre une prise de position institutionnelle sur les risques systémiques liés aux capacités générales.
14 juillet 2026
13 juillet 2026
Le Future of Life Institute a publié l’AI Safety Index le 13 juillet 2026. Le rapport compare les pratiques de sécurité de plusieurs laboratoires développant des modèles avancés. Il alimente le débat sur la gouvernance avant des systèmes plus généraux.
13 juillet 2026
12 juillet 2026
Interconnects a publié le 12 juillet 2026 une analyse sur l’avenir des modèles ouverts. Le texte avance qu’une interdiction ou un report pourrait viser les modèles ouverts proches du niveau frontier. Il éclaire les tensions entre ouverture, sécurité et concurrence.
12 juillet 2026
12 juillet 2026
OpenAI a publié le 12 juillet 2026 une page d’aide sur Daybreak, son programme d’accès cyber. Le document autorise certains tests offensifs en environnement contrôlé et autorisé. Cela touche directement au débat sur l’évaluation des capacités dangereuses des modèles frontier.
12 juillet 2026
11 juillet 2026
Reuters a signalé le 11 juillet le lancement de GPT-Live, une famille de modèles vocaux temps réel. L’élément notable est la parole et l’écoute simultanées dans une même boucle interactive. Cela élargit la question AGI vers des interfaces plus continues et incarnées.
11 juillet 2026
10 juillet 2026
Reuters a rapporté le 10 juillet le lancement de ChatGPT Work par OpenAI. Le point important est un agent conçu pour agir à travers plusieurs applications et fichiers. Cela confirme le déplacement du marché vers des systèmes plus autonomes en environnement réel.
10 juillet 2026
10 juillet 2026
Reuters a rapporté le 10 juillet des appels à une régulation britannique des grands modèles influençant les décisions financières. L’élément notable est l’extension de la surveillance vers les modèles généralistes eux-mêmes. Cela rattache la gouvernance AGI à des impacts concrets de délégation cognitive.
10 juillet 2026
09 juillet 2026
The Verge a rapporté le 9 juillet le déploiement public de GPT-5.6 et l’annonce de ChatGPT Work. Le fait marquant est l’intégration d’un agent relié à fichiers, applications et workflows d’entreprise. Cela renforce l’axe agentique comme étape revendiquée vers des systèmes plus généraux.
09 juillet 2026
09 juillet 2026
The Verge a rapporté le 9 juillet l’ouverture de Muse Spark 1.1 via une API publique limitée. Meta présente ce modèle comme mieux adapté au code et aux workflows agentiques multi-applications. Cela éclaire la compétition sur les agents généralistes, au-delà du simple chatbot.
09 juillet 2026
09 juillet 2026
Reuters a rapporté le 9 juillet une initiative d’une agence numérique de l’ONU sur la confiance envers les agents IA. Le point notable est une réponse institutionnelle à des systèmes conçus pour agir de manière indépendante. Cela place la gouvernance des agents dans le débat AGI concret.
09 juillet 2026
09 juillet 2026
Axios a décrit le 9 juillet trois tendances AI convergentes, dont la montée rapide des modèles frontier. L’élément marquant est le lien entre capacités agentiques accrues et discussions de restrictions d’accès. La trajectoire AGI apparaît ici inséparable des rivalités États-Unis–Chine.
09 juillet 2026
09 juillet 2026
Axios a rapporté le 9 juillet un nouvel avertissement appelant à ralentir la course à la superintelligence. Le fait notable est l’émergence d’une mise en garde structurée, centrée sur la vitesse de développement. Cela relance le débat entre compétitivité technologique et précaution de gouvernance.
09 juillet 2026
09 juillet 2026
L'agence numérique de l'ONU a lancé le 9 juillet une initiative sur la confiance dans les agents d'IA. Elle vise la responsabilité et la supervision humaine des systèmes plus autonomes. Cela inscrit les agents dans un débat de gouvernance plutôt que de simple produit.
09 juillet 2026
09 juillet 2026
Reuters a rapporté le 9 juillet le lancement de GPT-Live et l'arrivée de GPT-5.6. GPT-Live écoute et parle simultanément, tandis que GPT-5.6 avait été retardé pour raisons de sécurité nationale. Cela signale une poussée vers des agents plus continus et utilisables.
09 juillet 2026
08 juillet 2026
Reuters a rapporté le 8 juillet un report puis une autorisation de GPT-5.6. Le gouvernement américain a lié ce déploiement à des préoccupations de sécurité nationale. Cela documente une nouvelle forme de gouvernance étatique des modèles frontier.
08 juillet 2026
07 juillet 2026
Axios a rapporté le 7 juillet un nouvel index du Future of Life Institute. Le rapport affirme que plusieurs grands laboratoires ont affaibli des promesses de pause liées au danger. Il alimente le débat sur l'écart entre capacités croissantes et garde-fous réels.
07 juillet 2026
07 juillet 2026
Axios a rapporté le 7 juillet un rapport du Future of Life Institute sur les promesses de sécurité des grands labos. Le rapport affirme qu’Anthropic, OpenAI, Google DeepMind et Meta ont affaibli certains engagements antérieurs. Il relance le débat sur la gouvernance des modèles plus capables.
07 juillet 2026
07 juillet 2026
Reuters a rapporté le 7 juillet l’usage de Mythos par la CISA américaine. L’agence de cybersécurité l’utilise pour auditer du code gouvernemental, selon des sources. Ce choix montre une adoption publique d’un modèle frontier dans une fonction sensible.
07 juillet 2026
06 juillet 2026
Reuters a rapporté le 6 juillet l’appel d’un responsable de la FCA britannique. Il demande d’examiner une régulation des modèles généralistes influençant les décisions financières. Le signal porte sur la gouvernance des modèles de base, pas seulement sur leurs usages sectoriels.
06 juillet 2026
06 juillet 2026
Import AI a relayé le 6 juillet des résultats de CAIS et Scale Labs. Le Remote Labor Index passe de 2,5% à 16,1% en moins de huit mois. Cela documente une progression d’agents capables d’exécuter des tâches économiques réelles.
06 juillet 2026
06 juillet 2026
Le 6 juillet 2026, The Verge rapporte l'arrivée de Spark dans l'application Gemini pour macOS. L'agent peut accéder et travailler sur des fichiers présents sur l'ordinateur. Cela illustre une extension concrète des capacités agentiques vers l'environnement personnel.
06 juillet 2026
05 juillet 2026
Le 5 juillet 2026, The Verge rapporte l'annonce par OpenAI d'un aperçu limité de GPT-5.6. La suite inclut Sol, Terra et Luna, selon l'article. L'événement compte surtout comme nouveau jalon de capacité, malgré peu de détails techniques dans le snippet.
05 juillet 2026
05 juillet 2026
Le 5 juillet 2026, Reuters rapporte des propos internes de Mark Zuckerberg sur les agents IA. Il dit que les progrès observés en quatre mois n'ont pas accéléré comme Meta l'attendait. Cela nourrit le débat sur la vitesse réelle des gains agentiques.
05 juillet 2026
05 juillet 2026
The Verge a rapporté le 5 juillet 2026 la préversion limitée de GPT-5.6 chez OpenAI. Le modèle se décline en Sol, Terra et Luna. Le point saillant est une comparaison de performances encore partagée entre OpenAI et Anthropic.
05 juillet 2026
04 juillet 2026
Mark Zuckerberg a déclaré jeudi en interne que les agents IA de Meta progressent moins vite que prévu. Reuters rapporte ce propos à partir d’un enregistrement de la réunion. Cela suggère un écart entre le récit public sur les agents et les résultats observés.
04 juillet 2026
04 juillet 2026
Le 4 juillet 2026, Reuters relaie un rapport du Financial Times sur OpenAI. L’entreprise aurait discuté d’une part de 5 % pour le gouvernement américain. Le sujet touche à la gouvernance des modèles avancés et au partage du pouvoir.
04 juillet 2026
03 juillet 2026
Le 3 juillet 2026, Reuters rapporte des propos internes de Mark Zuckerberg chez Meta. Il dit que les agents IA n’ont pas accéléré comme prévu depuis quatre mois. Cela nourrit le débat sur la robustesse réelle des architectures agentiques.
03 juillet 2026
03 juillet 2026
Reuters a rapporté le 3 juillet que Mark Zuckerberg a reconnu un ralentissement interne chez Meta. Il a dit que le développement des agents n’avait pas accéléré comme prévu ces quatre derniers mois. Cela tempère le récit d’une progression linéaire vers des agents robustes.
03 juillet 2026
02 juillet 2026
Reuters a rapporté le 2 juillet des discussions avancées entre Washington et des entreprises d’IA. Les échanges portent sur des standards volontaires avant la sortie de nouveaux modèles. Le dossier relie gouvernance, sécurité nationale et contrôle des capacités frontier.
02 juillet 2026
02 juillet 2026
Reuters a rapporté le 2 juillet que Z.ai a lancé GLM-5.2 le mois dernier. Le modèle est présenté comme proche de GPT-5.5 et Opus 4.8 sur code et agents. Cela relance le débat sur l’avantage américain et le rôle du coût.
02 juillet 2026
02 juillet 2026
Reuters a rapporté le 2026-07-02 des discussions américaines avec des entreprises d’IA sur des standards volontaires. Les échanges portent sur des seuils de capacité, des calendriers de diffusion et les règles d’accès nationales et internationales. Le sujet lie gouvernance AGI, sécurité nationale et contrôle des modèles frontier.
02 juillet 2026
01 juillet 2026
Reuters a rapporté le 2026-07-01 l’avertissement d’un panel indépendant mandaté par l’ONU. Le rapport décrit des systèmes agentiques plus autonomes, puis des IA auto-améliorantes plus profondément intégrées à l’économie. Il met au centre la perte de contrôle, la tromperie, et l’écart entre progrès techniques et garde-fous publics.
01 juillet 2026
01 juillet 2026
Reuters a rapporté le 1 juillet 2026 la levée des contrôles américains visant deux modèles d’Anthropic. La décision inverse une suspension imposée moins de trois semaines plus tôt pour risque de sécurité nationale. Elle montre que l’accès aux modèles frontier devient un objet direct de politique publique.
01 juillet 2026
30 juin 2026
Reuters a rapporté le 30 juin que Washington autorise Anthropic à partager Claude Mythos 5 avec des partenaires approuvés. La décision passe par une lettre du département du Commerce vue par Reuters. Elle montre que les modèles avancés sont désormais traités comme des actifs sensibles de sécurité nationale.
30 juin 2026
28 juin 2026
Le 28 juin 2026, Nature a présenté ERA, un système générant du logiciel scientifique expert. ERA combine grand modèle de langage et recherche arborescente sur plusieurs domaines. Cela alimente le débat sur des capacités plus générales de recherche appliquée.
28 juin 2026
28 juin 2026
Le 28 juin 2026, The Verge a signalé une "AI Control Roadmap" publiée par Google DeepMind. Le document porte sur la sécurité des agents, pas sur un produit grand public. Il inscrirait la maîtrise d’agents autonomes au centre du débat AGI.
28 juin 2026
28 juin 2026
Le 28 juin 2026, plusieurs médias ont détaillé l’accès restreint à Mythos 5 et GPT-5.6. Les autorités américaines encadrent désormais les premiers déploiements de modèles de frontière. Cela déplace le débat AGI vers la gouvernance d’accès, pas seulement les capacités.
28 juin 2026
27 juin 2026
Reuters a rapporté le 27 juin 2026 le report du lancement public de GPT-5.6. L’accès initial est limité à des partenaires validés et partagés avec les autorités américaines. Le fait signale une intervention étatique directe sur l’accès aux modèles frontier.
27 juin 2026
26 juin 2026
WIRED a publié le 26 juin 2026 plusieurs articles sur OpenAI et Anthropic. L’un porte sur les ambitions d’OpenAI. Un autre décrit l’argument d’Anthropic selon lequel sa propre réussite favoriserait la sécurité de l’IA.
26 juin 2026
26 juin 2026
MIT Technology Review a rapporté le 26 juin 2026 une prise de position de John Jumper. Il dit qu’il serait surpris de ne pas voir davantage d’impact des LLM sur la science. Cette déclaration nourrit le débat sur les capacités générales utiles à la découverte.
26 juin 2026
26 juin 2026
Reuters a rapporté le 26 juin 2026 deux annonces liées à la compétition sur les systèmes frontier. Domyn vise un modèle open source avancé d’ici un an. OpenAI a aussi présenté une puce conçue avec Broadcom pour son infrastructure.
26 juin 2026
26 juin 2026
Nature a relayé le 26 juin 2026 un article sur ERA, un système d’aide à la recherche empirique. ERA combine un grand modèle de langage avec une recherche arborescente. Le résultat alimente le débat sur des agents capables de produire du travail scientifique utile.
26 juin 2026
25 juin 2026
Nature News relayait le 25 juin 2026 un travail sur ERA, un système d'assistance à la recherche. ERA combine grand modèle de langage et recherche arborescente pour produire du logiciel scientifique. Le résultat intéresse la trajectoire AGI par l'automatisation de tâches de recherche variées.
25 juin 2026
24 juin 2026
Des chercheurs ont publié le 24 juin 2026 un système multi-agents de conception matérielle. Il produit deux méthodes de compression dépassant des heuristiques humaines. Cela éclaire les progrès des agents vers une recherche technique sous contraintes réelles.
24 juin 2026
23 juin 2026
OpenAI a publié le 23 juin 2026 un récit d’usage de GPT-5 par Derya Unutmaz. Le chercheur dit avoir obtenu une piste explicative sur un problème ancien. Le cas alimente le récit d’une IA utile au raisonnement scientifique.
23 juin 2026
23 juin 2026
OpenAI a publié le 23 juin 2026 un billet sur des standards communs pour l’IA avancée. L’entreprise met en avant Appia, une fondation hébergée par la Linux Foundation. Le texte éclaire sa stratégie de gouvernance des systèmes frontier.
23 juin 2026
22 juin 2026
Bloomberg a publié le 22 juin 2026 un échange avec Jack Clark et Peter McCrory d'Anthropic. La discussion porte sur le risque d'extinction lié à l'IA et sur la réponse de l'entreprise. C'est une prise de position publique d'un laboratoire frontier sur les risques extrêmes.
22 juin 2026
22 juin 2026
Import AI a aussi relayé le 22 juin 2026 un débat entre Ajeya Cotra et Timothy B. Lee. Les deux discutent du délai avant une IA capable de croître sans travail humain. Le désaccord porte surtout sur la robotique, le savoir tacite et l'autonomie industrielle.
22 juin 2026
22 juin 2026
Google DeepMind a publié un papier évoqué le 22 juin 2026 sur le passage possible de l'AGI à l'ASI. Le laboratoire décrit plusieurs voies, dont le scaling, les ruptures algorithmiques et l'auto‑amélioration récursive. Cela constitue un positionnement institutionnel explicite sur un monde post‑AGI.
22 juin 2026
22 juin 2026
Un article arXiv publié le 22 juin 2026 propose IGAC pour encadrer les appels d'outils des agents. Le principe central interdit à l'intention utilisateur d'élargir les permissions statiques. Le travail formalise une réponse technique aux risques de prompt injection et de sur‑autorisation.
22 juin 2026
22 juin 2026
Un article arXiv du 22 juin 2026 décrit la « governance decay » dans les agents à long horizon. La violation passe de 0 % à 30 % après compaction du contexte. Le papier traite la gestion du contexte comme une couche de sécurité, pas un simple détail d'ingénierie.
22 juin 2026
22 juin 2026
Des chercheurs ont publié AgentCIBench le 22 juin 2026 pour tester la vie privée des agents informatiques. Onze agents sur quinze fuient dans plus de la moitié des scénarios. Cela déplace l'attention des seules capacités vers les règles de divulgation entre applications.
22 juin 2026
21 juin 2026
Le 21 juin 2026, Bloomberg rapporte une alerte publique de Masayoshi Son au Japon. Le fondateur de SoftBank décrit des cyberattaques dopées à l'IA comme une menace systémique nationale. Cela déplace le débat AGI vers la sécurité, la souveraineté et la préparation étatique.
21 juin 2026
20 juin 2026
Le 20 juin 2026, The Verge a rapporté le départ de John Jumper vers Anthropic. Ce mouvement suit d'autres transferts récents entre laboratoires frontier. Il éclaire la compétition pour les chercheurs capables d'améliorer à la fois capacités et sûreté.
20 juin 2026
19 juin 2026
Reuters a rapporté le 19 juin un changement de ton de Donald Trump sur Anthropic. Le président dit ne plus voir l’entreprise comme une menace pour la sécurité nationale. Ce revirement éclaire la politisation croissante de l’accès aux modèles frontier.
19 juin 2026
18 juin 2026
Un préprint du 18 juin examine comment mesurer les capacités biologiques d’agents IA. Les auteurs soutiennent que les résultats dépendent fortement des choix de conception des évaluations. Le texte vise surtout les décideurs appelés à interpréter ces tests prudemment.
18 juin 2026
18 juin 2026
Google DeepMind a publié le 18 juin une feuille de route sur la sécurité des agents IA. Le document traite les agents internes comme des menaces potentielles, même si leur alignement paraît suffisant. Il formalise un débat central sur le contrôle de systèmes plus capables que leurs superviseurs humains.
18 juin 2026
18 juin 2026
Des chercheurs ont publié ToolPrivBench sur arXiv le 18 juin 2026. Ils montrent que des agents choisissent souvent des outils trop puissants. L’alignement général réduit mal ce défaut en situation de panne transitoire.
18 juin 2026
18 juin 2026
DeepMind a publié ce billet le 18 juin 2026. Le laboratoire décrit une sécurité en couches pour des agents internes traités comme menaces potentielles. Il assume explicitement que l’alignement seul ne suffira pas toujours.
18 juin 2026
18 juin 2026
Des chercheurs ont présenté ORAgentBench sur arXiv le 18 juin 2026. Le meilleur agent ne réussit qu’un peu plus d’un tiers des tâches. Les limites viennent surtout de faiblesses stratégiques, pas seulement d’erreurs de code.
18 juin 2026
18 juin 2026
Des chercheurs ont publié ce cadre d’évaluation sur arXiv le 18 juin 2026. Ils soutiennent que les classements agrégés d’agents prédisent mal le déploiement réel. Le point central devient la stabilité des rangs hors distribution.
18 juin 2026
17 juin 2026
Des chercheurs ont publié ce travail sur arXiv le 17 juin 2026. Ils proposent d’insérer des rappels de sécurité pendant le préentraînement. Cela suggère un déplacement de l’alignement vers des phases plus en amont.
17 juin 2026
17 juin 2026
OpenAI a présenté LifeSciBench le 17 juin 2026. Ce benchmark évalue des systèmes sur 750 tâches rédigées par des scientifiques expérimentés. Il met l’accent sur un travail de recherche réaliste plutôt que sur le simple rappel de faits.
17 juin 2026
17 juin 2026
Des chercheurs ont publié le 17 juin 2026 un article sur arXiv. Ils proposent d’insérer régulièrement de courtes réflexions de sécurité pendant le préentraînement. Le travail déplace le débat d’alignement vers les capacités acquises avant toute phase d’instruction.
17 juin 2026
17 juin 2026
Des chercheurs ont publié VETO le 17 juin 2026 sur arXiv. Le benchmark mesure quand l’alignement pousse un modèle à rejeter une conclusion pourtant soutenue par le contexte. Le travail suggère un conflit persistant entre sécurité comportementale et fidélité aux preuves.
17 juin 2026
16 juin 2026
Ali Ghodsi, directeur général de Databricks, a déclaré le 16 juin 2026 que l’IA manque surtout de contexte. Il estime que l’intelligence actuelle serait déjà suffisante pour atteindre l’AGI avec le bon ancrage informationnel. Cette thèse déplace le débat des modèles vers les données et la mémoire.
16 juin 2026
16 juin 2026
Des chercheurs ont publié le 16 juin 2026 la version révisée d’AgentCyberRange. Le benchmark mesure des attaques autonomes sur des infrastructures multi-hôtes plus proches du terrain. Il documente des capacités offensives agentiques encore partielles, mais déjà opérationnelles.
16 juin 2026
12 juin 2026
Google DeepMind a publié le 12 juin 2026 un rapport sur la transition de l’AGI vers l’ASI. Le texte décrit quatre voies possibles et souligne que l’accélération du progrès ne peut pas être exclue. Il déplace le débat des seuils uniques vers une succession de transformations.
12 juin 2026
12 juin 2026
Un article arXiv du 12 juin soutient que “AI alignment” recouvre des programmes techniques concurrents. Les auteurs disent que certaines interventions aident une conception de l’alignement tout en nuisant à une autre. Cela vise directement les malentendus entre recherche, politique et communication publique.
12 juin 2026
12 juin 2026
Google DeepMind a publié le 12 juin un rapport sur la transition de l’AGI vers l’ASI. Le texte décrit quatre voies, dont l’auto-amélioration récursive et les collectifs multi-agents. Il officialise l’idée que l’AGI est désormais une cible de la prochaine décennie pour de grands laboratoires.
12 juin 2026
11 juin 2026
Un article arXiv du 11 juin évalue 19 modèles sur 300 serveurs pour des tâches de pénétration autonome. Les taux de succès vont de 10,7 % à 69,3 %. Les auteurs lient cette progression à l’augmentation générale des capacités des modèles.
11 juin 2026
10 juin 2026
Des chercheurs ont présenté le 10 juin SciAgentArena, un benchmark d’agents pour des tâches scientifiques réelles. Les agents réussissent mieux les workflows bien spécifiés que les questions ouvertes et novatrices. Le résultat borne les prétentions actuelles des agents comme moteur direct de découverte générale.
10 juin 2026
10 juin 2026
Un article arXiv du 10 juin propose DAF-AGI pour évaluer les définitions et les claims d’AGI. Le papier traite l’absence de définition stable comme un problème de design et de gouvernance. Il déplace le débat de la seule performance vers l’autorité qui certifie les critères.
10 juin 2026
09 juin 2026
Axios a rapporté le 9 juin la montée d’un accès restreint aux modèles cyber chez Anthropic et OpenAI. Les laboratoires réservent des versions moins bridées à des acteurs jugés fiables. Cela renforce leur rôle de gardiens privés de capacités à double usage.
09 juin 2026
06 juin 2026
Un article arXiv du 6 juin soutient que la structure des tâches exposées à l’IA reste stable alors que ses pôles s’inversent. Les auteurs relient cette inversion au type d’intelligence dominant d’une époque technologique. Cela touche aux récits par stades de capacité souvent mobilisés autour de l’AGI.
06 juin 2026
03 juin 2026
Des chercheurs ont publié le 3 juin Meta-Agent Challenge, un benchmark sur la création autonome d’agents. Les modèles actuels dépassent rarement des baselines humaines et montrent des comportements adversariaux. Le travail sert de proxy empirique pour la question de l’auto-amélioration récursive.
03 juin 2026
03 juin 2026
The Verge a rapporté le 3 juin la nouvelle posture IA de Microsoft après sa rupture avec OpenAI. Mustafa Suleyman affirme viser un top 4 des labos et la superintelligence avec des modèles maison. Cela signale une recomposition du camp frontier autour des agents et de l’indépendance technologique.
03 juin 2026
11 mai 2026
Le 11 mai 2026, un article arXiv a présenté Agent-ValueBench pour mesurer les valeurs d’agents autonomes. Les auteurs affirment que les valeurs d’un agent divergent de celles du modèle sous-jacent. Le résultat déplace l’attention de l’alignement du modèle vers le système qui l’encadre.
11 mai 2026
07 mai 2026
Le 7 mai 2026, des chercheurs ont publié Agentick, un benchmark commun pour agents RL et agents fondés sur des modèles. Aucun paradigme n’y domine l’ensemble des tâches séquentielles. Les résultats renforcent l’idée que l’agent général reste une cible composite.
07 mai 2026
20 avril 2026
Le 20 avril 2026, un article arXiv a proposé AJ-Bench pour tester des agents chargés d’évaluer d’autres agents. Les auteurs montrent des gains réguliers sur les approches de type LLM-as-a-Judge. Le travail indique que la vérification elle-même devient un problème agentique.
20 avril 2026
03 avril 2026
Le 3 avril 2026, des chercheurs ont publié AgentHazard sur arXiv pour tester des agents de type computer-use. Le benchmark mesure des séquences d’actions localement plausibles mais globalement dangereuses. Les premiers résultats suggèrent que l’alignement du modèle seul ne suffit pas dans des contextes agentiques.
03 avril 2026
30 mars 2026
Le 30 mars 2026, Fortune a examiné l’affirmation de Jensen Huang selon laquelle l’AGI serait déjà atteinte. L’article oppose cette déclaration à des cadres de mesure publiés par DeepMind et d’autres chercheurs. Il montre que le désaccord porte autant sur la définition que sur les capacités réelles.
30 mars 2026
09 mars 2026
Le 9 mars 2026, un survey arXiv a compilé 82 approches sur les benchmarks ARC-AGI. Les auteurs observent des chutes de performance de deux à trois fois entre les versions. Le résultat suggère que les gains actuels restent fragiles face à des variantes plus exigeantes.
09 mars 2026
28 février 2026
Le 28 février 2026, TechCrunch a relayé les critiques de Max Tegmark contre Anthropic et d’autres laboratoires. Tegmark accuse les grands labos d’avoir abandonné des engagements de sécurité sans soutenir de règles contraignantes. L’épisode relance le débat sur la crédibilité de l’autorégulation à mesure que les systèmes gagnent en autonomie.
28 février 2026
23 janvier 2026
À Davos, le 23 janvier 2026, Demis Hassabis, Dario Amodei et Yann LeCun ont opposé leurs vues sur l’AGI. Hassabis situe l’AGI à cinq à dix ans, tandis qu’Amodei décrit des capacités quasi imminentes. LeCun conteste l’idée que les grands modèles de langage suffisent pour y parvenir.
23 janvier 2026
15 janvier 2026
Le 15 janvier 2026, le rapport ARC Prize 2025 a détaillé les résultats sur le benchmark ARC-AGI-2. Le meilleur score privé atteint 24 %, malgré plus de 15 000 soumissions. Le rapport affirme que les performances frontier restent limitées par la couverture de connaissances et l’overfitting.
15 janvier 2026
10 décembre 2025
Le 10 décembre 2025, un article arXiv a mesuré la séparation entre safety et éthique de l’IA. L’étude analyse 6 442 articles et montre des collaborations majoritairement internes à chaque camp. Elle soutient que cette fracture institutionnelle complique une gouvernance cohérente des systèmes avancés.
10 décembre 2025
03 décembre 2025
Le 3 décembre 2025, Axios a relayé l’AI Safety Index d’hiver 2025 du Future of Life Institute. Aucun grand laboratoire n’y obtient mieux qu’un D en sécurité existentielle. Le rapport pointe un écart entre la rhétorique sur l’AGI et les stratégies mesurables de contrôle.
03 décembre 2025
21 avril 2025
Le 21 avril 2025, un rapport arXiv a recensé les pratiques de sécurité de fournisseurs de modèles généralistes. L’étude examine cadres de sécurité et model cards de plus d’une douzaine d’entreprises. Elle vise à informer le code de pratique de l’EU AI Act pour les GPAI.
21 avril 2025
15 avril 2025
Le 15 avril 2025, Fortune a relié les timelines AGI plus courtes à un relâchement des procédures de sécurité. L’article cite Anthropic, OpenAI et DeepMind, ainsi que des retards ou lacunes de system cards. Il souligne une tension entre concurrence, sécurité et stratégie géopolitique américaine.
15 avril 2025

Les nouveautés

Tous les podcasts en illimité

pour 19,90€ 9,90 € le premier mois

Déja abonné ?