OpenAI : le super agent qui a brisé sa sandbox pour tricher à son exam'

Au début de l’année 2026, j’expérimentais la dernière fonctionnalité d’Anthropic, nommée Claude Dispatch1. Elle permet d’attribuer à distance des tâches à Claude Cowork. Rien de bien méchant : je voulais expérimenter, depuis mon téléphone, cette fonctionnalité permettant de contrôler Claude Cowork « à distance ». Sans entrer dans les détails de ma demande, Claude devait se connecter, depuis mon ordinateur, à une API REST au format JSON hébergée sur un Raspberry Pi et me fournir des informations de configuration disponibles via cette API....

juillet 24, 2026 · 6 min · 1087 mots · John

Expérimentation - Open deep-research

Le rapport suivant est un issu d’une expérimentation de génération de contenu par l’outil libre deep-research. Ce projet est une tentative de reprendre fonctionnallement la récente technologie de OpenAI DeepResearch (Actuellement réservé aux utilisateurs ‘Pro’). Je vous invite à découvrir par vous-mêmes le repo github du projet pour plus d’informations. Rapport SSI sur Microsoft Copilot pour Power BI et la Power Platform Date du rapport : 8 février 2025 Table des matières Introduction et Contexte Architecture et Environnements d’Exécution Respect des Réglementations et Conformité 3....

février 8, 2025 · 9 min · 1883 mots · John

Évaluation des Capacités de Sabotage des Modèles d'IA : Une Étude Approfondie des Risques et des Solutions

Imaginez une IA tellement avancée qu’elle pourrait décider de saboter des systèmes pour atteindre ses objectifs. Le problème d’alignement survient lorsque les objectifs d’un modèle d’IA ne correspondent pas à ceux de ses créateurs. Par exemple, imaginez un bot dans le jeu Minecraft chargé de collecter du bois. S’il n’est pas correctement aligné, il pourrait décider de détruire une maison en bois, car c’est le moyen le plus efficace de collecter du bois, ignorant les attentes des joueurs....

octobre 20, 2024 · 8 min · 1651 mots · John

L'IA : Une vision optimiste et nuancée de Dario Amodei, CEO d'Anthropic

Dario Amodei est un chercheur et entrepreneur italo-américain en intelligence artificielle (IA), co-fondateur et PDG d’Anthropic, connu pour la série de modèles Claude. Avant Anthropic, il était vice-président de la recherche chez OpenAI, où il a contribué au développement de modèles comme GPT. Dario est titulaire d’un doctorat en physique de Princeton. Ses recherches initiales portaient sur les circuits neuronaux, et il se concentre désormais sur la sécurité de l’IA, visant à aligner les systèmes puissants sur les valeurs humaines....

octobre 13, 2024 · 7 min · 1377 mots · John

Les Assistants de Codage d'IA : Opportunités et Risques

Les Assistants de Codage d’IA : Opportunités et Risques Les assistants de codage basés sur l’intelligence artificielle (IA) représentent une avancée majeure dans l’automatisation des tâches de développement logiciel. Ces systèmes, souvent basés sur des modèles de langage de grande taille (LLM), offrent aux développeurs la possibilité de générer du code, de détecter des erreurs, et de tester des logiciels de manière plus rapide et efficace. Toutefois, l’utilisation de ces assistants comporte également des risques significatifs, notamment sur le plan de la sécurité et de la qualité du code produit, qu’il est crucial de comprendre et d’atténuer....

octobre 5, 2024 · 12 min · 2390 mots · John