Un laboratoire qui veut protéger les esprits vulnérables
Alors que les débats publics s’attardent souvent sur les scénarios catastrophiques où l’intelligence artificielle pourrait menacer l’humanité, une réalité plus immédiate et tout aussi alarmante se profile : les dommages psychologiques que les chatbots peuvent infliger, notamment aux adolescents. Des affaires judiciaires récentes, comme celles contre Character.AI et OpenAI, ont mis en lumière des suicides liés à des conversations avec des agents virtuels. Face à ce constat, le duo de frères et sœurs Shirali et Arul Nigam a fondé Circuit Breaker Labs, une startup qui se consacre à rendre les modèles d’IA plus sûrs, quel que soit le contexte linguistique ou culturel.
Des simulations humaines à l’échelle d’une armée de crash‑test
Leur approche repose sur la création d’agents d’IA qui reproduisent fidèlement la diversité des utilisateurs : enfants de six ans, adultes de quarante‑cinq ans, locuteurs natifs ou apprenants, gamers, personnes utilisant du slang ou des fautes de frappe. Ces « mannequins numériques » sont soumis à des tests d’« red‑team », c’est‑à‑dire des évaluations adversariales destinées à exposer les failles les plus subtiles. Chaque jour, des dizaines voire des centaines de milliers d’interactions simulées sont générées, afin de vérifier que le modèle réagit correctement face à des propos à risque, des détresses émotionnelles ou des indices de parasocialité.
Un score explicable pour chaque modèle
Après chaque série de simulations, Circuit Breaker Labs applique une méthode propriétaire de notation, produisant des scores auditables et explicables. Ces indicateurs permettent aux développeurs d’identifier précisément les zones où l’IA se trompe – par exemple lorsqu’un enfant exprime le désir de se faire du mal et que le bot ne saisit pas la gravité du message. En combinant l’expertise de spécialistes humains avec les données massives générées par les agents virtuels, la startup offre une couche de sécurité supplémentaire aux applications à haut risque, telles que les coachs virtuels, les journaux numériques ou les services de soutien psychologique.
Un futur prometteur au cœur de TechCrunch Disrupt
Présentée parmi les 200 finalistes du Startup Battlefield 2026, Circuit Breaker Labs s’apprête à présenter son prototype lors de TechCrunch Disrupt, qui se tiendra du 13 au 15 octobre à San Francisco. Malgré une équipe réduite à cinq personnes, la société a déjà attiré l’attention de plusieurs acteurs majeurs du secteur, même si leurs noms restent confidentiels. Les fondateurs espèrent que leur plateforme pourra, à terme, être déployée dans tout type d’application où l’interaction homme‑machine risque de créer une dépendance ou de déclencher des comportements autodestructeurs.
En misant sur la diversité des profils simulés et sur une méthodologie rigoureuse, Circuit Breaker Labs ambitionne de transformer la façon dont les développeurs évaluent la sécurité psychologique de leurs produits IA, offrant ainsi une protection accrue aux jeunes utilisateurs comme aux adultes.
Source: https://techcrunch.com/2026/10/02/circuit-breaker-labs-hopes-to-make-ai-safer-for-your-kids-and-you/