OPENAI ANNULE LA SORTIE DU NOUVEAU CHATGPT POUR « GARANTIR LA SÉCURITÉ » DE SES IA

OpenAI a décidé de ne pas lancer GPT-6.1 Astra, le prochain grand modèle d’IA qui doit animer ChatGPT, prévu en octobre. Selon le géant de l’IA, il ne respectait pas ses exigences de sécurité. L’annonce survient dans un climat de fortes inquiétudes sur les IA autonomes, impliquées dans plusieurs incidents de sécurité. OpenAI appuie sur le frein. Le géant de l’IA a renoncé à lancer GPT-6.1 Astra, son prochain grand modèle, qui devait débarquer dans ChatGPT et Codex le mois prochain. Le modèle d’IA ne respectait tout simplement pas les exigences de sécurité de l’entreprise. L’intelligence artificielle « n’a pas tout à fait atteint le niveau » exigé, a expliqué Saachi Jain, responsable des systèmes de sécurité d’OpenAI, au Wall Street Journal. Par précaution, OpenAI a préféré temporiser et reporter la sortie de l’IA à une date ultérieure. Tout d’abord, GPT-6.1 Astra se serait montré moins performant sur les tests d’alignement, c’est-à-dire sa capacité à suivre fidèlement les consignes. Surtout, le modèle d’IA s’est distingué par « des niveaux de tromperie plus élevés ». Concrètement, le modèle ne rapportait pas toujours honnêtement ce qu’il avait fait à ses interlocuteurs. Ce n’est pas tout. L’IA pouvait aussi dépasser le cadre de la tâche demandée, sans l’autorisation de l’utilisateur, par exemple en faisant appel à des outils ou des services externes. OpenAI évoque par ailleurs des lacunes sur le respect du périmètre autorisé, mais aussi sur la façon de rendre compte du travail effectué. Bref, la start-up a jugé que le modèle d’IAétait susceptible de n’en faire qu’à sa tête. « Le modèle s’est avéré insuffisant en matière de respect du périmètre et des autorisations, ainsi que de communication avec l’utilisateur concernant le type de travail effectué », explique Saachi Jain. En dépit de ses dérives, GPT-6.1 Astra a été jugé nettement plus capable que GPT-6. Il faisait notamment mieux pour mener seul des tâches complexes de bout en bout. Le modèle est aussi plus doué pour l’écriture. Comme l’explique OpenAI, il faut trouver la bonne limite entre le respect du périmètre, qui est fixé par l’utilisateur, et une certaine forme de « paresse » face aux obstacles. Autrement dit, une IA trop sage abandonne un peu trop vite, tandis qu’une IA trop zélée finit par sortir des clous pour répondre coûte que coûte à la demande de son interlocuteur. « Nous voulons garantir la sécurité de nos modèles, tant pendant leur développement en interne que lors de leur mise à disposition des utilisateurs. Mais avant de les déployer, nous leur imposons des exigences particulièrement strictes en matière de sécurité et d’alignement », ajoute le responsable. C’est ce phénomène qui est à l’origine d’une grande partie des incidents récents. En juillet dernier, deux modèles d’OpenAI se sont échappés de leur environnement confiné, ont accédé à Internet et piraté la plateforme Hugging Face. Les IAcherchaient à répondre aux exigences d’un test de sécurité. Plus récemment, le Premier ministre australien a révélé qu’un agent d’OpenAI a piraté un site du gouvernement et consulté des données privées sans la moindre autorisation. Là encore, l’IA cherchait simplement à récolter des données et à répondre à la mission qui lui était confiée. Le même week-end, on a appris que ChatGPT s’était attaqué à plusieurs reprises à un site de l’ONU, ainsi qu’à plusieurs entités du gouvernement américain, pour aspirer des informations. Dans ce contexte, le débat sur le rythme de développement de l’IAs’est intensifié. Sam Altman d’OpenAI et Dario Amodei d’Anthropic ont appelé tout le secteur à lever le pied avant qu’il ne soit trop tard. OpenAI vient d’ailleurs de suspendre l’entraînement de ses derniers modèles, jusqu’à nouvel ordre, à la suite des différents incidents impliquant ses IA. L’un des avantages de cette connexion entre Google Wallet et Gemini est que vous allez pouvoir demander à l’IA de Google de retrouver en un clin d’œil vos cartes et billets via une demande textuelle ou vocale. Pour cela, il suffit de mentionner explicitement le service ou d’ajouter la mention adéquate dans la zone de texte si l’assistant ne l’active pas de lui-même. Plus besoin de fouiller dans votre Wallet, donc, ce qui devrait vous faire gagner du temps en déplacement. La configuration est transparente dans la mesure où vous avez simplement à suivre les instructions à l’écran une fois que la fonctionnalité vous sera proposée. Vous pourrez alors choisir les paramètres des applications connectées, et révoquer l’accès à tout moment. Google précise également que la fonctionnalité est disponible sur smartphone et ordinateur pour ceux qui ont activé l’historique des activités, mais qu’elle ne prend pour l’instant pas en charge les Gems ou Gemini Live.  Google Wallet se connecte enfin à Gemini pour pouvoir poser des questions à l’IA sur les billets et cartes qui se trouvent dans votre portefeuille numérique. Cette nouvelle intégration, qui se fait via les « Applis connectées » dans les paramètres de Gemini, permet d’interroger directement l’IA sur les informations stockées dans votre portefeuille Google Wallet, afin de trouver plus facilement des informations dans vos documents, sans avoir à jongler entre plusieurs applications. Tout le monde ne peut cependant pas avoir accès à ces nouvelles fonctionnalités pour l’instant.

Soyez le premier à commenter

Poster un Commentaire

Votre adresse de messagerie ne sera pas publiée.


*