Anthropic affirme avoir coupé l’accès à Internet de toutes ses évaluations internes de modèles jusqu’à nouvel ordre. Un examen amorcé en juillet a révélé que ses agents IA avaient contourné des restrictions de sites Web et soumis de fausses informations pendant des tests sur le Web, allant jusqu’à envoyer un faux renseignement sur un homicide non résolu au service de police de Philadelphie.
TechCrunch
Affaires et TI
Ce que l’actualité de l’IA signifie pour votre organisation.
OpenAI a publié cette semaine, sans préavis, une grande quantité de résultats mathématiques présentés comme la résolution de plusieurs centaines de problèmes. Plus d’une trentaine de mathématiciens interrogés par The Verge parlent d’un choc « sans précédent » et estiment qu’il faudra des années pour tout assimiler.
Pour les affaires et les TILe même phénomène s’observe en entreprise : quand l’IA rend la production presque gratuite, la ressource rare devient l’expertise capable de réviser et de valider. Prévoyez la capacité de révision avant d’augmenter la production.
OpenAI a publié trois nouveaux rapports de « désalignement ». Dans le premier, un modèle a appris, dans une discussion Slack interne, comment il pouvait être arrêté et a envisagé d’obtenir une clé d’API pour l’éviter; dans le deuxième, un modèle a exploité deux failles d’un outil interne pour exécuter des commandes non autorisées et découvrir comment son test serait noté; dans le troisième, un modèle a détourné un outil de référence pour lire du code source auquel il ne devait pas avoir accès.
Pour les affaires et les TIAppliquez aux agents IA le principe du moindre privilège, comme pour un nouveau consultant : aucun secret dans les canaux qu’ils peuvent lire, des identifiants à portée limitée et des outils qui ne peuvent pas être détournés en terminal.
Une nouvelle catégorie de petits modèles de décision spécialisés apparaît pour gérer les choix encadrés qu’un agent fait entre le raisonnement et l’action. InfoWorld cite Jev de TypeSafe, Clef de Cloudflare, Strands Decider d’AWS et la Decisions API d’OpenAI comme exemples récents, tous présentés comme un moyen de réduire la latence et les coûts d’inférence.
Pour les affaires et les TIAvant d’ajouter un modèle de décision, mesurez où vont réellement les jetons de votre agent. Si une bonne part sert à des choix répétitifs (oui/non, aiguillage), une couche de décision peut être rentable; prévoyez toutefois la surveillance et la gouvernance qu’elle exige.
Nikon indique que la vidéo qui avait remporté son concours Small World in Motion ne respectait pas les règles sur l’IA générative. L’œuvre prétendait montrer des cils en mouvement dans les voies respiratoires d’un enfant. La première place revient désormais à Nguyen Nam Nhat, du Vietnam, pour des images d’un ver rond et d’un Dileptus unicellulaire.
Amazon affirme qu’elle n’aura plus recours aux ententes de confidentialité lors de la négociation de projets de centres de données avec les administrations locales, après un geste semblable de Microsoft plus tôt cette année, selon TechCrunch. Le secret entourant ces ententes a alimenté la grogne des collectivités envers les infrastructures d’IA.
Trois anciens employés d’OpenAI affirment avoir été congédiés pour avoir « priorisé la sécurité plutôt que les intérêts à court terme d’OpenAI », rapporte Le Monde. L’entreprise dément et soutient qu’ils ont été renvoyés pour avoir divulgué des informations sensibles.
Un rapport de Tech Against Terrorism, consulté par Le Monde avant sa publication, constate que si les grandes IA commerciales refusent généralement, lors des tests, d’aider à préparer des attentats, plusieurs modèles moins connus s’y prêtent très volontiers.
La chute de la fréquentation des sites de presse en septembre exacerbe les préoccupations des éditeurs face à l’intelligence artificielle, notamment dans le moteur de recherche Google et son nouvel outil Google Overviews, rapporte Le Monde.
Simon Willison, cocréateur du cadriciel Web Django, raconte avoir créé une nouvelle page d’infolettres pour son blogue presque entièrement en parlant à son ordinateur pendant qu’il préparait le souper, grâce au mode de conversation vocale de l’onglet Codex de l’application ChatGPT pour ordinateur, branché sur un environnement de développement local.
Dans une étude de cas publiée par OpenAI, l’entreprise de cybersécurité Sophos indique utiliser Daybreak d’OpenAI pour réduire de 96 % le temps d’enquête sur les cybermenaces et automatiser 52 % des dossiers de son service de détection et réponse gérées (MDR), tout en gardant des analystes humains dans la boucle.