Charles Tech
Actualité

Anthropic blacklisté par le Pentagone pour des capacités qu'il n'avait pas

Charles Gouin-Peyrot

· · 3 min de lecture

Anthropic blacklisté par le Pentagone pour des capacités qu'il n'avait pas
© CharlesTech avec ChatGPT

Le Pentagone aurait inscrit Anthropic sur une liste noire en lui attribuant des fonctionnalités que son assistant Claude ne possédait pas réellement. Cette décision, révélée par The Register, soulève des questions sur la rigueur des évaluations menées par le ministère de la Défense américain à l'égard des entreprises d'intelligence artificielle.

L'affaire met en lumière un problème récurrent dans les institutions gouvernementales : la difficulté à évaluer avec précision les capacités réelles des systèmes d'IA, dans un secteur qui évolue rapidement et dont les communications commerciales sont parfois difficiles à démêler des réalités techniques.

Une mise sur liste noire fondée sur des faits inexacts

Selon les informations rapportées par The Register, le Pentagone aurait pris sa décision en se basant sur une évaluation erronée des capacités de Claude, le modèle développé par Anthropic. Les fonctionnalités incriminées n'auraient tout simplement pas existé dans le système au moment des faits.

Ce type d'erreur dans un contexte de sécurité nationale est particulièrement significatif. Une mise sur liste noire peut avoir des conséquences directes sur la capacité d'une entreprise à collaborer avec des agences fédérales, à accéder à des contrats publics et à développer des partenariats institutionnels aux États-Unis.

Anthropic blacklisté par le Pentagone pour des capacités qu'il n'avait pas
© CharlesTech avec ChatGPT

Anthropic, fondée en 2021 par d'anciens membres d'OpenAI, positionne Claude comme un modèle axé sur la sécurité et l'alignement. Être associé à des capacités problématiques que l'entreprise nie détenir représente donc un enjeu d'image particulièrement sensible pour elle.

La difficulté d'évaluer les systèmes d'IA pour les institutions

Ce cas n'est pas isolé. Les agences gouvernementales peinent régulièrement à distinguer ce que les modèles d'IA peuvent faire concrètement de ce que les communications marketing ou les rapports de tiers laissent entendre. La frontière entre capacités réelles et perçues reste floue, y compris pour des acteurs disposant de ressources importantes.

Anthropic blacklisté par le Pentagone pour des capacités qu'il n'avait pas
© CharlesTech avec ChatGPT

Le Pentagone, comme d'autres institutions de défense, intensifie depuis plusieurs années son examen des technologies d'IA susceptibles de poser des risques pour la sécurité nationale. Cette vigilance accrue s'accompagne toutefois d'un risque d'erreur d'appréciation, surtout lorsque les évaluations reposent sur des sources secondaires plutôt que sur des tests directs des systèmes concernés.

Les enjeux pour Anthropic et le secteur

Pour Anthropic, l'enjeu dépasse la seule relation avec le Pentagone. L'entreprise cherche à s'imposer comme un fournisseur fiable pour les administrations publiques et les entreprises régulées, ce qui exige une réputation irréprochable en matière de transparence sur ses capacités.

Plus largement, cette affaire pointe vers un problème structurel du secteur : en l'absence de cadres d'évaluation standardisés et indépendants, les décisions institutionnelles concernant les systèmes d'IA restent exposées à des erreurs factuelles. Plusieurs organisations travaillent à l'élaboration de tels cadres, mais leur adoption reste limitée à ce stade.

La situation d'Anthropic illustre les risques auxquels s'exposent les développeurs d'IA lorsque la perception de leurs outils échappe à leur contrôle, même lorsque les faits leur sont favorables.

Source : Theregister

L'auteur

Charles Gouin-Peyrot

Journaliste tech et testeur indépendant, je décrypte la tech grand public. Spécialisé dans le hardware, l'audio et la maison connectée, je mets ma rigueur technique et mon expérience de formateur au service de mes tests. Mon objectif est simple : dépasser les fiches techniques pour vous livrer des analyses transparentes, impartiales et ancrées dans un usage 100 % réel.

Voir tous ses articles