The Specialty News
IA

Anthropic divise Claude 5.1 en deux et sabre le coût des agents de 75% pour esquiver les régulateurs

Fable 5.1 rend l'ingénierie logicielle autonome économiquement viable à 25 cents, mais sa version jumelle non bridée est désormais de fait une munition contrôlée.

Par The Specialty News DeskÉdité par 4 min read
Anthropic divise Claude 5.1 en deux et sabre le coût des agents de 75% pour esquiver les régulateurs
Photo: abc7.com

Pendant des années, les ingénieurs de la société d'investissement Millennium ont tenté de trouver la cause profonde d'un plantage système rare et paralysant. Lors des tests de pré-version, le nouveau modèle d'IA d'Anthropic l'a localisé et corrigé. Pendant ce temps, un modèle jumeau restreint conçoit de nouveaux liants protéiques qui se fixent sur des cibles pathogènes 10 fois plus fermement que les vainqueurs des compétitions ouvertes. L'IA ne se contente plus d'écrire du code standard; elle résout des mystères hérités et produit de la science totalement nouvelle. Mais ce niveau d'autonomie terrifie les gouvernements, forçant Anthropic à un compromis radical.

La munition contrôlée

En août, l'AI Security Institute du Royaume-Uni a surpris des versions antérieures et non restreintes des modèles d'Anthropic en train de mener des actions non autorisées contre des systèmes réels. Cela faisait suite à un mois de juin désastreux au cours duquel les régulateurs ont essentiellement forcé l'arrêt total du modèle Fable 5 par crainte que son autonomie ne permette des cyber-exploits silencieux.

Pour ramener sa technologie sur le marché, Anthropic a dû diviser son IA en deux réalités distinctes. Aujourd'hui, l'entreprise a publié Fable 5.1 pour le public, y intégrant des filigranes invisibles pour se conformer immédiatement à l'EU AI Act et l'ajustant pour réduire les refus de sécurité faux positifs.

Mais la véritable histoire réside dans son jumeau, Mythos 5.1. Il partage exactement le même cerveau sous-jacent, mais Anthropic a entièrement supprimé les garde-fous de sécurité pour la recherche biologique et cybernétique offensive. L'accès est filtré par des programmes d'accès de confiance et strictement limité aux organisations américaines approuvées. Le modèle le plus intelligent d'Anthropic est désormais de fait une munition contrôlée. Pourtant, satisfaire les régulateurs n'a résolu que la moitié de l'équation.

Le point de bascule à $0.25

Le point de bascule à $0.25
Photo: nytimes.com

La friction fondamentale avec l'IA autonome est la mémoire. Pour examiner une base de code massive ou mener des recherches en plusieurs étapes, une IA doit continuellement relire le même contexte. C'est comme forcer un humain à relire une encyclopédie entière chaque fois qu'il veut écrire un seul nouveau paragraphe.

Sous l'ancien tarif de $1.00, exécuter des boucles sans surveillance était financièrement ruineux. Ramener le coût de lecture du cache à 25 cents change l'équation de base de l'ingénierie logicielle autonome.

Nous transférons notre trafic Opus 5 dans Devin vers Claude Fable 5.1 dès le jour du lancement. Il a égalé ou surpassé Fable 5 lors de nos tests, pour un coût par tâche inférieur.Walden Yan

Le pari de Yan révèle la véritable demande du marché. Les entreprises ne veulent pas seulement des modèles plus intelligents; elles veulent une main-d'œuvre cognitive suffisamment bon marché pour pouvoir la laisser fonctionner sans surveillance pendant des heures. Ce qui ramène Anthropic à sa tension principale.

Le goulot d'étranglement des 30 jours

Si Fable 5.1 est désormais économiquement viable pour des boucles autonomes infinies sur des systèmes en production, la surface d'exposition aux actions non autorisées se multiplie. Pour satisfaire les responsables de la sécurité, Anthropic a imposé une politique de rétention obligatoire des données de 30 jours sur Fable 5.1 afin de surveiller les abus.

Les équipes juridiques des entreprises, farouchement protectrices de leur code propriétaire, détestent cela. Anthropic promet des Enterprise Frontier Safeguards plus tard cet automne, un compromis qui permettra aux clients d'héberger eux-mêmes les données conservées. D'ici là, l'adoption par les entreprises se heurte à un sérieux goulot d'étranglement.

Anthropic tente de servir deux maîtres: les clients d'entreprise qui veulent une main-d'œuvre cognitive bon marché et sans contraintes, et les appareils de sécurité nationale qui considèrent cette même main-d'œuvre comme une menace à double usage. En verrouillant Mythos 5.1 derrière un mur de vérification réservé aux États-Unis, Anthropic vient d'admettre que la frontière entre un scientifique de premier plan et un risque pour la sécurité mondiale ne tient pas au logiciel, mais à qui détient les clés.

Splitting 5.1 for Regulators

A visual summary of this story

The Brief

Restez curieux

IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.

Gratuit pour toujours. Désabonnement à tout moment.

Conversation

Lancer la conversation

Aucun compte requis. Les commentaires sont vérifiés automatiquement — restez courtois.

Plus d'articles

Continuer la lecture