Virksomheden citerede en amerikansk eksportkontrolordre, som kom få dage efter, at den afslørede tidligere skjulte Fable 5-sikkerhedsforanstaltninger. Det amerikanske AI-firma Anthropic sagde fredag, at det deaktiverede adgangen til sine mest avancerede AI-modeller, Fable 5 og Mythos 5, efter at have modtaget en regeringsordre om at suspendere adgang for udenlandske statsborgere.
Virksomheden sagde, at det lukkede ned for modellerne for alle brugere, mens de vurderer, hvordan eksportkontrol skal overholdes. Ordren gjaldt også for udenlandske statsborgere antropiske medarbejdere, tilføjede det. Virksomheden sagde, at regeringen ikke gav detaljerede oplysninger om den påståede sikkerhedsrisiko.
Ifølge Anthropic mener embedsmænd, at brugerne kan have opdaget en måde at omgå modellernes sikkerhedskontrol og få dem til at hjælpe med at finde softwaresårbarheder. Anthropic bestridte betydningen af bypasset og sagde, at det kun var i stand til at afsløre et lille antal tidligere kendte, mindre softwaresårbarheder.
Anthropic udgav Fable 5 og Mythos 5 tidligere på ugen. Fable 5 var beregnet til generel brug med yderligere sikkerhedsforanstaltninger, mens Mythos 5 kun blev gjort tilgængelig for en begrænset gruppe af betroede cybersikkerhedspartnere med nogle begrænsninger fjernet. Anthropic sagde, at Fable 5’s muligheder “overstiger dem for hver model, vi tidligere har gjort almindeligt tilgængelige.”
Onsdag sagde Anthropic, at det ville gøre restriktioner for deres mest avancerede AI-modeller mere gennemsigtige, herunder ved at afsløre, hvornår brugeranmodninger nedgraderes eller afvises. Flytningen kom efter kritik af, at nogle begrænsninger ikke var synlige for brugerne. Inden politikændringen kunne Anthropic stille forespørgsler, der involverede cybersikkerhed, biologi og avanceret AI-udvikling, fra Fable 5 til den mindre dygtige Opus 4.8-model.
I henhold til den nye politik vil brugere blive underrettet, når en anmodning er markeret, mens udviklere af Application Programming Interfaces (API) vil modtage forklaringer på enhver afvisning eller tilbagevenden til en anden model. LÆS MERE: Pope brugte AI til at advare om farerne ved AI – forsker Tilgangen fik kritik fra forskere, der hævdede, at routing af nogle anmodninger relateret til frontier AI-udvikling til en mindre dygtig model kunne bremse fremskridtene på området.
Som reaktion på tilbageslaget gik Anthropic med til at gøre sikkerhedsforanstaltningerne synlige. Virksomheden har tidligere nævnt nationale sikkerhedsproblemer som en grund til at afvise eller nedgradere nogle anmodninger, idet de argumenterede for, at udenlandske modstandere kunne bruge dets teknologi til at styrke deres AI-kapacitet.