Anthropic lanserte Claude Fable 5 med store lovord om biologiforståelse og vitenskapelig kompetanse. Så viste det seg at modellen ikke svarte på pensumspørsmål fra videregående skole, og at selskapet hadde lagt inn skjulte begrensninger uten å fortelle noen om det. Nå har de beklaget og lovet å gjøre det bedre.
Det skjer sjelden at et av verdens ledende AI-selskaper går ut og sier unnskyld. Anthropic gjorde nettopp det denne uken, etter at det kom frem at Claude Fable 5 hadde skjulte sikkerhetssperringer som verken brukere, forskere eller konkurrenter fikk vite om ved lansering.
Hva slags begrensninger var det snakk om? Ifølge flere internasjonale tech-medier svarte ikke modellen på helt ordinære biologispørsmål, den typen du finner i lærebøker for 16-åringer. Modellen omdirigerte i stedet til andre ressurser, uten å forklare hvorfor. For forskere som brukte Fable 5 til å utvikle konkurrerende systemer, skapte dette åpenbare problemer. De fikk ikke den modellen de trodde de betalte for.
Skjulte sperrer bryter tilliten
På overflaten handler dette om biologi og sikkerhetsfiltre, men kjernen i saken er et tillitsbrudd.
Når du abonnerer på et AI-verktøy, inngår du en slags stilltiende kontrakt: du betaler, verktøyet gjør det det er annonsert for. Skjulte begrensninger bryter den kontrakten uten varsel. Du sitter igjen med et verktøy som oppfører seg uforutsigbart, og ingen forklaring på hvorfor.
For vanlige brukere er dette irriterende. For forskere og utviklere som bygger systemer oppå Claude, kan det være direkte kostbart. De har designet arbeidsflyter, testet ytelse og tatt tekniske beslutninger basert på hva modellen skal kunne gjøre, mens den i det stille har gjort noe helt annet.
Sikkerhetsfiltre bør stå i dokumentasjonen
La oss være rettferdige mot Anthropic: selskapet er genuint opptatt av AI-sikkerhet, og det er ikke urimelig å legge inn sperringer mot innhold som kan misbrukes. Biologisk kunnskap kan i teorien brukes til å utvikle farlige ting, og det er forståelig at et selskap vil være forsiktig.
Men forskjellen mellom å ha sikkerhetspolicyer og å skjule dem er stor. Hvis Claude ikke skal svare på visse typer spørsmål, bør det stå i dokumentasjonen. Brukere og utviklere kan da gjøre informerte valg om verktøyet passer for dem.
Her oppdaget folk i stedet begrensningene ved å støte på dem i praksis. Anthropic fortalte dem aldri om det. Praksisen er dårlig, og Anthropic erkjenner det selv. Det er bakgrunnen for beklagelsen.
Uklarheten går igjen hos flere selskaper
Dette er ikke første gang AI-selskaper har vært uklare om hva modellene faktisk kan og ikke kan. Forskjellene mellom de store assistentene handler om hvilke valg selskapene tar bak kulissene, langt mer enn om rene evner. Disse valgene påvirker deg som bruker uten at du nødvendigvis vet om det.
Det er også verdt å merke seg at denne saken dukket opp bare dager etter lanseringen. Fable 5 ble hyllet som den sterkeste modellen tilgjengelig for vanlige brukere. Det er mulig den fortsatt er det. Men episoden minner oss om at markedsføring og virkelighet ikke alltid er det samme, og at det er sunt å teste verktøy selv og heller stole på egne erfaringer enn på lanseringsomtaler.
Slik påvirker saken deg som bruker
Praktisk sett er situasjonen denne: Anthropic sier de reverserer de skjulte begrensningene og vil kommunisere tydeligere fremover. Claude Fable 5 er fortsatt en svært kapabel modell, og for de fleste brukstilfeller vil du neppe merke noe til det som skjedde.
Men hvis du bruker AI-verktøy til noe viktig, enten det er forskning, jobb eller beslutninger du tar på bakgrunn av svarene, er det verdt å ha i bakhodet at modellene ikke alltid er det de fremstilles som. Test konkrete oppgaver selv, og sammenlign gjerne flere verktøy. Vær også skeptisk når noe oppfører seg rart uten forklaring, for det skjer fra tid til annen.
Transparens er et fint ord, men for AI-verktøy du stoler på daglig, er det først og fremst en forutsetning. Anthropic ser ut til å være enig i det nå, om enn litt sent.
Vi følger saken videre og oppdaterer hvis Anthropic kommer med mer konkret informasjon om hvilke begrensninger som gjelder og for hvilke emner. Vil du holde deg oppdatert på det viktigste som skjer i AI-verdenen, er våre løpende AI-nyheter et godt sted å starte.




