OpenAI satte modelltrening på pause mens sikkerheten ble styrket
OpenAI meldte om en treningspause og strengere tiltak etter tegn på kritisk cyberevne. Kunngjøringen synliggjør også kostnaden ved å følge opp AI-agenter.
Forsidebildet er en AI-generert redaksjonell illustrasjon. Skjermer og dokumenter er illustrerte konsepter.
OpenAI opplyste at selskapet hadde tatt en to ukers pause i forsterkningslæring av sine mest avanserte modeller. Det største planlagte treningsløpet var fortsatt satt på vent mens sikringen ble styrket. I kunngjøringen fra august viste selskapet til foreløpige tegn på at Astra kunne nå nivået Critical for cyberevne i eget rammeverk.
Dette beskrev utviklingsprogrammet på det tidspunktet. Det var verken en permanent stans eller en prognose for når andre modeller ville få samme evner.
Tiltakene omfattet strengere isolering av arbeidsoppgaver og nettverk, mer overvåking og en prosess for å håndtere mulige brudd på sikkerhetsgrenser. OpenAI anslo at overvåkingen krevde rundt 20 prosent ekstra beregningskapasitet sammenlignet med inferensen som ble overvåket, med store forskjeller mellom arbeidsoppgaver.
Oppfølgingen må inn i regnestykket
Prosenttallet gjelder OpenAIs oppsett. Det er ingen budsjettnøkkel for en norsk SMB. Poenget er at overvåking krever ressurser og må planlegges samtidig med agenten.
Et regnestykke som bare tar med modellabonnement og spart arbeidstid, utelater vedlikehold av integrasjoner, vurdering av viktige handlinger, undersøkelser av varsler og gjenoppretting etter feil. Avklar hvem som gjør dette, og hvor raskt de må kunne reagere.
Tenk på en kundestøtteagent som kan endre kundedata. Logging er nyttig, men hindrer ikke en skadelig endring alene. Det kan også være nødvendig med rettigheter per felt, godkjenning av følsomme handlinger og en pålitelig måte å gjenopprette tidligere verdier på. Konsekvensene avgjør hvilke tiltak som passer.
Sett grenser før tilgangen utvides
Start med en avgrenset arbeidsflyt og et tydelig mål. Agenten bør kunne stoppe og be om hjelp når oppgaven ikke kan løses innenfor rettighetene. Utholdenhet er ikke alltid ønskelig.
Kontroller deretter grensene rundt agenten: separate kjøremiljøer, begrensede nettverksmål og nøkler som utløper eller kan tilbakekalles hver for seg. Hugging Face-rapporten viser hvordan en felles støttetjeneste kan svekke isoleringen.
Modellleverandørens sikring er én del av oppsettet. Virksomheten bestemmer fortsatt hvilke data og handlinger egne integrasjoner gjør tilgjengelige.