OpenAI ir Anthropic saugumo vertintojai: nepriklausomybę reikės įrodyti
·

OpenAI ir Anthropic saugumo vertintojai gali skambėti kaip geras kompromisas. Laboratorijos įsileidžia išorinius žmones, šie pamato daugiau nei viešose demonstracijose, o visuomenė gauna daugiau pasitikėjimo.
TechCrunch rašo, kad abi bendrovės nori įterpti nepriklausomus saugumo vertintojus į savo DI laboratorijas. Tyrėjai tokią prieigą vertina, bet klausia, ar ji tikrai bus nepriklausoma.
Čia panašu į auditą. Vien įleisti auditorių į pastatą dar nereiškia, kad jis gali atidaryti visas duris.
PRIEIGA YRA DIDELIS DALYKAS
DI saugumo tyrėjai dažnai dirba iš išorės. Jie mato modelio elgesį, viešus dokumentus, ribotus testus ir incidentų ataskaitas.
Jei vertintojai gauna vidinę prieigą, jie gali tikrinti anksčiau, giliau ir konkrečiau. Tai gali padėti rasti rizikas dar prieš produktui pasiekiant milijonus žmonių.
Tokios prieigos ilgai trūko. Todėl pati kryptis yra sveika.
BET KAS MOKA UŽ KĖDĘ
Nepriklausomybė prasideda nuo paprasto klausimo: kas parenka vertintojus, kas moka, kas gali publikuoti nepatogias išvadas?
Jei laboratorija leidžia žiūrėti tik į pasirinktus testus, priežiūra tampa gražiu pažadu. Jei vertintojas negali kalbėti viešai, visuomenė gauna tik pasitikėjimo dekoraciją.
Todėl TechCrunch keliamas klausimas labai žemiškas. Ar tai bus tikras patikrinimas, ar reputacijos remonto mechanizmas?
KĄ TAI REIŠKIA VERSLUI
Įmonėms verta stebėti ne tik modelio galimybes, bet ir jo priežiūros tvarką. Kas testavo? Kokiomis sąlygomis? Ar išvados viešos?
Perkant DI paslaugas, saugumo pažadas be patikrinimo tampa panašus į lipduką ant dėžutės. Gražu, bet mažai padeda, kai atsiranda incidentas.
Geras tiekėjas neturėtų bijoti klausimų. Ypač tada, kai jo įrankis patenka į klientų duomenis, finansus ar vidinius procesus.
FAQ
Ką planuoja OpenAI ir Anthropic?
Jos nori suteikti išoriniams saugumo vertintojams daugiau prieigos prie savo DI laboratorijų ir modelių testavimo.
Kodėl tai svarbu?
Vidinė prieiga gali padėti rasti rizikas anksčiau nei modeliai plačiai paleidžiami vartotojams.
Kokia pagrindinė rizika?
Jei vertintojai priklausys nuo pačių laboratorijų sąlygų, jų nepriklausomumas gali būti ribotas.
Šaltinis: TechCrunch.
Renkantis DI įrankį, paklauskite tiekėjo ne tik ką modelis moka. Paklauskite, kas ir kaip tikrino, ar jis saugus.


