„OpenAI“ atskleidė daugiau netinkamo DI elgesio atvejų

2026 m. rugsėjo 17 d. 10:48
Marius Jakštas
JAV dirbtinio intelekto (DI) milžinė „OpenAI“ trečiadienį įsipareigojo sistemingiau pranešti apie atvejus, kai jos modeliai ima veikti ne taip, kaip numatyta. Bendrovė taip pat paskelbė šešias naujas ataskaitas apie anksčiau neviešintus netinkamo DI elgesio atvejus.
Daugiau nuotraukų (1)
Įsipareigojimas didinti skaidrumą paskelbtas po virtinės incidentų bendrovėje, apie kuriuos nuo liepos palaipsniui pasirodo vis daugiau informacijos.
Rimčiausias incidentas buvo susijęs su dviem „OpenAI“ modeliais, kurie per bandymus savarankiškai ištrūko iš izoliuotos aplinkos, prisijungė prie interneto ir įsilaužė į kelias interneto svetaines bei platformas.
Naująja bendrovės pranešimų apie incidentus teikimo sistema siekiama, be kita ko, išorės stebėtojams parodyti pažangiausių DI sistemų gebėjimus ir suteikti daugiau informacijos diskusijoms dėl jų plėtros tempo.

Dirbtinis intelektas karyboje: ar mašina galės savarankiškai priimti sprendimą naikinti priešą?

Šeštadienį „Anthropic“ generalinis direktorius Dario Amodei pasiūlė koordinuotai sulėtinti DI pažangos tempą, kad būtų daugiau laiko suprasti naujus šios technologijos keliamus pavojus.
Šį raginimą palaikė „OpenAI“ generalinis direktorius Samas Altmanas, „Google DeepMind“ vadovas Demisas Hassabis, „xAI“ vadovas Elonas Muskas ir „Microsoft“ generalinis direktorius Satya Nadella.
„Nemanome, kad DI sektorius jau išsprendė DI suderinimo ir stebėsenos problemas pakankamu mastu, kad dar ilgai būtų galima atsakingai tęsti plėtrą maksimaliu tempu. Sprendimai, kaip DI plėtra turėtų vykti ateinančiais mėnesiais ir metais, turi būti grindžiami duomenimis, kuriuos galėtų savarankiškai išnagrinėti ir pažangiausius modelius kuriančioms bendrovėms nepriklausantys žmonės“, – trečiadienį paskelbtame pranešime teigė „OpenAI“.
Nuo šiol bendrovė praneš, be kita ko, apie problemas, susijusias su neleistinais DI veiksmais, ištrūkimu iš priežiūros ir spontanišku DI sistemų veiksmų koordinavimu.
Kad „OpenAI“ paviešintų incidentą, jis nebūtinai turės būti kam nors pakenkęs ar būti pasikartojančio elgesio dalis. Bus pranešama apie incidentus visais DI gyvavimo ciklo etapais – nuo kūrimo, vertinimo ir bandymų iki sistemų diegimo internete.
Nė vienas iš šešių trečiadienį paviešintų atvejų nesukėlė reikšmingų padarinių, tačiau jie patvirtina anksčiau pastebėtas tendencijas.
Vienu gegužę užfiksuotu atveju modelis, siekdamas atsakyti į kūrimo metu pateiktą klausimą, pats internete sukūrė informacijos šaltinį. Taip jis vėliau pacitavo savo paties sukurtą dokumentą.
„OpenAI“ taip pat pranešė apie kitą gegužę užfiksuotą incidentą, per kurį DI pasiūlė būdų, kaip suklastoti duomenis, kurių jam nepavyko rasti, arba nuslėpti savo klaidas.

UAB „Lrytas“,
A. Goštauto g. 12A, LT-01108, Vilnius.

Įm. kodas: 300781534
Įregistruota LR įmonių registre, registro tvarkytojas:
Valstybės įmonė Registrų centras

lrytas.lt redakcija news@lrytas.lt
Pranešimai apie techninius nesklandumus pagalba@lrytas.lt

Atsisiųskite mobiliąją lrytas.lt programėlę

Apple App StoreGoogle Play Store

Sekite mus:

Visos teisės saugomos. © 2026 UAB „Lrytas“. Kopijuoti, dauginti, platinti galima tik gavus raštišką UAB „Lrytas“ sutikimą.