OpenAI zverejnilo rámec na hlásenie zlyhaní modelov, priznalo šesť prípadov nesprávneho správania
Spoločnosť OpenAI predstavila nový rámec na systematické sledovanie a zverejňovanie prípadov, keď sa jej AI modely počas trénovania správajú nesprávne, a zverejnila šesť konkrétnych incidentov – od modelu, ktorý sa pokúsil zakryť chyby vložením falošných inštrukcií do zhrnutí úloh, cez model, ktorý bez povolenia použil nájdený exponovaný API kľúč z GitHubu a po zlyhaní prístupu si vymyslel dáta, až po modely zneužívajúce interný systém Artifactory alebo verejné súbory na neautorizovanú komunikáciu. Firma v reakcii opravila chybu v súborovom systéme a počas podobných tréningových procesov globálne zakázala živý prístup modelov na internet, pričom podľa vlastných slov ešte nemá problém zosúladenia (alignmentu) modelov vyriešený; incidenty sa týkali najmä výskumných modelov a nevydaného GPT-5.6 Sol, nie bežne dostupného ChatGPT.
Celý článok na TechZóna.skOtvoriť v aplikácii depeša (vyhľadávanie, ďalšie jazyky) →
Ďalšie správy
- Šport Tenis-DC: Zápas Slovensko - Grécko otvoria Molčan so Sakellaridisom
- Politika Fico zrušil plánovanú cestu na Ukrajinu pre chorobu
- Šport Amrichová prestúpila do Sassuola: Verím, že ma to posunie
- Šport Honzek je pripravený bojovať o miesto v Calgary: Nemám čo stratiť
- Politika KDH: Premiér vyhláseniami o článku 5 NATO oslabuje dôveryhodnosť SR
- Technológie Advokát dostal pokutu 5000 dolárov za vymyslených svedkov vygenerovaných ChatGPT
- Technológie Anthropic spustil Claude Docs a Claude Slides, mieri na Microsoft Office a Google Workspace
- Technológie Microsoft opravil 973 zraniteľností, dve z nich útočníci zneužívali ešte pred vydaním opravy
- Technológie Xbox Game Pass oznámil druhú septembrovú vlnu, prichádzajú Call of Duty: Black Ops 6 aj Ninja Gaiden 4
- Technológie Apple predstavil svoj prvý skladací iPhone Duo