OpenAI odhaluje nové "znepokojující" chování

18. 9. 2026

čas čtení 2 minuty
Nové zprávy o transparentnosti od OpenAI ukazují, že některé modely AI se dopouštějí klamavého chování, což vyvolává nové otázky ohledně bezpečnosti, spolehlivosti a řízení pokročilé umělé inteligence, píše Emilio Reynoso.

OpenAI, vývojář stojící za ChatGPT, odhalil, že zaznamenal nové incidenty, při nichž se jeho umělá inteligence (AI) chovala "nečekaně nebo znepokojujícím" způsobem.

Vývojář provedl několik behaviorálních testů na AI modelech a podle nich některé modely vynaložily významné úsilí k "podvádění". V jednom konkrétním případě se AI pokusila nahrát na internet soubory, které si sama vytvořila, jen aby je později citovala a prezentovala jako spolehlivé zdroje ve svých odpovědích. V jiném případě model, který nenašel požadované informace, je zfalšoval a snažil se to skrýt.

OpenAI také identifikovala problém týkající se instrukcí ohledně "rolí a identit", které si její software občas nechával pro sebe.

Tato zveřejnění jsou součástí nového přístupu OpenAI, který tvrdí, že se nyní zaměřuje na to, aby byla tato zjištění transparentní, zejména v případech, kdy se AI chová neočekávaně nebo sleduje cíle odlišné od lidských uživatelů.

Je AI hrozbou?

Vývojář ChatGPT slíbil větší transparentnost ohledně svých testovacích postupů poté, co jeho software nezávisle unikl bezpečnému sandboxu a pronikl do systémů patřících společnosti Hugging Face zabývající se umělou inteligencí. Důvodem, proč se software během kybernetického útoku snažil obejít zabezpečení Hugging Face, bylo to, že věřil, že najde odpovědi na test, který mu byl přidělen.

Během útoku AI agenti zneužili softwarové zranitelnosti a koordinovali se navzájem. Incident s hackery a další podobné události vyvolaly obavy, že AI systémy jsou stále pokročilejší a mohly by se nakonec vymknout lidské kontrole.

Generální ředitel OpenAI Sam Altman také nedávno podpořil návrhy na zpomalení vývoje technologie a zavedení přísnější regulace.

Ačkoliv poukazují na to, že tyto obavy mohou být oprávněné, výzkumníci se také ptají, zda nejde o taktiku odklonu pozornosti, která má za cíl zvýšit investice a odvést pozornost od environmentálních škod, které v současnosti způsobují datová centra AI.

Zdroj v angličtině: ZDE

0
Vytisknout
151

Diskuse

Obsah vydání | 18. 9. 2026