OpenAI nevydá model GPT-6.1 Astra. Prý nesplnil požadavky na bezpečnost

  • OpenAI ruší vydání modelu GPT-6.1 Astra, který měl dorazit v říjnu
  • Model v interních testech nesplnil bezpečnostní standardy firmy
  • Podle deníku The Wall Street Journal klamal častěji než předchůdce

Sdílejte:
Adam Kurfürst
Adam Kurfürst
29.9.2026 19:45
Ikona komentáře 0
chatgpt logo s krizkem zruseni ai ilustrace

Nástupce vlajkového modelu, který OpenAI představila na začátku září, se do ChatGPT ani do Codexu hned tak nepodívá. Firma v pondělí potvrdila, že vydání GPT-6.1 Astra ruší, protože model při interním testování nesplnil její laťku v oblasti bezpečnosti a sladění s lidskými záměry (tzv. alignmentu).

Model GPT-6.1 Astra selhává s ohledem na bezpečnost

S informací jako první přišel deník The Wall Street Journal, odvolávají se na něj agentura Reuters a server Engadget. Podle něj model v interních testech vykazoval vyšší míru klamání než jeho předchůdce – ne vždy například přesně přiznal, jaké kroky ve skutečnosti provedl. Model měl přitom zvládat složitější úkoly bez lidské pomoci a při jejich plnění si podle dostupných zpráv sahal po externích nástrojích a službách, aniž by požádal o svolení.

Vedoucí bezpečnostních systémů OpenAI Saachi Jain podle agentury Reuters uznává, že se nový model v něčem zlepšil, třeba méně „lenošil“. Nedosáhl ale na požadovanou úroveň v tom, jestli se drží zadání a udělených oprávnění, ani v tom, jak uživateli popisuje odvedenou práci. „Když model dáváme uživatelům, máme extrémně vysokou laťku,“ dodává Jain.

Co bude s řadou GPT-6 dál?

Konec GPT-6.1 Astra neznamená konec celé generace. Stejný základní model firma využije i pro další verze GPT-6. Nejdřív chce dohledat, kde se problémy vzaly, a pak nasadit posilované učení (reinforcement learning), které bude žádoucí chování modelu odměňovat.

Zrušení je dalším článkem řetězce incidentů

Rozhodnutí zapadá do série incidentů, které firmu provázejí od léta. Její modely v červenci utekly z testovacího prostředí a nabouraly platformu Hugging Face, později OpenAI přiznala i průniky do dalších služeb – mezi nimi australský systém veřejného zdravotního pojištění Medicare, službu pro distribuci balíčků jazyka Ruby nebo německé programátorské fórum. Na konci minulého týdne pak kvůli dalšímu úniku modelu na internet pozastavila trénink svých nejschopnějších modelů.

Ani současný GPT-6 Astra není bez výhrad – OpenAI sama varuje, že se občas dokáže vymanit z lidského dohledu. Šéf firmy Sam Altman se spolu s Dariem Amodeiem z konkurenčního Anthropicu tento měsíc připojil k výzvám ke zpomalení vývoje AI a k silnějším pojistkám. Floridský generální prokurátor James Uthmeier navíc podal ke státnímu soudu návrh, aby OpenAI nesměla trénovat nové modely bez nezávislého dohledu.

Věříte, že OpenAI dokáže další modely udržet pod kontrolou?

Zdroje: Reuters, Engadget

O autorovi

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Více o autorovi

Adam Kurfürst
Sdílejte: