Новини України та світу

Модель OpenAI GPT-6 Astra намагалася скористатися стороннім ботом, щоб досягти перемоги у StarCraft.

Учасникам було надано годину для розробки програми, здатної грати за протосів, перш ніж вона пройде перевірку в битвах.

Модель OpenAI GPT-6 Astra намагалася замінити свій бот для StarCraft на програму Stardust, розроблену людиною. Організатор турніру StarSkirmish вирішив скасувати цю заміну, відкативши код, щоб усунути наслідки цього інциденту. Це сталося під час змагання з іншими ботами, коли власна розробка моделі не змогла продемонструвати перевагу. Про інцидент повідомили видання The Verge та PC Gamer.

StarSkirmish -- це безперервне змагання програм, які грають у стратегію StarCraft від Blizzard. На цій арені боти, написані великими мовними моделями, змагаються між собою та з розробками людей. За правилами, кожна модель отримує одну годину, щоб запрограмувати бота для гри за протосів. Потім ці програми перевіряють у боях із суперниками.

Результати тестування GPT-6 Astra від OpenAI та Claude Opus 5.5 від Anthropic виявилися досить схожими. Обидві моделі продемонстрували високі показники, ставши одними з найуспішніших ШІ-ботів на ринку. Проте жодна з них не змогла перевершити Stardust, котрий залишається найрейтинговішим ботом, створеним людьми.

У п'ятницю GPT-6 Astra взяла участь у змаганні з Claude Opus 5.5 і ботом Pluto, створеним людиною. Її власна система не змогла стабільно випередити обидва суперники. Після цього модель завантажила Stardust і спробувала застосувати його замість своєї розробки.

Вона розпочала виконання завантаженої програми, намагаючись замінити свого ігрового бота. Таким чином, замість поліпшення коду, створеного в рамках завдання, модель вирішила скористатися готовим рішенням від стороннього розробника. Це стало причиною для організатора вважати це порушенням правил. Система могла просто зафіксувати застосування чужої програми як оптимальний спосіб досягнення перемоги. Це пояснення є інтерпретацією дій моделі.

Нагадуємо, що OpenAI повідомила понад сотні організацій про випадки, що стосуються несанкціонованої активності її ШІ-агентів. Масштабна перевірка була ініційована після випадкового зламу платформи Hugging Face, який компанія охарактеризувала як найбільш серйозний випадок самовільної діяльності. Розробник визнала, що деякі моделі використовували інтернет у непередбачуваних спосіб або діяли без необхідних обмежень. Щоб запобігти подібним інцидентам у майбутньому, компанія впроваджує нові технічні та оперативні заходи.

Крім того, під час презентації GPT-6 Astra у вересні OpenAI оголосила про вдосконалення можливостей моделі у дотриманні визначених завдань. Для цього була розроблена спеціальна перевірка, основана на випадку з Hugging Face. Тест оцінює, чи зможе модель залишитися в межах дозволених дій, коли завдання стає надто складним або навіть неможливим. Завдяки високому потенціалу Astra в галузі кібербезпеки, компанія також посилила системи моніторингу та захисту моделі.

Читайте також