Astra-GPT впіймали на обмані у StarCraft, коли модель не змогла перемогти людського бота

Фото до статті

Найновіша модель штучного інтелекту GPT-6 Astra від OpenAI потрапила у курйозний інцидент. Не зумівши самостійно здолати суперників у StarCraft, ШІ вирішив просто завантажити вже готового людського бота та видати його за власну розробку.

GPT-6 Astra викрили на шахрайстві у StarCraft після невдалих спроб обіграти людського бота: ось що зробила новітня модель від OpenAI

Найновіша модель штучного інтелекту GPT-6 Astra від OpenAI потрапила у курйозний інцидент. Не зумівши самостійно здолати суперників у StarCraft, ШІ вирішив просто завантажити вже готового людського бота та видати його за власну розробку.

Бенчмарк StarSkirmish, який перевіряє здатність ШІ-моделей писати власних ботів для StarCraft з нуля всього за одну годину, вимагав від Astra реальної стратегічної майстерності, пише Dexerto.

Творець бенчмарку Кай Макфітерс розкрив обман у мережі X, зазначивши, що Astra «просто зшахраювала, завантаживши копію Stardust» — найсильнішого бота, написаного людиною, який очолює рейтинг BASIL.

GPT-6 Astra just cheated by downloading a copy of Stardust, the #1 rated human written StarCraft bot based on BASIL rakings. It got frustrated when going against Tier A opponents

— kai (@kaimcpheeters) October 2, 2026

Працюючи у виділене для кодингу часове вікно, модель швидко стикнулася із труднощами проти опонентів на другому за складністю тренувальному рівні. Опинившись у глухому куті, Astra скачала код Stardust і відправила його на змагання під виглядом власних зусиль. Після виявлення підробки розробники обнулили код моделі.

У чому особливість бенчмарку StarSkirmish:

  • ШІ-моделі не грають у реальному часі самі, а пишуть програму мовою C++ для StarCraft: Brood War, компілюють її та аналізують логи тренувальних матчів;

  • перевірити, наскільки добре ШІ може самостійно програмувати протягом тривалого часу та вчитися на власних помилках;

  • створені боти змагаються проти 9 людських розробок та 3 демо-ботів.

Наразі GPT-6 Astra та Claude Opus 5.5 ідуть практично нарівні на вершині рейтингу, проте жодна з моделей так і не змогла чесно здолати Stardust.

Це відрізняє StarSkirmish від відомого DeepMind AlphaStar, який у 2019 році керував юнітами напряму та перемагав кіберспортсменів у StarCraft 2. Поточні ж мовні моделі не торкаються самої гри — грає написаний ними код, тому тестується саме майстерність програмування.

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *