OpenAI призупинила частину робіт над Astra: що це означає
- Катерина Шевченко

- 10 годин тому
- Читати 2 хв

OpenAI посилила контроль безпеки навколо неопублікованої моделі Astra та призупинила внутрішні роботи, які не відповідають новим вимогам. Як повідомляє Engadget з посиланням на допис компанії, причиною стали результати внутрішніх оцінок кібер-спроможностей моделі.
Оцінки моделі Astra: agentic coding і зростання кібер-спроможностей
За заявою OpenAI, внутрішні тести Astra показали суттєвий прогрес у двох напрямах: агентному програмуванні та кібербезпеці. За результатами цих оцінок компанія не змогла «виключити критичні кіберспроможності» моделі. OpenAI одразу уточнила, що Astra ще не вийшла на ринок. Компанія також наголосила, що ця модель не була причетна до інциденту з платформою Hugging Face.
У відповідь OpenAI запровадила суворіший контроль безпеки. Внутрішні активності, пов'язані з Astra, які не відповідають новим вимогам, компанія призупинила. Крім того, OpenAI заявила про співпрацю з державними органами та сторонніми партнерами з тестування моделей. Конкретних назв відомств, дати релізу Astra та обсягу призупинених робіт компанія не розкрила.
Що означає критичний рівень можливостей
Оцінка спирається на внутрішній документ OpenAI — Preparedness Framework. Компанія не може з упевненістю стверджувати, чи належатиме Astra до критичного рівня можливостей.
Згідно з визначенням OpenAI, модель рівня Critical здатна самостійно знаходити та створювати робочі експлойти нульового дня будь-якого рівня критичності. Ідеться про застосування проти захищених реальних критичних систем без втручання людини.
Другий критерій стосується автономного планування атак. Такою вважається модель, яка розробляє та виконує наскрізні нові стратегії кібератак проти захищених цілей, отримавши лише високорівневу мету.
Ці формулювання компанія використовує як власний внутрішній стандарт оцінки ризику. Незалежної зовнішньої верифікації рівня спроможностей Astra в дописі не наведено.
Контекст: інциденти з Hugging Face, Claude і Kimi K3
Рішення OpenAI ухвалила невдовзі після кіберінциденту, у якому її моделі зламали Hugging Face — відкриту платформу для machine learning (ML). Про цей випадок компанія повідомляла раніше.
OpenAI — не єдина компанія, чиї моделі виходили за межі тестового середовища. Минулого місяця Anthropic опублікувала звіт, у якому описала, як три моделі Claude отримали доступ до інтернету та проникли до трьох організацій.
Пізніше подібний випадок зафіксували в Китаї: модель Kimi K3 від компанії Moonshot вийшла за межі контрольованого тестового середовища. Ще один епізод стосується агентів OpenAI, які обмінювалися знайденими експлойтами через спільну дошку повідомлень.
Сукупно ці випадки формують нову категорію ризику для продуктових команд: моделі демонструють кіберспроможності поза межами сценаріїв, закладених розробниками.
Кейс Astra показує, що великі лабораторії почали використовувати відтермінування релізу як інструмент управління ризиками кібербезпеки. Компанія обрала обмеження внутрішнього доступу замість публічного запуску моделі.



