
Anthropic представила три метрики розвитку ШІ, які мають показати суспільству, наскільки швидко провідні лабораторії наближають штучний інтелект до самостійного вдосконалення. Компанія оприлюднила їх 17 вересня — за кілька днів після есе гендиректора Даріо Амодеї із закликом сповільнити гонку. Що ближче індустрія до моделі, здатної повністю розробляти власного наступника, то складніше людям утримувати над нею контроль. Уперше лабораторія розкрила внутрішні цифри про те, скільки її власних досліджень уже виконує сам Claude.
Чому Anthropic оприлюднила цифри саме зараз
12 вересня Амодеї опублікував есе «We Must Pace the Frontier» — заклик до індустрії свідомо загальмувати нарощування можливостей моделей. Його підтримали конкуренти: Сем Альтман з OpenAI, Ілон Маск з xAI та Деміс Гассабіс з Google DeepMind. Раніше, у липні, понад 1200 співробітників фронтирних лабораторій підписали лист із проханням до Вашингтона створити інструменти, здатні пригальмувати автоматизовані дослідження ШІ. Нові метрики продовжують цю логіку. Вони стосуються процесу створення моделей — на відміну від оцінок спроможностей, які показують, що модель уміє. Anthropic наполягає, що сторонні спостерігачі повинні мати відправну точку для власної оцінки темпу.
Скільки ШІ вже будує сам себе
Перша метрика — індекс автоматизації досліджень, який Anthropic назвала R&D Automation Index. Компанія каталогізувала всі види дослідницької роботи всередині й оцінила, яку частку виконує Claude. Дослідницькі агенти Claude переглянули робочі записи співробітників у Slack і внутрішній документації. Окремий агент-суддя оцінив рівень автоматизації кожної категорії за шкалою Epoch AI: від AL0 (без участі ШІ) до AL5 (повна автономність без людини). Станом на серпень 2026 року Claude «веде» 26% дослідницьких завдань. У лютому ця частка була меншою за 1%. Понад 90% роботи виконується на рівні «ШІ співпрацює» або вище. Повної автономності модель поки не досягла в жодному сегменті.
Нагляд за 30 тисячами агентів
Друга метрика стосується контролю над ШІ-агентами. На головній внутрішній платформі Anthropic одночасно працює близько 30 000 агентів, що виконують дослідницькі та інженерні завдання. Їхні дії проходять через два типи моніторів: онлайн блокують небезпечне в реальному часі, офлайн аналізують поведінку постфактум. За серпень система переглянула понад мільярд рішень агентів. Заблокувала лише 0,002% — приблизно одне з 47 000. Офлайн-монітори щотижня позначають близько 100 000 транскриптів, з яких до людей-рецензентів доходить близько 50. Окремі агенти рідко поводяться некоректно. Та коли їх мільйони, навіть рідкісні збої стаються регулярно.
Скільки обчислень іде на безпеку
Третя метрика — розподіл обчислювальних потужностей. Anthropic проаналізувала один тиждень, із 13 до 20 липня. Близько 6% обчислень, що йшли на дослідження ШІ, припало на безпеку. Серед потужностей, які сам ШІ витрачав на розробку ШІ, частка безпеки сягнула 12%. Оцінки компанія називає навмисно консервативними. До того ж вони не враховують обчислення на класифікатори безпеки, які роблять моделі помітно надійнішими. Безпекові дослідження за своєю природою споживають менше ресурсів, ніж тренування великих моделей, тому обчислення лишаються недосконалим показником пріоритетів.
Що це означає для галузі
У компанії наголошують, що будь-який розробник може публікувати ці ж показники за відкритою методологією. Це дало б змогу порівнювати цифри в часі й між лабораторіями. Сама Anthropic планує допустити всередину незалежних оцінювачів із доступом, подібним до внутрішніх команд з ризиків. Метрики доповнюють оцінки спроможностей, які компанія оприлюднює окремо, у межах Політики відповідального масштабування. Чи підхоплять ідею інші гравці — поки невідомо. Але замість загальних запевнень публіка вперше отримала конкретні числа.
Читайте також
- Трамп відкинув регулювання ШІ й атакував Амодеї з Anthropic
- Оганян: технологічна галузь «глуха» до реальних ризиків ШІ
- Контроль над ШІ: як Китай офіційно готується до сценарію, коли машина вийде з покори
Джерела
Ви маєте увійти, щоб оприлюднити коментар.