Компанія Anthropic заявила, що її чат-бот Claude уже виконує більшу частину роботи у 26% внутрішніх досліджень і розробок у сфері штучного інтелекту. Модель здатна виконати більшу частину завдання від початку до кінця, отримуючи команди високого рівня, тоді як людина контролює процес.
Як ШІ створюють ШІ: 3 показники
Наразі ШІ виконує велику частину роботи під пильним наглядом людини у понад 90% досліджень, включно з цими 26%. Водночас Anthropic наголошує, що Claude не працює повністю автономно в жодній із виміряних підгруп.
Для оцінювання рівня автоматизації компанія використала показник частки досліджень і розробок. Цифру отримали за першим із трьох запропонованих показників: це експерименти в галузі ШІ, які веде сам ШІ. Компанія поєднала індекс частки роботи, яку виконує Claude, зі шкалою автоматизації від Epoch AI і побудувала діаграму рівня автоматизації з серпня 2025 року. За її словами, таку методику може відтворити будь-який розробник передових моделей на власних даних із перевіркою третьою стороною.
Інші два показники стосуються контролю за агентами ШІ й обчислювальних ресурсів. Перший охоплює частку відстежуваної активності агентів, час на її перевірку та частоту позначення поведінки як підозрілої. Другий вимірює, скільки обчислень іде на дослідження й розробки ШІ.
Anthropic пов’язує публікацію показників із необхідністю зробити розвиток ШІ більш прозорим. За задумом компанії, такі дані можуть допомогти помітити ситуацію, коли автоматизація досліджень починає розвиватися швидше, ніж механізми контролю.
