ШІ вже допомагає створювати сам себе: участь Claude зросла у 26 разів за п’ять місяців

ШІ вже допомагає створювати сам себе: участь Claude зросла у 26 разів за п’ять місяців

Штучний інтелект дедалі активніше залучають до розробки наступних поколінь моделей: у 26% дослідницьких завдань Anthropic Claude вже виконує більшу частину роботи під наглядом людини. Ще в березні таких завдань було лише близько 1%, тому всього за п’ять місяців їхня частка зросла у 26 разів.

Компанія вперше оприлюднила набір внутрішніх показників, за допомогою яких відстежує темпи автоматизації досліджень і розробок. Крім участі Claude у створенні майбутніх моделей, Anthropic розкрила дані про контроль за ШІ-агентами та обчислювальні ресурси, які витрачає на безпеку.

Для оцінки автоматизації компанія використовує шестирівневу шкалу Epoch AI — від AL0, коли штучний інтелект взагалі не залучений до виконання завдання, до AL5, що означає повністю автономну роботу без участі людини.

Станом на серпень Claude не досяг найвищого рівня AL5 у жодній із категорій, які відстежує Anthropic. Однак у 26% дослідницьких завдань модель уже працює на рівні AL4.

На цьому рівні людина ставить загальне завдання, після чого Claude самостійно виконує більшу частину необхідної роботи. Досліднику залишається переважно контролювати процес та результат.

Зростання виявилося дуже швидким. У березні частка таких завдань становила лише 1%, у квітні — 2%, у травні — 4%, у червні — 10%, у липні — 20%, а в серпні досягла 26%.

Ще показовіша ситуація з меншою автономністю. Понад 90% дослідницьких завдань Anthropic уже перебувають щонайменше на рівні AL3, коли Claude здатний виконувати значну частину роботи у співпраці з людиною.

Anthropic паралельно нарощує систему контролю за такими інструментами. На основній внутрішній платформі компанії працюють близько 30 тисяч ШІ-агентів, дії яких перевіряють автоматизовані системи.

Онлайн-моніторинг охоплює 100% дій агентів ще до їх виконання. Система може заблокувати потенційно небезпечну операцію, зокрема спробу скопіювати ваги моделей із внутрішньої інфраструктури.

Протягом серпня такі системи перевірили понад мільярд рішень агентів. Заблоковано було приблизно 0,002% дій — близько однієї на кожні 47 тисяч.

Додатково офлайн-системи щотижня аналізують приблизно 100 тисяч записів роботи агентів. Після автоматичного відбору близько 50 найважливіших випадків передають фахівцям для ручної перевірки.

Anthropic також уперше розкрила частину даних про ресурси, які спрямовує на безпеку. Протягом тижня з 13 до 20 липня приблизно 6% обчислень у дослідницьких і розробницьких процесах припадало на завдання безпеки.

Якщо використовувати ширше визначення відповідних робіт, частка становила близько 12%. У компанії наголошують, що ці оцінки навмисно консервативні та не охоплюють усіх ресурсів, які так чи інакше допомагають робити моделі безпечнішими.

Anthropic пропонує іншим розробникам передових моделей публікувати аналогічні показники. Компанія вважає, що спільна методологія та незалежна перевірка дозволять відстежувати, наскільки швидко ШІ перебирає на себе роботу зі створення нових систем і наскільки ефективно розробники контролюють цей процес.



🌟 Читайте «Експерт» у своєму смартфоні — додайте нас в Google Discover

Автор player

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *