Claude вже допомагає створювати наступні моделі ШІ: Anthropic розкрила масштаб

Компанія Anthropic показала, наскільки далеко просунулася у використанні власного ШІ для розробки нових моделей. У серпні Claude уже самостійно виконував більшу частину окремих завдань у 26% дослідницьких і розробницьких процесів компанії. Ще понад 90% роботи виконувалися у співпраці людини та ШІ.

Цифри цікаві не лише масштабом. Вони показують, як розробка штучного інтелекту поступово переходить від моделі «людина створює ШІ» до складнішої схеми, де ШІ допомагає створювати наступне покоління ШІ.

Claude дедалі більше бере участь у створенні нових моделей

Anthropic запровадила власний показник — R&D Automation Index. Він оцінює, наскільки різні етапи розробки моделей автоматизовані за допомогою ШІ.

Для оцінювання використовується шкала Epoch AI. На її рівні AL3 ШІ може виконувати великі частини роботи під пильним керівництвом людини. На AL4 система вже здатна виконати більшість завдання від початку до кінця, отримавши лише загальний запит.

Саме до другого рівня належить згаданий показник у 26%.

Для порівняння: ще кілька місяців тому Claude фактично не «очолював» жодної з вимірюваних категорій роботи. За даними Anthropic, у лютому його частка була нижчою за 1%, а до серпня зросла до 26%.

При цьому є важливе уточнення: Claude не працює повністю автономно. Anthropic прямо заявляє, що для жодної з вимірюваних категорій R&D модель ще не досягла рівня, на якому людина повністю випадає з процесу.

Що тут справді незвичайного

Найцікавіше не саме число 26%.

Важливіше те, що ШІ використовується для роботи над технологією, яка сама по собі є ШІ.

Раніше типовий цикл виглядав приблизно так: люди придумують архітектуру, пишуть код, проводять експерименти, аналізують результати й навчають нову модель.

Тепер частину цих етапів можна передати Claude. Людина формулює завдання та контролює процес, а модель виконує значний обсяг технічної роботи.

Це ще не означає, що Claude сам вирішив створити нову версію себе. Але такий підхід скорочує кількість ручної роботи між поколіннями моделей.

Як це працює

Якщо спростити, Claude можна уявити як дуже швидкого дослідницького помічника.

Інженер ставить високорівневе завдання. Модель може написати або змінити код, провести експеримент, проаналізувати результати та підготувати наступні кроки.

У складніших випадках одна система може залучати кілька агентів, які паралельно виконують різні частини роботи.

Anthropic повідомляє, що станом на серпень приблизно 30 тисяч ШІ-агентів одночасно виконували дослідницькі та інженерні завдання на найпоширенішій внутрішній платформі компанії.

Це не 30 тисяч незалежних «версій Claude, які самі себе створюють». Йдеться про агентів, які використовують ШІ для виконання конкретних завдань.

Але Anthropic стежить за діями агентів

Чим більше роботи передають ШІ, тим важливішим стає контроль.

Anthropic заявляє, що дії агентів проходять через системи моніторингу. Онлайн-монітори можуть блокувати небезпечні дії ще до їх виконання, а офлайн-монітори аналізують поведінку після виконання завдань.

У серпні агенти компанії прийняли понад 1 млрд рішень. Приблизно одне рішення з кожних 47 тисяч було заблоковане системами безпеки. Це близько 0,002%.

Однак ця цифра не означає, що 99,998% усіх дій були гарантовано безпечними. Вона показує лише частоту випадків, коли система моніторингу заблокувала рішення.

Що було відомо раніше

Використання ШІ для створення нового ШІ вже не є експериментом лише на рівні теорії.

Anthropic раніше демонструвала, як Claude може виконувати відкриті дослідницькі проєкти, висувати гіпотези, проводити тести та аналізувати результати. У серпні компанія також опублікувала дослідження, де Claude автономно навчав моделі для покращення їхніх результатів у тестах на різні проблеми безпеки ШІ.

Тепер компанія намагається вимірювати вже не окремі експерименти, а масштаб використання ШІ всередині власного процесу розробки.

Чи означає це початок самовдосконалення ШІ?

Не зовсім.

Anthropic називає потенційний сценарій, у якому ШІ повністю автономно створює свого наступника, рекурсивним самовдосконаленням.

За визначенням компанії, це ситуація, коли модель уже не просто допомагає людям розробляти нову систему, а самостійно проєктує та створює наступну версію.

До цього етапу Claude поки не дійшов.

Anthropic прямо зазначає, що повністю автономна робота такого типу ще не відбувається і що рекурсивне самовдосконалення не є гарантованим сценарієм.

Тому правильніше говорити не «ШІ вже створює себе», а про швидке збільшення частки розробки, яку ШІ здатен виконувати самостійно під контролем людей.

Що це може змінити

Якщо така тенденція продовжиться, розробка нових моделей може прискоритися: частину програмування, тестування, аналізу та досліджень виконуватимуть агенти, а люди зосередяться на постановці завдань, перевірці результатів і контролі.

Водночас саме це створює нову проблему. Якщо ШІ дедалі більше бере участь у створенні потужніших моделей, людям стає важливіше розуміти, що саме відбувається всередині цього процесу.

Anthropic тому закликає інші лабораторії регулярно публікувати аналогічні показники. Компанія вважає, що єдина методологія дозволила б порівнювати динаміку розвитку різних ШІ-лабораторій.

Водночас сама Anthropic визнає проблему: спільної методології поки немає, а частину оцінювання проводять за допомогою власних моделей, що створює ризик помилок у такому контролі.

💡 Цікаво знати

Anthropic оцінює не лише те, скільки роботи виконує ШІ, а й те, скільки обчислювальних ресурсів витрачається на безпеку.

Під час одного тижня у липні близько 6% обчислювальних ресурсів для AI R&D компанія спрямувала на роботу з безпеки. Якщо рахувати лише дослідження, які веде ШІ, частка становила вже близько 12%.

❓ Головне питання: чи зможе ШІ одного дня створити свого наступника?

Теоретично саме до такого сценарію може привести подальше збільшення автоматизації. Але нинішні дані Anthropic цього ще не демонструють.

Claude уже виконує значну частину роботи над розвитком ШІ, проте остаточний контроль залишається за людьми. Саме межа між «ШІ допомагає створювати наступну модель» і «ШІ сам створює наступну модель» є ключовою в цій історії.

ШІ поки не замінив розробників — але вже став частиною процесу

Головна зміна полягає не в тому, що Claude нібито навчився створювати себе.

Він цього ще не робить.

Змінилося інше: розробка передових моделей дедалі більше стає спільною роботою людини та ШІ. І якщо частка таких завдань продовжить зростати, саме швидкість, з якою люди зможуть контролювати й перевіряти роботу своїх ШІ-помічників, може стати не менш важливою за швидкість створення нових моделей.

Про це повідомляє NNews із посиланням на Anthropic.

Exit mobile version