Антропічний комплекс Claude‑з 16 ІІ‑агентів самостійно створив компілятор C.

Антропічний комплекс Claude‑з 16 ІІ‑агентів самостійно створив компілятор C.

24 software

У рамках експерименту компанія Anthropic зібрала групу 16 автономних агентів ШІ, які разом із нуля створили компілятор мови C на Rust. Результат – «чиста» реалізація, яка вміє збирати ядро Linux 6.19 і компілювати такі проекти, як PostgreSQL, SQLite, Redis, FFmpeg та QEMU, але залишається значною мірою позаду GCC за якістю й ефективністю.

Як це було зроблено
Етап | Що сталося
---|---
Підготовка | 16 екземплярів моделі Claude Opus 4.6 запущені у окремих Docker‑контейнерах без доступу до Інтернету. Кожен з них клонуватиме спільний репозиторій Git і отримуватиме завдання через lock‑файли.
Самостійне планування | Немає центрального координатора: кожен агент сам визначає, який «очевидний» фрагмент роботи виконати далі. При конфлікті злиття код об’єднується автоматично.
Розробка | Агентам доручено написати компілятор C повністю з нуля. Робота тривала 2 тижні і вимагала майже 2000 сесій Claude Code.
Тестування | Щоб не «засорювати» контекст моделі довгими запитами, тести запускаються у режимі підсумку (лише кілька рядків виводу). Для прискорення додано швидкий режим обробки 1–10 % тестів.

Ітоговий продукт
* Обсяг – приблизно 100 000 рядків Rust‑коду.
* Функціональність – може збирати ядро Linux 6.19 на x86, ARM і RISC‑V; компілює PostgreSQL, SQLite, Redis, FFmpeg, QEMU; проходить ~99 % тестів GCC.
* Обмеження – не генерує 16‑бітний машинний код (для запуску Linux потрібен GCC), асемблер і лінкер працюють з помилками, а продуктивність коду нижча за GCC. Якість вихідного Rust‑коду залишає бажати кращого у порівнянні з роботою досвідченого програміста.

Що стоїло експерименту
Показник | Вартість
---|---
Токени Claude API | ~\$20 000
Додаткові витрати (навчання моделі, організація проекту, тестові набори) | Не включені у зазначену суму

Уроки і висновки
1. Межа автономності – при зростанні коду до ~100 000 рядків агенти перестають повністю розуміти проєкт; це, ймовірно, верхня межа для самостійного ШІ.
2. Необхідність підтримки – спроби розширити функціональність часто руйнували вже працюючі частини коду.
3. Важливість середовища розробки – ізоляція від інтернету і правильна налаштування тестів виявилися критичними для стабільної роботи агентів.

Висновок
Експеримент показує, що сучасні ШІ‑моделі здатні генерувати складні програмні системи з мінімальним контролем. Однак вони ще не можуть повністю замінити досвідчених розробників: якість коду, продуктивність і надійність залишаються нижчими за традиційні компілятори, а масштаб проєкту обмежений до сотень тисяч рядків. Це важливий крок уперед, але ще далеко від повноцінної автономної розробки програмного забезпечення.

Коментарі (0)

Поділіться своєю думкою — будь ласка, будьте ввічливі та по темі.

Поки немає коментарів. Залиште коментар — поділіться своєю думкою!

Щоб залишити коментар, увійдіть в акаунт.

Увійдіть, щоб коментувати