Дослідники Anthropic показали систему, у якій ШІ сам шукає способи покращити іншу модель

Сьогодні,   08:48    106

Дослідники Anthropic продемонстрували експериментальну систему, у якій штучний інтелект виконує значну частину роботи дослідника й самостійно шукає методи покращення іншої моделі. Робота не означає появу повністю автономного ШІ, який безконтрольно переписує себе, але показує, як частину циклу досліджень уже можна автоматизувати.

Електронні компоненти та обчислювальна система

У випробуванні автоматизованій системі дали десять тестів, кожен із яких перевіряв конкретний тип небажаної поведінки моделі. Для кожної проблеми система самостійно переглядала доступну літературу, пропонувала метод виправлення, проводила короткий цикл навчання та оцінювала результат.

Останні новини:  Google хоче домовитися з Голлівудом про використання відомих фільмів і персонажів для розвитку ШІ

Кожна спроба навчання тривала приблизно 30 хвилин. Після отримання нового результату автоматизований дослідник міг змінити підхід і повторити цикл. У підсумку система змогла покращити показники на всіх десяти тестах без помітного погіршення загальної продуктивності моделі.

Авторами роботи керував дослідник програми Anthropic Fellows Чень Юех-Хань. Мета проєкту полягала в тому, щоб перевірити, чи можуть автоматизовані дослідники систематично знаходити способи зменшувати проблеми узгодженості поведінки моделей із заданими правилами.

Результати є раннім експериментом, а не доказом необмеженого самовдосконалення. Однак вони показують, що ШІ вже може автоматизувати частину процесу, який раніше вимагав постійної участі людини: пошук ідей, проведення експериментів, навчання моделей та аналіз результатів.

Останні новини:  NVIDIA наблизилася до купівлі Hugging Face приблизно за $13 млрд

https://techcrunch.com/2026/08/28/an-anthropic-researcher-just-gave-us-a-peek-at-self-improving-ai/