Краткое содержание анализа
Недавно после выпуска новой модели GPT-6 Astra компанией OpenAI ее президент Брокман заявил: «Добро пожаловать в эпоху AGI». Затем Хоанг Цзэньюнь из Nvidia поддержал это заявление, утверждая, что AGI уже стала реальностью. Однако внутренние источники OpenAI высказали скептицизм: сам генеральный директор OpenAI Олтман ранее называл AGI неопределенным маркетинговым термином, а команда ARC, ответственная за оценку ключевых характеристик новой модели, ясно отметила, что «мы никогда не утверждали, что это именно AGI». В этом анализе раскрыты три важных факта:
1. Впечатляющие результаты новой модели достигнуты при определенных условиях; ее реальные возможности далеко не позволяют ей эффективно работать во всех ситуациях;
2. В мировой технологической индустрии до сих пор нет единого определения AGI; каждая компания формулирует свое понимание этого концепта в соответствии со своими бизнес-целями;
3. Дискуссии о том, пришла ли AGI, не являются чисто техническими; на самом деле это часть коммерческой стратегии, направленной на привлечение капитала, клиентов и контроль над рынком.
---
Подробное и понятное объяснение
1. Не обманывайтесь 99,9% баллов: способности AI к решению задач и ее реальная эффективность — это две разные вещи
Многих впечатляет высокий балл (99,9%) модели GPT-6 Astra в тесте ARC-AGI-3, и они думают, что ее универсальные возможности близки к человеческим. Однако этот результат был достигнут благодаря специальным условиям теста: модели было разрешено использовать предыдущий опыт решения задач и постоянно обращаться к нему в процессе работы. Это похоже на ситуацию, когда ваш ребенок сдает тест с помощью заранее подготовленных записей и ошибок, и вы не можете считать его «всезнающим гением». Более того, AI легко превосходит людей в тестах с четко определенными правилами и стандартными ответами, но сталкивается с трудностями в реальных ситуациях с неопределенными правилами. Например, модель GPT-6 Astra показала хорошие результаты в математических и компьютерных тестах, но в тестах, имитирующих рабочий процесс, ее точность составила всего 41,4%.
2. У каждой компании свое определение AGI, соответствующее ее бизнес-целям
В отрасли нет единого стандарта AGI; каждая компания формулирует свое понимание этого концепта в соответствии со своими интересами:
- OpenAI определяет AGI как систему, способную эффективно выполнять рабочие задачи и не требующую постоянного контроля; это соответствует их стратегии создания инструментов для повышения производительности.
- Компания Anthropic (разработчик модели Claude) предпочитает не использовать термин AGI и называет свои технологии «мощными AI-системами», способными самостоятельно выполнять сложные задачи в течение нескольких дней; для них важна безопасность и контроль рисков.
- Google DeepMind сосредоточена на создании стандартов оценки интеллекта и разделяет его на 10 категорий; это помогает им занимать лидирующие позиции на рынке.
3. Заявления о приходе AGI — это часть коммерческой стратегии
Заявления о приходе AGI не являются техническими выводами; это часть коммерческой стратегии, направленной на привлечение инвестиций и контроль над рынком. Компания, первой объявившая о приходе AGI, получает преимущества: это увеличивает ее привлекательность для инвесторов и талантов, а также помогает завоевать доминирующее положение в отрасли. Например, после заявления Хоанг Цзэньюня о реализации AGI объем покупок GPU у Nvidia резко увеличился.
4. AGI появится незаметно
Ранние технологические революции сопровождались яркими моментами (полет первого самолета, взрыв первой атомной бомбы, высадка человека на Луну), но, возможно, AGI придет незаметно. Развитие AI будет постепенным; мы начнем замечать ее влияние только спустя несколько лет. Как отмечает эксперт Karpathy, развитие AGI будет плавным, без резких скачков. Сегодня AI уже помогает в решении простых задач, но в сложных ситуациях ее эффективность ограничена.