Никто не возвращается проверить
В марте 2025 года Дарио Амодеи заявил Совету по международным отношениям, что ИИ будет писать 90% кода в течение трёх-шести месяцев, а практически весь код, за двенадцать. Этот двенадцатимесячный срок истёк в марте. Почти никто не вернулся проверить.
Таков странный этикет прогнозов об ИИ. Предсказания звучат громко, с датами и абсолютной уверенностью, а затем срок наступает, и все уже переключились на следующее. Никакого табло результатов нет. Поэтому я его создал.
В феврале 2025 года я заложил агентные сценарии в Whizi, исходя из того, что Альтман прав насчёт 2025 года. Я закрыл проект шесть недель спустя, посчитав, во сколько обходится один многошаговый запуск агента по сравнению с плоской месячной подпиской. Шесть недель собственного роадмапа, потраченные на чужой прогноз. Я собрал каждое датированное предсказание 2024 и 2025 годов, у которого есть первоисточник и уже истёкший срок. В итоговый список попали восемнадцать.
Правило оценки, чтобы было с чем спорить: предсказание оценивается по тому, что обещали его собственные слова, в его собственный срок. Если вы сказали 90% к сентябрю, а сентябрь принёс 30%, «ну, когда-нибудь» это не оценка. Это отговорка.
Табло результатов
| Кто и когда | Предсказание | Что произошло | Оценка |
|---|---|---|---|
| Сэм Альтман, январь 2025 | ИИ-агенты «вольются в штат» в 2025 году | 95% корпоративных пилотов не показали влияния на прибыль; лучший агент завершил 30,3% офисных задач | C- |
| Марк Бениофф, сентябрь 2024 | Миллиард агентов Agentforce к концу 2025 | Около 29 000 сделок и $1B годового регулярного дохода | F |
| Klarna, февраль 2024 | ИИ-ассистент выполняет работу 700 сотрудников | С мая 2025 нанимает людей обратно из-за низкого качества | C |
| Дарио Амодеи, март 2025 | 90% кода за три-шесть месяцев | 25%-41% по отрасли в целом, 75% у Google к середине 2026 | C+ |
| Дарио Амодеи, март 2025 | Практически весь код за двенадцать месяцев | Даже близко нет | F |
| Эрик Шмидт, апрель 2025 | Подавляющее большинство программистов заменят за год | Программисты всё ещё работают; junior-позиции сократились примерно на 16% | F |
| Марк Цукерберг, январь 2025 | ИИ-инженер среднего уровня, лидирующий ассистент на миллиард пользователей и Llama как топ-модель, всё в 2025 | Ничего из трёх не сбылось; вместо этого рекордные зарплаты живым инженерам | F |
| Илон Маск, апрель 2024 | ИИ умнее любого человека к концу 2025 | Grok 4 набрал 25,4% на Humanity's Last Exam | F |
| Мира Мурати, июнь 2024 | Интеллект уровня PhD «для отдельных задач» примерно за 18 месяцев | Официальное золото на Международной математической олимпиаде 2025 | B- |
| Гэри Маркус, январь 2025 | 25 датированных предсказаний, здесь оценены четыре | Все четыре верны, и ни одного из успехов года в списке нет | A- |
Штат, который так и не заступил на работу
Сэм Альтман, январь 2025: «Мы верим, что в 2025 году мы можем увидеть, как первые ИИ-агенты "вольются в штат" и заметно изменят результаты работы компаний».
Проект NANDA от MIT в августе 2025 обнаружил, что 95% корпоративных пилотов генеративного ИИ не дали измеримого влияния на прибыль. Университет Карнеги-Меллон укомплектовал фиктивную компанию исключительно ИИ-агентами и замерил, сколько офисной работы они выполнили: лучшая модель завершила 30,3% задач. Сотрудник с результатом 30% не вливается в штат. Он не проходит испытательный срок.
Одно исключение спасает эту оценку от F: внутри софтверных компаний агенты для кода действительно изменили результаты работы. Оценка: C-.
Марк Бениофф, сентябрь 2024: «Наше видение смелое: наделить возможностями миллиард агентов с помощью Agentforce к концу 2025 года».
Salesforce отчиталась о примерно 29 000 совокупных сделок Agentforce к началу 2026 года и превысила $1B годового регулярного дохода. Реальный бизнес, и примерно в 34 000 раз меньше обещанного, если считать сделки, а не агентов. Мой любимый штрих: теперь Salesforce отчитывается в «единицах агентной работы» (3,8 миллиарда штук) вместо количества агентов. Не можешь попасть в цифру, смени единицу измерения. Оценка: F.
Klarna, февраль 2024: её ИИ-ассистент «выполняет работу, эквивалентную 700 штатным сотрудникам».
Затем в мае 2025 года гендиректор Себастьян Семятковски развернул курс и начал нанимать людей обратно: «Мы слишком сильно сосредоточились на эффективности и затратах. Результатом стало снижение качества». ИИ оставили на рутинных обращениях. Люди вернулись на всё, что имело значение. Плюс в карму за то, что провёл эксперимент публично и признал результат. Оценка: C.
Код, который реально был написан
90% Амодеи. Направление было верным, а знаменатель нет. Google утверждает, что 75% нового кода компании сгенерировано ИИ по состоянию на середину 2026, против 25% в конце 2024, хотя сюда засчитывается каждое принятое автодополнение, а люди всё равно проверяют код перед деплоем. Оценки по отрасли в целом в начале 2026 года группировались вокруг 25%-41%.
Итак: 90% всего кода за шесть месяцев, нет. Практически весь код за двенадцать, даже близко нет. Историческая смена в том, как пишется код, безусловно да. Предсказание описало настоящую революцию и ошиблось во всех цифрах. Оценка: C+ за 90%, F за «практически весь».
Эрик Шмидт, апрель 2025: «в течение следующего года подавляющее большинство программистов заменят ИИ-программисты».
Год истёк. Программисты почти везде остаются на своих местах. Реальный урон рынку труда уже, но и жёстче, чем в предсказании: данные Стэнфорда и ADP по зарплатам показывают, что занятость среди людей 22-25 лет на самых уязвимых для ИИ должностях упала примерно на 16% с конца 2022 года и продолжает сокращаться. Удар пришёлся на junior-уровень, а подавляющее большинство сохранило работу и получило лицензии на Copilot. Оценка: F.
И цифра, которую вообще никто не предсказал: Cursor вырос с $100M до $4B годового регулярного дохода примерно за семнадцать месяцев, а 14 августа SpaceX закрыла сделку по покупке компании за $60B, крупнейшее поглощение стартапа за всю историю. Ни в одном списке предсказаний 2024 года, который я проверил, нет пункта «редактор кода станет крупнейшим выходом стартапа в истории».
Очень дорогой год для Meta
Марк Цукерберг, январь 2025, в подкасте Джо Рогана: «Вероятно, в 2025 году у нас в Meta... появится ИИ, который сможет по сути быть инженером среднего уровня, который есть у вас в компании и который умеет писать код». Спустя недели на звонке по итогам квартала он добавил ещё два прогноза на 2025: Meta AI как ведущего ассистента с миллиардом пользователей и Llama как самую продвинутую и широко используемую модель.
Ничего из трёх не сбылось. Llama 4 вышла без особого впечатления, пока Gemini 3 забрала корону лидера в ноябре 2025 года. А Meta провела год, делая противоположную ставку кошельком: $14.3B за половину Scale AI, зарплатные пакеты исследователям, о которых сообщалось в диапазоне от $100M до $450M, затем сокращение 600 человек в лаборатории суперинтеллекта в октябре и примерно 8 000 увольнений в мае 2026.
Meta предсказала ИИ, который пишет код как инженер среднего уровня, а вместо этого потратила восемнадцать месяцев на установку мирового рекорда по рыночной цене живых инженеров. Оценка: F.
Илон Маск, апрель 2024: ИИ «умнее любого отдельного человека, вероятно, примерно к концу следующего года».
К концу 2025 года флагманской моделью xAI был Grok 4, запущенный как «самый умный ИИ в мире», набравший 25,4% на бенчмарке, буквально названном Humanity's Last Exam. Заявление не пережило столкновения с экзаменом. Оценка: F.
Мира Мурати, июнь 2024: интеллект уровня PhD «для отдельных задач» примерно за восемнадцать месяцев.
Для математики это, в сущности, сбылось: Deep Think от Google DeepMind получил официально сертифицированное золото на Международной математической олимпиаде 2025 года, на годы раньше большинства прогнозов 2024 года. Оговорка, которую она использовала, «для отдельных задач», делает всю тяжёлую работу, и это именно та оговорка, от которой отказались её более громкие коллеги. Осторожная версия сбылась. Безоговорочная, поставленная в августе 2025 года как позиционирование GPT-5 «уровня PhD», провалилась настолько, что Альтман признал: OpenAI «полностью облажалась» с запуском. Оценка: B-.
Табель скептика
Гэри Маркус опубликовал 25 датированных предсказаний 1 января 2025 года. Индустрия обычно закатывает на него глаза. Оцениваем его поддающиеся оценке утверждения:
- «Мы не увидим общего искусственного интеллекта в этом году». Верно.
- Агенты будут «бесконечно перехайплены на протяжении 2025 года, но далеки от надёжности». Верно, см. весь первый раздел.
- «Прибыль от моделей ИИ по-прежнему будет скромной или нулевой». Выручка взлетела, но он говорил про прибыль, а лаборатории всё ещё сжигают деньги. Верно по букве.
- Возможно, не будет консенсусного скачка «уровня GPT-5» в 2025 году. GPT-5 вышла, скачка не случилось. Верно по духу.
Оценка: A-. Минус за то, чего в списке нет: ничего в нём не предсказало категорию инструментов для кода на $4B, золото IMO или агентов, ставших по-настоящему полезными в единственной сфере, где результат можно проверить. Лучший прогнозист 2025 года верно назвал каждый провал и не угадал ни одного успеха.
И неприятный факт второго порядка: правота не принесла ему практически ничего. Инвесторы, поставившие против всей его картины мира, это как раз те, кто оценил Cursor в $60B. Точность прогноза и финансовая доходность идут по разным табло, и растёт только одно из них.
Прогнозы о возможностях сбылись. Прогнозы о внедрении нет
Разложите 18 предсказаний на две стопки, и шум исчезнет.
Предсказания о возможностях, о том, что смогут делать модели, состарились хорошо и порой сбывались раньше срока. Длина задач, которые могут выполнить агенты, удваивается примерно каждые четыре-семь месяцев, по данным METR, и тренд держится.
Предсказания о внедрении, о том, что реально позволят делать ИИ организации, провалились почти все до единого. Агенты в штате, платформы на миллиард агентов, заменённые программисты, ИИ-сотрудники, всё это разбилось об одну и ту же стену: планки качества, ответственность, стоимость интеграции и упрямый факт, что система, выполняющая 30% задач, это демо, а не наём.
Альтман сказал, что агенты вольются в штат. Они влились в IDE, потому что IDE это единственное рабочее место, где неверный ответ ловит компилятор, а не клиент.
Так что вот правило принятия решений, которым я пользуюсь сейчас, поставив на кон собственные деньги: услышав прогноз о возможностях, воспринимайте его всерьёз, даже самый безумный, потому что тренды продолжают побеждать. Услышав прогноз о внедрении с конкретной датой, удвойте срок, а затем посмотрите, что продаёт тот, кто это говорит. По этому же правилу я выбираю, за какую модель платить: бенчмарк это заявление о возможностях, рабочий процесс это заявление о внедрении.
Каждый квартал отныне я буду оценивать то, чей срок истёк, а следующий выпуск откроется моими собственными датированными предсказаниями, чтобы вы могли прогнать меня через то же правило. Оценивать бесплатно. Быть оценённым, вот цена.
- Оценивайте предсказание по его собственным словам и в его собственный срок; «когда-нибудь» это не оценка
- Воспринимайте прогнозы о возможностях всерьёз, даже самые безумные; тренды продолжают побеждать
- Удваивайте любой срок внедрения, у которого есть конкретная дата
- Смотрите, что продаёт тот, кто делает предсказание
- Записывайте свои собственные прогнозы с датами, чтобы кто-то мог потом оценить вас
Частые вопросы
Был ли прав Дарио Амодеи насчёт того, что ИИ будет писать 90% кода?
Не в свой срок. Он говорил про 90% в течение трёх-шести месяцев с марта 2025 года и практически весь код за двенадцать. Оценки по отрасли в начале 2026 года группировались вокруг 25%-41%, при этом у Google 75% нового кода к середине 2026, если считать каждое принятое автодополнение. Направление было верным, а цифры нет.
Вошли ли ИИ-агенты в штат в 2025 году?
Не за пределами разработки ПО. Проект NANDA от MIT обнаружил, что 95% корпоративных пилотов генеративного ИИ не дали измеримого влияния на прибыль, а тест агентной компании Карнеги-Меллон показал, что лучшая модель завершила 30,3% офисных задач. Агенты для кода внутри софтверных компаний были единственным настоящим исключением.
Кто точнее всех предсказал 2025 год в сфере ИИ?
Гэри Маркус, скептик, если судить по оценённым здесь утверждениям: никакого AGI, агенты перехайплены, но ненадёжны, прибыль по-прежнему скромная, консенсусного скачка GPT-5 нет. Все четыре подтвердились. Его список также пропустил каждый успех года, от категории инструментов для кода на $4B до золота IMO.