Лондонский стартап Mantic 18 сентября объявил о привлечении $25 млн. Поводом для громкой формулировки о «сверхчеловеческом прогнозировании» стал летний турнир Metaculus: система компании точнее оценивала будущие политические, экономические и культурные события, чем все 676 участников-людей.

Результат выглядит сильнее обычного теста языковой модели, потому что прогнозы делались до наступления событий и оценивались по тому, насколько хорошо назначенные вероятности совпали с реальностью. Но абсолютной победы не было: Mantic обошла людей, однако уступила одному другому боту — системе под названием laertes.

Как Mantic учит модель работать с неопределённостью

Mantic не заявляет о создании собственной универсальной модели с нуля. По словам генерального директора Тоби Шевлейна, команда берёт передовые модели других лабораторий и специализирует их для прогнозирования. Система проверяется на исторических данных, получает оценку за точность, а затем дорабатывается.

Главная задача — не назвать одно будущее, а присвоить исходам вероятности. Такой подход позволяет отличить осторожную оценку от уверенного, но случайно удачного ответа. В турнире Metaculus участники прогнозировали события из политики, экономики и культуры, а результаты пересчитывались после того, как становился известен реальный исход.

Шевлейн привёл Reuters два примера. Mantic не поддержала мнение большинства о том, что песня Шакиры «Dai Dai» не обгонит «Waka Waka» в Billboard Hot 100; консенсус оказался ошибочным. В другом вопросе система дала Абелардо де ла Эсприэлье около 40% шансов на победу на президентских выборах в Колумбии против примерно 30% у общего прогноза. Кандидат в итоге победил.

Кто вложил $25 млн и зачем

Раунд возглавила Radical Ventures. В нём также участвовали венчурный фонд Microsoft M12, Balderton Capital, Thinking Machines Lab, DRW, FT Ventures, Episode 1 Ventures и инвестор Чарли Сонгхёрст. Оценку стартапа стороны не раскрыли.

Mantic основали Шевлейн и Бен Дэй в 2024 году. До этого Шевлейн работал исследователем в Google DeepMind и, по его словам, столкнулся с потребностью лучше оценивать мировые события, способные повлиять на развитие ИИ.

Компания планирует тратить деньги на исследования, разработку продукта, продажи и найм. Основатель утверждает, что некоторые крупные хедж-фонды уже используют Mantic в торговле на финансовых рынках. Reuters также приводит слова партнёра Radical Ventures Аарона Розенберга о спросе со стороны компаний и государственных организаций. Названия клиентов Mantic не раскрывает, поэтому независимо проверить масштаб внедрения пока нельзя.

Почему один турнир ещё не доказывает превосходство

Соревнование Metaculus — полезная проверка, но его результат не означает, что система лучше людей предсказывает любое событие. Набор вопросов, правила подсчёта, доступные данные и срок прогноза влияют на итог. Люди могут ошибаться из-за группового мнения, но модель тоже наследует ограничения исходных данных и базовых моделей.

Есть и риск подгонки. Если разработчик много раз тестирует систему на похожих исторических задачах, высокие результаты могут хуже переноситься на редкие кризисы и события без аналогов. Для серьёзных решений важны повторные независимые турниры, открытая методика и сравнение с сильными командами профессиональных прогнозистов, а не только с общей таблицей участников.

Главная оговорка: Mantic обошла всех 676 участников-людей, но заняла не первое место среди всех систем — один бот оказался точнее.

Финансовый рынок станет особенно жёсткой проверкой. Преимущество быстро исчезает, если конкуренты находят тот же сигнал, а неверная уверенность превращается в прямой убыток. Пока Mantic не называет клиентов и не публикует результаты реальных внедрений, заявления об экономической ценности остаются словами компании и инвестора.

Вывод

Mantic показала практичный способ применять ИИ вне чатов: не выдавать один уверенный ответ, а оценивать несколько возможных исходов и регулярно сверять вероятности с реальностью. Победа над 676 людьми делает результат заметным, а $25 млн дают стартапу возможность проверить его на задачах клиентов.

Главный следующий рубеж — воспроизводимость. Если Mantic снова обойдёт сильных человеческих прогнозистов и другие системы на новых вопросах, разговор о «сверхчеловеческом» уровне получит больше оснований. Пока точнее говорить о сильном результате в одном турнире, где один бот всё же оказался лучше.

Источники

  1. Mantic — прямое заявление о раунде, участниках и результате системы
  2. Reuters — Mantic привлекла $25 млн после турнира прогнозистов
  3. Metaculus — официальный турнир Metaculus Cup Summer 2026