Чья нейронка умнее?

—

от автора

Всем привет, я фаундер агрегатора нейросетей BotHub, и мне вдруг захотелось поделиться своими мыслями на тему специализаций в разных моделей искусственного интеллекта.

Все текстовые нейросети строятся по одной технологии — трансформер, которая открыта и общедоступна всем, которая кстати была разработана в недрах корпорации Google. Разница лишь кроется в том как их обучают.

Нет одной идеальной нейросети. Самая лучшая нейронка для программирования и кстати самая популярная в BotHub — это Claude от Антропик, упрощённо говоря, её специально обучают сначала простой арифметике, потом дают книги посложнее вроде Дональда Кнута, в этой компании реально работает 1000 сенйоров разработчиков которые обучают её программированию.

Однако если вам нужна нейронка с энциклопедическими знаниями, то Claude тут проигрывает Gemini, и это легко проверить по промтам вроде «из какой песни эта строчка», клод не может ответить, тогда как Gemini легко справляется с такими задачами на широту знаний.

Если вам нужен контент NSFW (18+), например создать сценарий для ролевой игры со своей женой, то ни Claude ни Gemini вам не помогут, но вот Grok от Илона Маска просто обожает такие задачи.

В последнее время многие говорят что качество китайских моделей выросло, Deepseek\Kimi\Qwen. И да и нет. Основной плюс китайского ИИ его дешевизна, и достигается он в основном на том, что процессом их обучения занимаются западные ИИ (GPT, Gemini, Claude) т.е. они очень здорово на этом экономят, дешевле взять ИИ, чем использовать тысячи реальных людей. Поэтому прогресс в китайском ИИ напрямую будет зависеть от прогресса западных ИИ. На мой взгляд, самое большое отставание китайского ИИ состоит в механизме размышлений (Reasoning) — да нейронки можно обучить чему угодно, в том числе тому как думает человек. И вот в этом у них пока не получается. К примеру недавно я вбил строчку из одной известной песни «Сектор Газа», топовая Кими К3 сидела и размышляла в таком стиле «Может это Руки вверх? нет. Может это Алла Пугачёва? Нет. Может это Басков? нет Может это из Тик-тока? нет» Вобщем долго думала, но как-то примитивно, хотя по тестам она идёт типа вровень с Клодом.

Однако я бы хотел отметить что компания создатель Тик-Тока Bytedance выпустила очень крутую нейронку для генерации видео, секрет кроется в том, что у них очень много видео-данных для обучения. Тут также хорошо работает избитая фраза «данные — это новая нефть».

А что по поводу российских нейросетей? Я тут был на одной конференции и там какой-то большой член сказал, что российские математики и программисты самые умные во всём мире и они точно скоро сделают ИИ который превзойдёт всех конкурентов. Насчёт математиков и программистов я с ним спорить не буду, однако дядя не учёл один из ключевых факторов успеха в ИИ — это наличии мощного железа, те самые кластеры на сотни тысяч видеокарт Nvidia, AMD, Huawei которые используются как для обучения так и для работы железных мозгов. И у вот их у нас почти что нет. В США только за 2026 инвестируют 600-700 млрд долларов в железо для ИИ. Для сравнения в типичном кластере в США — 20 тыс новых видео карт H100 (иногда доходит 100 тыс), а у Яндекса — всего лишь 1500 старых видео карт A100. Поэтому в недавнем интервью их представитель заявил, что Алиса часть запросов будут обрабатывать на бесплатных китайских ИИ.

ссылка на оригинал статьи https://habr.com/ru/articles/1087042/