Всем привет, я фаундер агрегатора нейросетей BotHub, и мне вдруг захотелось поделиться своими мыслями на тему специализаций в разных моделей искусственного интеллекта.
Все текстовые нейросети строятся по одной технологии – трансформер, которая открыта и общедоступна всем, которая кстати была разработана в недрах корпорации Google. Разница лишь кроется в том как их обучают.
Нет одной идеальной нейросети. Самая лучшая нейронка для программирования и кстати самая популярная в BotHub – это Claude от Антропик, упрощённо говоря, её специально обучают сначала простой арифметике, потом дают книги посложнее вроде Дональда Кнута, в этой компании реально работает 1000 сенйоров разработчиков которые обучают её программированию.
Однако если вам нужна нейронка с энциклопедическими знаниями, то Claude тут проигрывает Gemini, и это легко проверить по промтам вроде “из какой песни эта строчка”, клод не может ответить, тогда как Gemini легко справляется с такими задачами на широту знаний.
Если вам нужен контент NSFW (18+), например создать сценарий для ролевой игры со своей женой, то ни Claude ни Gemini вам не помогут, но вот Grok от Илона Маска просто обожает такие задачи.
В последнее время многие говорят что качество китайских моделей выросло, DeepseekKimiQwen. И да и нет. Основной плюс китайского ИИ его дешевизна, и достигается он в основном на том, что процессом их обучения занимаются западные ИИ (GPT, Gemini, Claude) т.е. они очень здорово на этом экономят, дешевле взять ИИ, чем использовать тысячи реальных людей. Поэтому прогресс в китайском ИИ напрямую будет зависеть от прогресса западных ИИ. На мой взгляд, самое большое отставание китайского ИИ состоит в механизме размышлений (Reasoning) – да нейронки можно обучить чему угодно, в том числе тому как думает человек. И вот в этом у них пока не получается. К примеру недавно я вбил строчку из одной известной песни “Сектор Газа”, топовая Кими К3 сидела и размышляла в таком стиле “Может это Руки вверх? нет. Может это Алла Пугачёва? Нет. Может это Басков? нет Может это из Тик-тока? нет” Вобщем долго думала, но как-то примитивно, хотя по тестам она идёт типа вровень с Клодом.
Однако я бы хотел отметить что компания создатель Тик-Тока Bytedance выпустила очень крутую нейронку для генерации видео, секрет кроется в том, что у них очень много видео-данных для обучения. Тут также хорошо работает избитая фраза “данные – это новая нефть”.
А что по поводу российских нейросетей? Я тут был на одной конференции и там какой-то большой член сказал, что российские математики и программисты самые умные во всём мире и они точно скоро сделают ИИ который превзойдёт всех конкурентов. Насчёт математиков и программистов я с ним спорить не буду, однако дядя не учёл один из ключевых факторов успеха в ИИ – это наличии мощного железа, те самые кластеры на сотни тысяч видеокарт Nvidia, AMD, Huawei которые используются как для обучения так и для работы железных мозгов. И у вот их у нас почти что нет. В США только за 2026 инвестируют 600-700 млрд долларов в железо для ИИ. Для сравнения в типичном кластере в США – 20 тыс новых видео карт H100 (иногда доходит 100 тыс), а у Яндекса – всего лишь 1500 старых видео карт A100. Поэтому в недавнем интервью их представитель заявил, что Алиса часть запросов будут обрабатывать на бесплатных китайских ИИ.
Автор: rajce


