Alice AI LLM.

Наш бенчмарк ИИ‑агентов: собачьи бега моделей LLM, в которых Алиса выигрывает

Всем привет. На связи Сергей Игнатенко, основатель ИИ‑платформы VibePilot.Мы тут сделали свой бенчмарк моделей ИИ, которые работают внутри наших ИИ‑агентов.Почему вообще возникла эта задачаДело в том, что наши ИИ‑агенты работают на суверенных моделях Яндекса (Alice AI LLM, YandexGPT 5 Pro) уже с апреля этого года. Традиционно считается, что это слабые модели, которые не приспособлены для агентных сценариев. Благодаря проработанной архитектуре мы добились того, что слабые модели делают сложные задачи. Чтобы это доказать и показать, и была сделана страница.

продолжить чтение