ai. - страница 33

ai.

От Triton Inference Server к NVIDIA Dynamo: как изменился inference для агентов в 2026

продолжить чтение

Как на самом деле работают LLM

В статье подробно рассматриваются принципы работы больших языковых моделей (large language model, LLM). Поскольку в основе большинства современных LLM лежит архитектура трансформера (transformer), ее понимание дает представление о ключевых механизмах, обеспечивающих работу таких моделей.В этой статье мы разберем ключевые принципы работы современных LLM, построенных на архитектуре трансформера. Я постараюсь объяснить основные идеи без погружения в сложную математику. Конечно, для глубокого понимания темы математическая база важна, но для первого знакомства этого материала должно быть достаточно.

продолжить чтение

Семь собеседований, чтобы нанять своего

Кандидата звали, допустим, Миша. Сеньор, нормальное резюме, живой. Резюме Миши, между прочим, прошло AI-скрининг с оценкой «92% соответствия позиции» — компания недавно внедрила умный ATS и гордилась этим. Дальше Мишу гоняли семь раундов: скрининг, техническое, систем-дизайн, лайв-кодинг, культурное, разговор с директором, финал. Две недели. Миша брал отгулы, решал задачку про лифты, рисовал квадратики и пять раз разным людям объяснял, почему ушёл с прошлого места. На финале ему жали руку и говорили «мы свяжемся в ближайшие дни».

продолжить чтение

Как я построил систему, внутри которой AI пишет код [Сгенерировано]

Последние полгода я почти не пишу код руками. И, пожалуй, это лучшее изменение в моём процессе разработки за последние годы.Нет, я не перестал быть разработчиком. Просто моя работа изменилась. Раньше большую часть времени я писал код сам. Теперь я проектирую инженерную систему, внутри которой этот код пишет AI. Моя задача — не объяснить модели, что нужно сделать, а создать среду, в которой она физически не сможет принять неправильное решение.В этой статье я покажу, как устроена моя система разработки и почему именно такой подход позволяет использовать AI в реальных проектах без потери качества.Вы узнаете:

продолжить чтение

Нейросеть DeepSeek: что умеет Дипсик и как использовать ИИ на русском

Нейросеть DeepSeek: что умеет Дипсик и как использовать ИИ на русском

продолжить чтение

ИИ добрался до шампуней и печенья: как L’Oreal и Mondelez придумывают новые рецепты

продолжить чтение

Нейросеть Claude AI в России: как работают Claude Sonnet 5 и Claude Fable 5

Нейросеть Claude AI в России: как работают Claude Sonnet 5 и Claude Fable 5Claude

продолжить чтение

Как проект из ШАДа попал в Spotlight статей на конференции ICML 2026

продолжить чтение

Когда ИИ мониторит ИИ: Полный стек наблюдаемости для LLM

пупупупуПредставьте: вы развернули в своём частном облаке или на локальных серверах Llama 3, DeepSeek или другую LLM. Данные остаются внутри инфраструктуры, модель работает локально, на первый взгляд система полностью здорова: CPU, память, сеть и сами сервисы работают без отклонений.

продолжить чтение

Как мы научили большую языковую модель говорить на карачаево-балкарском

Рис 0. Демо-чатДавно ничего не писал где-либо: разработка занимает много времени. Надеюсь, наш путь будет кому-либо полезен, особенно тем, кто обучает модельки на малоресурсных языках.Большая в данном контексте - это условно. По сути, взяли

продолжить чтение