llm. - страница 14

llm.

Jev: большой инженерный разбор нашумевшей System One модели

продолжить чтение

Бенчмарк качества англо-русского перевода для ведущих западных и китайских LLM

Бенчмарк качества англо-русского перевода для ведущих западных и китайских LLMTL;DR

продолжить чтение

GitHub обновил Copilot для JetBrains: появились автоматические подтверждения действий и управление MCP‑инструментами

GitHub выпустил версию 1.18.0 плагина GitHub Copilot для IDE от JetBrains. В обновлении появились новые возможности для работы с агентами: автоматическое подтверждение безопасных действий, редактирование предыдущих сообщений в диалогах, поддержка общих инструкций организации и расширенное управление MCP‑инструментами. Рассмотрим изменения подробнее.Автоматическое подтверждение безопасных действий

продолжить чтение

Как мы сделали универсальный ИИ-инструмент, который может создавать сам себя

Когда в компании заходит речь об ИИ-ассистенте для сотрудников, чаще всего выбирают из двух не очень удачных вариантов. Либо сотрудники уходят на личные подписки вроде ChatGPT — и рабочие данные утекают за периметр компании. Либо заводят корпоративного ассистента, который безопасен, но умеет только отвечать текстом: в отличие от прогрессивных моделей в веб-интерфейсе, он не может залезть в данные системы и внести в них реальные изменения.На GenAI-платформе SimpleOne

продолжить чтение

Как сделать интерактивного агента с помощью KV‑кеш‑манипуляций

продолжить чтение

Скорость — главное, что ИИ изменил в кибератаках

Недавно мы публиковали перевод статьи The Cybersecurity Industry Is Entering Its Third Era. Мы обсудили её с нашей red team-командой и пришли к выводу, что это хороший обзор происходящих изменений, но в нём почти нет главного, что происходит прямо сейчас, пока LLM ещё даже не раскрылись на полную. Речь о скорости.

продолжить чтение

ИИ знает, что он не знает? Как психология 1970-х может улучшить наш prompt engineering

Полвека назад психологи пытались понять, способен ли человек оценить границы собственного знания. Сегодня примерно тот же вопрос задают языковым моделям. И, кажется, из этого получается куда более интересный способ работы с ИИ, чем мистический «идеальный промпт». Хотя признаюсь, сам грешу мечтами об идеальных промптах.

продолжить чтение

Умеет ли Jev быть guard‑моделью для LLM?

картинка на подумать или посмеятьсяВведениеGuard модели становятся все более и более интересными. Еще 2 года назад лучшее, что мог дать опенсорс, был Wildguard

продолжить чтение

OpenAI выпустила GPT-6 Sol и GPT-6 Luna: модели дешевле GPT-5.6 в два раза

OpenAI расширила семейство GPT-6 двумя моделями — GPT-6 Sol и GPT-6 Luna. Они дополняют флагманскую GPT-6 Astra и рассчитаны на задачи, где важны не максимальные возможности модели, а стоимость, скорость и возможность масштабировать большое количество запросов.Главное изменение — цена API. По данным OpenAI, GPT-6 Sol и Luna стоят в два раза дешевле промо-тарифов соответствующих моделей GPT-5.6.

продолжить чтение

Генерация энциклопедии фазовых равновесий

В прошлой статье я рассказал о создании калькулятора химических равновесий, который реализовался в виде формы на сайте и в виде мобильного приложения. Следующей идеей для реализации был еще один формат: создать страницы на сайте, каждая из которых будет посвящена равновесию между парой химических элементов.В идеале это должно быть не просто перечисление всех реализованных фаз в соответствующем диапазоне температур, это должно быть еще и грамотное описание, что же здесь происходит и почему.

продолжить чтение