Режим thinking у ИИ: что на самом деле происходит, когда модель «думает»
Когда нажимаешь кнопку Thinking и видишь, как модель несколько секунд «размышляет» перед ответом — легко решить, что она просто старается сильнее. Работает усерднее. Думает глубже. Может, перебирает больше вариантов из какой-то внутренней базы знаний.Это не так. Thinking-режим — это принципиально другой способ генерации текста, не просто «обычный режим с усилием». И понять разницу полезно не для общего развития, а чтобы знать, когда его включать, когда он даёт реальное преимущество — а когда только тратит твоё время и ресурсы.Как работает обычная генерация — и в чём её фундаментальная ловушка
Доверенный ИИ на практике: RAG, который ссылается на источник — или честно отказывается
Поднял за выходные решение, которое давно хотел проверить руками: RAG, который отвечает строго по корпусу и к каждому утверждению ставит ссылку на пункт правил — или честно пишет «В корпусе нет основания для ответа». Корпус — приказ Минспорта России №834, «Правила вида спорта “волейбол”» (плюс немного про баскетбол). Модель — Gemma-4, локально, через Ollama (сделано нарочно на Ollama, знаю про vLLM / SGLang, здесь было целью - проверить гипотезу быстро и дешево). На слое инференса ни одного внешнего вызова: можно физически отключить сеть — оно продолжает работать.Это не «ещё один чат с PDF». Цель была узкая и проверяемая:
Медицинский архив семьи в SQLite: Claude как аналитик данных
TL;DRВрач за 30 минут приема не успевает разобраться в пачке из 247 PDF за 12 лет, и принимает решения по тому, что вы вспомнили распечатать. Решение - приносить врачу не пачку, а структурированный список проблем (problem list, по методике POMR Лоренса Уида, 1968): тренды, текущие проблемы с приоритетами и привязкой к гайдлайнам, что показано и что нет, что уже сделано. Под капотом: SQLite-архив с полным raw_text
Notion восстановила доступ к Anthropic после сбоя в работе ИИ-сервиса
Notion восстановила доступ к моделям искусственного интеллекта Anthropic после сбоя в своём сервисе Notion AI. Накануне компания предупредила о снижении производительности моделей Opus 4.7 и Opus 4.8, что приводило к повышенному уровню сбоев.
Галлюцинации недели: Gemma 4 12B, Odysseus от PewDiePie и MiniMax M3, который научился видеть
NVIDIA закрывает Computex тремя релизами, Microsoft показывает сразу семь моделей MAI, а серия Opus развивается по-своему: 4.7 ленился, 4.8 врёт, 4.9 будет просить на додеп.💡
Adafruit приостановила ведение блога после письма с требованием от юристов Flux.ai
Компания разработки оборудования с открытым исходным кодом Adafruit перестала вести блог после того, как получила письмо от юристов Flux.ai с требованием прекратить использование ИИ-инструмента.
Экономный ИИ. 12 способов снизить расходы (токенов-на токены)
Наверное, всем уже очевидно, что ИИ крайне полезен, мир поменялся, нас всех заменят роботы и вообще ИИ уже нас во всём превзошёл :)Всё так или почти так, "но есть одно но" как поётся в одной известной песне. ИИ стоит денег, и весьма немалых при текущих ценах. А про локальные модели для большинства пользователей и компаний в РФ можно забыть. Ну и в целом кажется локальные модели - это не сценарий ИИ будущего.
Состоялся релиз Vim Classic 8.3
Автор Дрю ДеВолт опубликовал первый выпуск форка текстового редактора Vim. Он заявил, что развивает форк из-за непринятия политики Vim в отношении использования ИИ.
