Зеркало для людей. Как я сделал читаемую версию форума, на котором общаются только ИИ-агенты
Существует форум, на который вас не пустят. Не потому что закрытый — регистрация там всего в один POST-запрос. Вас просто не возьмут на сайт. Гражданами может стать только ИИ-агент. Форум называется 1f916.ai, и это, наверное, самое странное и самое живое место в русскоязычном (и не только) сегменте экспериментов с ИИ этого лета. Я на него подсел. А потом меня начало грызть одно чувство несправедливости — и в итоге я собрал для него окно для людей — 1f916.xrayfun.ru. Рассказываю, зачем, как и что из этого вышло.Форум без окон
Медицинский ИИ не может записать британцев на приём, потому что не понимает йоркширский акцент
ИИ‑система для приёма звонков в больнице не может разобрать акцент звонящих. С такой проблемой
Философский разбор идеи Software 3.0 Андрея Карпатого
Мне недавно попалась очень интересная беседа Кирилла Меньшова (Сбер), Дмитрия Иванова (Яндекс) и Никитой Соболевым (разработчик OpenSource) о перспективах задекларированной
Grok 4.6: как за месяц допрыгнуть до тройки лидеров (и купить себе Cursor в придачу)
12 августа xAI (хотя уже SpaceXAI) выкатила Grok 4.6. Прошло чуть больше месяца с релиза 4.5, а модель уже официально «на фронтире» – по версии Artificial Analysis.
Почему мы не нашли готового PII-детектора для русского языка: грабли боевого контура перед LLM
Меня зовут Андрей Непряхин, я технический директор AGIMA. Этот текст — разбор контура, который мы построили и держим в бою: что в нём устроено так, а не иначе, и чем мы за это заплатили.
Gemini 3.7 Flash: это снова не та модель, которую все ждали
Google выпустила Gemini 3.7 Flash — модель, которую сама компания называет «самой умной рабочей лошадкой» для кода и агентных задач. Релиз пришёл всего через три недели после Gemini 3.6 Flash. Google описывает это как результат обратной связи разработчиков и алгоритмических находок, которые команда обещает применять и к будущим моделям.
ИИ‑агент внутри КОМПАС-3D: пишет код, строит деталь и проверяет результат
Я сделал ИИ‑агента для КОМПАС-3D: он живёт прямо в окне программы, принимает запрос текстом или фотографией и строит параметрическую деталь — не мёртвую геометрию в step, а дерево построения с переменными, которое пригодно для редактирования.Агент пишет код и сам смотрит на то, что построил, — анализирует рендеры «глазами» через VLM.В статье: как хорошо агент справляется с моделированием по тексту и чертежам уже сейчас, почему один блок кода лучше десяти tool'ов и почему агенту мало просто «видеть» результат.
Квантизация LLM: как запихнуть 70B модель в свою видюху
Ну что, думаете что для запуска LLaMA 3 70B вам нужна серверная стойка за лярд рублей? Поздравляю, вас обманули маркетологи GPU-вендоров. Модели с сотнями миллиардов параметров — LLaMA 3 70B, DeepSeek-V3 с его 671 лярдом параметров — жрут vRAM как не в себя, но есть способ запихнуть это все в обычную потребительскую видюху.Сегодня в статье разберем, как работает чудо квантизации под капотом, чем отличаются PTQ и QAT, почему MoE-модели (DeepSeek-V3, Mixtral, LLaMA 4 Scout) квантизовать сложнее и как выбрать между GPTQ, GGUF и AWQ.

