искусственный интеллект. - страница 557

Сублиминальное обучение и инерция весов: Почему нейросети помнят то, что должны были забыть

В предыдущей статье я рассматривал феномен сублиминального обучения, но вопросов было больше, чем ответов. Пришло время разобрать его подробнее. Эксперименты и код ниже.В задачах AI Alignment и безопасности LLM остается актуальным вопрос: гарантирует ли дообучение (fine-tuning) или обучение с подкреплением (RLHF) удаление нежелательной информации?

продолжить чтение

Siri будет работать через Google Gemini уже в 2026

Совместное заявление Google и AppleApple и Google заключили многолетнее соглашение о сотрудничестве, в рамках которого следующее поколение Apple Foundation Models будет основано на моделях Gemini от Google и их облачных технологиях. Эти модели помогут обеспечить работу будущих функций Apple Intelligence, включая более персонализированную Siri, которая появится уже в этом году.

продолжить чтение

Почему я удалил ChatGPT после трёх лет использования

Реклама - это лишь симптом более серьёзной проблемыSource: Alex Shuper, Unsplash I. Реклама в ChatGPT — это переход красной чертыНа этой неделе OpenAI объявила, что начнёт тестировать рекламу в бесплатной версии ChatGPT

продолжить чтение

GLM-4.7 Flash. Локальная модель, которая реально тянет уровень флагманов

ZAI выпустили

продолжить чтение

MCP (КОМПАС-3D + LLM): превращаем САПР в среду для AI-агентов с помощью Python и COM API

Есть рутина, которую вы мечтаете автоматизировать?

продолжить чтение

Cloudflare купил Human Native и строит рынок данных для обучения ИИ

продолжить чтение

Сатья Наделла: индустрия ИИ может потерять общественную поддержку без обеспечения реальных преимуществ

Генеральный директор Microsoft Сатья Наделла предупредил, что индустрия искусственного интеллекта может потерять общественную поддержку, если не принесет реальной пользы пользователям. 

продолжить чтение

ElevenLabs готовится к новому раунду при оценке $11 млрд

продолжить чтение

RLM-Toolkit: Полная замена LangChain? FAQ часть 2

Продолжение статьи о RLM. Первая часть: Почему ваш LLM-агент забывает цельО чём эта статья?В первой части я разобрал 10 проблем LLM-приложений и как RLM их решает. Но остался очевидный вопрос:"Чем это отличается от LangChain? Зачем ещё один фреймворк?"Короткий ответ: RLM-Toolkit — это пока не полная замена LangChain. Не весь запланированный функционал реализован, но в своей нише (огромный контекст, H-MEM память, безопасность, InfiniRetri, самоулучшающиеся агенты) — уже конкурент и опережает в вопросах развития под современные задачи.

продолжить чтение

Fine-tuning Qwen-8B под проприетарный синтаксис (CADINP) на одной RTX 3090: опыт инженера-конструктора

Проблема: Галлюцинации в инженерных расчетахЯ занимаюсь расчетами строительных конструкций в комплексе SOFiSTiK. Основной инструмент взаимодействия с ним — внутренний язык CADINP. Это мощный, но старый процедурный язык с жестким синтаксисом: строгая последовательность модулей (AQUA -> SOFIMSHC -> ASE), специфичные команды фиксации узлов и неявные зависимости.SOTA-модели (ChatGPT-4o, Claude 3.5 Sonnet) справляются с CADINP посредственно. Основные проблемы при генерации кода general-purpose моделями:Синтаксический шум: Выдумывание несуществующих аргументов функций.Потеря контекста:

продолжить чтение