BrainTools - Методики для развития мозга - страница 118

Три месяца с Claude: хороший ассистент, плохой программист

Мне выдали подписку на Claude и сказали выжимать максимум из токенов, так что я решил дать ему честный шанс. В этой статье расскажу, что из этого вышло.В наши дни от LLM становится всё сложнее спрятаться. Даже если вы избегаете соцсетей — или хотя бы тщательно подбираете подписки, чтобы не видеть основную массу нейрослопа, — и пропускаете мимо ушей громкие маркетинговые заявления, которые потом в новостях почему‑то преподносят как факты, LLM, скорее всего, всё равно найдут вас на работе.

продолжить чтение

Шесть LLM‑судей из четырёх лабораторий несут 1,9 независимого голоса из 6

*6 LLM‑судей, 4 лаборатории, 3 страны — а ошибки коррелируют: ρ̄ ≈ 0,42, эффективно 1,9 из 6.В июле я писал, что консенсус шести LLM‑судей на RAGTruth бьёт любого одиночного судью. Это по‑прежнему верно. Но тогда я не проверил главного: сколько независимых голосов стоит за этим консенсусом. Оказалось — примерно два.## 1,9 из 6Посадите шесть разных инструктивных LLM судить одну задачу и выносить вердикт голосованием — интуиция подсказывает, что шесть моделей из четырёх лабораторий надёжнее одной: разные компании, архитектуры, страны, ошибки же должны быть независимыми.

продолжить чтение

Словарь «Колобок» и идея перевода словарей

TL:DR версияЕсли поработать с промптами и гейтами, то можно перевести большущий японо-английский словарь к виду японо-русского с очень неплохим качеством. Идея применима к другим языкам. Сделал пайплайн, запускал 100 Sol-воркеров-переводчиков одновременно через CLI. Вышло недорого. Тут словарь, тут гитхаб с пайплайном, тут примеры статей. Почему нужен новый словарь

продолжить чтение

ИИ пишет тест-кейсы и автотесты за тебя: как их генерировать и не получить ложное покрытие

Генерация тест-кейсов — один из первых сценариев, с которых компании начинают внедрение ИИ в тестирование. Модель получает требования или код и через несколько секунд выдаёт список проверок. Руководство довольно быстро приходит к выводу: если эту часть работы можно автоматизировать, возможно, ручных тестировщиков стоит сократить или переквалифицировать.

продолжить чтение

Ни строчки руками: как я вайбкодил AI-мастера D&D и что показали два месяца открытой беты

Каждый раз, когда на Хабре очередной срач про вайбкодинг, я сижу тихонько и молчу. Мне спорить неудобно: у меня в проде живёт продукт, где весь код — от миграций базы до анимации кубиков — написали агенты. Вообще весь. Клавиатура за полгода не набрала ни одного if.Продукт — «Таверна Мокрый Тортл», AI-мастер подземелий. Соло-игра в D&D 5e прямо в Telegram: бот плюс мини-апп с листом персонажа. Броски без поддавков, бой по правилам, магия, левелап. Сделал для тех, кто хочет играть в НРИ, но группу собрать не может — а таких, как выяснилось, немало) Бота зовут @dnd5char_bot

продолжить чтение

Теплый ламповый локальный инет. От Opencode и DocFetcher. «Свой лунопарк»

Уже лет 10 я пользуюсь Everything от VoidTools, и наслаждаюсь. Вся навигация в машине - поиск - только через него. Единственное что он не умеет делать быстро - искать в файлах по содержимому.Не в первый раз недавно посмотрел на DocFetcher, и стал он вдруг “LocalInet feat DocFetcher”.

продолжить чтение

OpenAI представила режим для подростков с инструментами для учёбы и родительским контролем

OpenAI представила

продолжить чтение

Компилятор как первый ревьюер: петля верификации Go‑кода, который написал агент

Год назад мой типичный пулл‑реквест писался руками часа три и ревьюился минут двадцать. Сейчас четыреста строк агент выдаёт за минуту, а ревью того же дифа занимает час: приходится вычитывать уверенно написанный чужой код, в котором ошибка выглядит ровно так же убедительно, как правильное решение. Узкое место переехало с набора кода на его проверку, и усилием воли оно не расширяется.В августе у Google вышел текст о том, почему Go хорошо подходит для разработки с агентами

продолжить чтение

Почему нейросети станут «цифровым фастфудом» для бедных

Привет, Хабр! А вот вы, наши дорогие читатели, думали о том, как будут воспринимать искусственный интеллект наши потомки? Мы-то понятно: кто-то вайбкодит, а кто-то переживает, что его работу полностью возьмут на себя нейросети. А вот наши дети, внуки, как они будут смотреть на ИИ, который сопровождает их с рождения?

продолжить чтение

Я не хотел нанимать работника и заменил его нейросетью

Дисклеймер: я люблю людей и свою карму. И не считаю, что всех нужно заменять ИИ. Всем привет! Меня зовут Миша Шумовский, я главред Нейромедиа — нового медиа про нейросети. На запуске у нас была задачка: наладить регулярный выпуск новостей, чтобы получать дополнительный поисковый трафик. Нанимать под это отдельного человека не хотелось: такая работа стоит недорого, но для молодого медиа важна каждая копеечка. Да и как будто в медиа про нейросети часть процессов точно должна быть автоматизирована, иначе зачем все это. 

продолжить чтение