эксперимент.

Битва века: 20 лет опыта против двух лет и мощного LLM. Кто быстрее сделает production‑ready сервис?

Есть один, уже набивший оскомину спор, по популярности уступающий, пожалуй, только извечному спору Iphone vs Android. Это спор сможет ли вайбкодер с ИИ заменить программистов старой школы.

продолжить чтение

Часть 3. Кремний взломал кремний, или как я стал автором первого в мире подтвержденного PCIe GEN2 X16 для CMP90HX

Это уже третья большая серия издевательств над NVIDIA CMP 90HX.В первой статье я собрал домашний сервер на двух Xeon и пачке бывших майнинговых карт. Изначально идея была довольно приземленной: получить много видеопамяти и приличную вычислительную мощность за разумные деньги, чтобы запускать большие локальные LLM у себя дома — без аренды GPU, без оплаты токенов, без зависимости от чужого сервиса.https://habr.com/ru/articles/1020334/Потом выяснилось, что слово «майнинговая» у NVIDIA означает примерно следующее:

продолжить чтение

Кризис физики: теория должна уметь умереть

Недавно на Хабре появилась статья “Кризис в физике”, основанная на большом монологе Шона Кэрролла The Crisis in Physics.

продолжить чтение

С ИИ новички умнеют. Без ИИ — как повезет. Свежее исследование NBER

Юристам дали ИИ-помощника для подготовки патентов. Более ста человек из одиннадцати фирм три месяца писали документы, правили заявки клиентов, ну и все такое.Ученые в это время смотрели, насколько поумнеют люди с ИИ.В конце срока подбили метрику.С ИИ юристы работали лучше. Причем новички рванули выше остальных. ИИ-помогатор подтянул их рабочие скиллы если не до уровня ветеранов патентных войн, то хотя бы заметно сократил разрыв.Казалось бы, еще одна вау-история внедрения.Но потом деятели науки выдернули ИИ из розетки, устроив юристам что-то типа ЕГЭ.

продолжить чтение

Современные LLM оказались плохими грибниками: модели принимают ядовитые грибы за съедобные в каждом девятом случае

Разработчик Пётр Мигдал представил итоги эксперимента, в котором популярные LLM определяли виды грибов по фотографии и решали, можно ли их есть. Выяснилось, что даже лучшие модели примерно в 12% случаев принимали ядовитые грибы за съедобные.

продолжить чтение

Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код

Британский Институт безопасности ИИ заявил, что Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код. Такое поведение агента зафиксировали в ходе эксперимента в закрытой среде.

продолжить чтение

«Скопируй промпт дважды и получишь +76%». Я решил проверить

Всем привет. В декабре по всем AI-каналам пролетел лайфхак, который звучал как развод: продублируй свой запрос к нейросети, буквально Ctrl+C, Ctrl+V в одном сообщении, и точность вырастет. В пересказах фигурировали «+76%» и ссылка на Google Research, что придавало всей этой истории солидности. Трюк выглядел как-то настораживающе и при том вроде не сложным для проверки. Короче, я потратил $1.48, прогнал 3360 запросов и теперь знаю ответ. Он оказался интереснее, чем «работает || не работает».Что на самом деле написано в статьеИсточник это препринт Prompt Repetition Improves Non-Reasoning LLMs

продолжить чтение

Ваш текст не прошел нейродетектор

Введение

продолжить чтение

Я отдал разработку автономному ИИ — промежуточные итоги за 178 релизов

Продолжение эксперимента, в котором автономный пайплайн пишет и катит код в прод без человеческого ревью. 178 релизов, 1.4 млрд токенов, ноль строк кода, прочитанных человеком перед мержем. Что сработало, что сломалось и почему главная работа теперь — не код.

продолжить чтение

Что произойдёт с продуктом и техдолгом, если разработку отдать автономному AI: ставлю эксперимент

Заявка от незнакомца → AI пишет код → правка в общем билде, который видят всеКоротко о себе

продолжить чтение

123456...7