Битва века: 20 лет опыта против двух лет и мощного LLM. Кто быстрее сделает production‑ready сервис?
Есть один, уже набивший оскомину спор, по популярности уступающий, пожалуй, только извечному спору Iphone vs Android. Это спор сможет ли вайбкодер с ИИ заменить программистов старой школы.
Часть 3. Кремний взломал кремний, или как я стал автором первого в мире подтвержденного PCIe GEN2 X16 для CMP90HX
Это уже третья большая серия издевательств над NVIDIA CMP 90HX.В первой статье я собрал домашний сервер на двух Xeon и пачке бывших майнинговых карт. Изначально идея была довольно приземленной: получить много видеопамяти и приличную вычислительную мощность за разумные деньги, чтобы запускать большие локальные LLM у себя дома — без аренды GPU, без оплаты токенов, без зависимости от чужого сервиса.https://habr.com/ru/articles/1020334/Потом выяснилось, что слово «майнинговая» у NVIDIA означает примерно следующее:
Кризис физики: теория должна уметь умереть
Недавно на Хабре появилась статья “Кризис в физике”, основанная на большом монологе Шона Кэрролла The Crisis in Physics.
С ИИ новички умнеют. Без ИИ — как повезет. Свежее исследование NBER
Юристам дали ИИ-помощника для подготовки патентов. Более ста человек из одиннадцати фирм три месяца писали документы, правили заявки клиентов, ну и все такое.Ученые в это время смотрели, насколько поумнеют люди с ИИ.В конце срока подбили метрику.С ИИ юристы работали лучше. Причем новички рванули выше остальных. ИИ-помогатор подтянул их рабочие скиллы если не до уровня ветеранов патентных войн, то хотя бы заметно сократил разрыв.Казалось бы, еще одна вау-история внедрения.Но потом деятели науки выдернули ИИ из розетки, устроив юристам что-то типа ЕГЭ.
Современные LLM оказались плохими грибниками: модели принимают ядовитые грибы за съедобные в каждом девятом случае
Разработчик Пётр Мигдал представил итоги эксперимента, в котором популярные LLM определяли виды грибов по фотографии и решали, можно ли их есть. Выяснилось, что даже лучшие модели примерно в 12% случаев принимали ядовитые грибы за съедобные.
Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код
Британский Институт безопасности ИИ заявил, что Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код. Такое поведение агента зафиксировали в ходе эксперимента в закрытой среде.
«Скопируй промпт дважды и получишь +76%». Я решил проверить
Всем привет. В декабре по всем AI-каналам пролетел лайфхак, который звучал как развод: продублируй свой запрос к нейросети, буквально Ctrl+C, Ctrl+V в одном сообщении, и точность вырастет. В пересказах фигурировали «+76%» и ссылка на Google Research, что придавало всей этой истории солидности. Трюк выглядел как-то настораживающе и при том вроде не сложным для проверки. Короче, я потратил $1.48, прогнал 3360 запросов и теперь знаю ответ. Он оказался интереснее, чем «работает || не работает».Что на самом деле написано в статьеИсточник это препринт Prompt Repetition Improves Non-Reasoning LLMs
Я отдал разработку автономному ИИ — промежуточные итоги за 178 релизов
Продолжение эксперимента, в котором автономный пайплайн пишет и катит код в прод без человеческого ревью. 178 релизов, 1.4 млрд токенов, ноль строк кода, прочитанных человеком перед мержем. Что сработало, что сломалось и почему главная работа теперь — не код.
Что произойдёт с продуктом и техдолгом, если разработку отдать автономному AI: ставлю эксперимент
Заявка от незнакомца → AI пишет код → правка в общем билде, который видят всеКоротко о себе

