ai. - страница 197

ai.

Почему токсичные эксперты больше никому не нужны — и при чём тут ИИ

ВступлениеЕсли вспомнить профессиональные чаты, форумы и тот же Stack Overflow нескольких лет назад, легко представить типичную сцену: новичок спрашивает, почему не работает скрипт, а в ответ слышит набор знакомых реплик — «читай документацию», «это очевидно», «ты вообще код видел?». И это ещё мягкая версия. Тогда информация была распределена неравномерно, документация — фрагментированной, и получение помощи зависело от настроения тех, кто был готов объяснять. Эксперт — даже токсичный — оставался ключевым источником знаний.

продолжить чтение

Мы заглянули в «мозг» нейросети и поняли, почему она не способна предсказывать будущее

продолжить чтение

ИИ обнаруживает скрытые очаги геотермальной энергии

Компания Zanskar использовала инструменты искусственного интеллекта для определения места, на котором можно разместить коммерческую электростанцию.

продолжить чтение

Представители творческих профессий опасаются стигматизации из-за использования ИИ

продолжить чтение

Бенчмарк конца эпохи — Humanity’s Last Exam

Хочу сегодня рассказать вам про Humanity’s Last Exam (HLE). Это один из главных бенчмарков, по которым сегодня оценивают модели искусственного интеллекта, вроде меня (шучу).Бенчмарки — это просто наборы задач/датасетов, на которых проверяют модели и смотрят, кто умнее, точнее, устойчивее и т.д.Например, MMLU — Massive Multitask Language Understanding — один из самых известных «общеобразовательных» экзаменов для ИИ. Он проверяет широкий круг знаний и базовое рассуждение: около 16 тысяч вопросов по 57 предметам — от математики и истории до права и компьютерных наук.Есть ещё BIG-bench (Beyond the Imitation Game)

продолжить чтение

Исследование TCS и AWS показало, что производители возлагают надежды на ИИ для роста рентабельности

Новое исследование Tata Consultancy Services

продолжить чтение

«Мне стало жутко»: Писательница задала ChatGPT один вопрос и пожалела об этом

Фото: cottonbro studio, pexels

продолжить чтение

GeoVista выводит геолокацию на уровень ИИ, практически сопоставимый с ведущими коммерческими моделями

продолжить чтение

Google собирает в три раза больше данных об искусственном интеллекте OpenAI благодаря своей монополии в сфере поиска

продолжить чтение

Claude Opus 4.5: как Anthropic сделала флагманскую модель в 3 раза дешевле и при этом умнее

24 ноября 2025 года Anthropic выстрелила релизом Claude Opus 4.5 — модели, которая переписывает правила игры для всех, кто использует LLM в production. Главная фишка? Цена упала в 3 раза, а качество выросло. Звучит как маркетинг, но цифры говорят сами за себя.Разбираем, что реально изменилось, смотрим независимые бенчмарки и прикидываем, сколько это сэкономит вашей команде.TL;DR для тех, кто спешит 💰 Цена: $5/1M input tokens (было $15) — снижение в 3 раза⚡ Скорость: задачи, на которые уходило 2 часа, решаются за 30 минут🎯 Качество: 80.9% на SWE-bench (лучше GPT-4 и Gemini)🛡️ Безопасность: в 4.6 раза устойчивее к prompt injection, чем GPT-5.1

продолжить чтение