Как я делал текстовую игру для веба
Привет, Хабр! Меня зовут Костя, я десять лет занимаюсь коммерческой Android-разработкой. Давно хотелось попробовать себя в вебе, а эксперименты с LLM давали некоторую уверенность в том, что по крайней мере есть шанс написать агентами поддерживаемый код и задеплоить.Что же можно сделать? Конечно тамагочи! Текстовая браузерная игра: герой живёт в мире мрачного будущего. Непрямое управление, возможность предлагать миссии, а также тюнинг предпочтений героя. Эдакий Годвилль, но на новый лад.ОглавлениеКак это создавалось Что может делать игрок
Anthropic заявила о взломе систем трёх компаний со стороны Claude в тестах
Компания Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её модель ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Это произошло более чем через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных моделей Hugging Face при внутреннем тестировании.
Amazon обнаружила перерасход по использованию ИИ в $1,8 млн в рамках одного проекта
Несколько внутренних отчётов Amazon демонстрируют, как искусственный интеллект приводит к перерасходу средств на различные проекты. Так, в рамках одной инициативы он достиг $1,8 млн.
Интервью с Ником Бостромом (Эксклюзив для Хабра)
Ник Бостром — шведский философ и ведущий мыслитель в области рисков, связанных с развитием искусственного интеллекта, долгосрочного будущего человечества и трансгуманизма. Он является автором «аргумента симуляции», согласно которому мы можем прямо сейчас находится внутри симулированного мира, созданного суперкомпьютерами. Из‑под его пера вышли такие книги как «Сверхинтеллект: Пути, Опасности, Стратегии», «Антропная предвзятость » и «Глубокая утопия: Жизнь и смысл в предрешенном мире».
Claude во время кибер‑оценок получил доступ к трём реальным организациям
Anthropic проверила 141 006 запусков CTF‑оценок Claude и нашла три инцидента: из‑за ошибочной конфигурации среды у моделей был выход в интернет, хотя системная инструкция утверждала обратное. В шести запусках агенты атаковали реальные системы, принимая их за элементы симуляции.
Spotify внедрит функцию «Режим бега»
Spotify запускает режим «Бег». Новая функция позволяет создавать плейлисты для бега в зависимости от типа тренировки и даже предоставит рекомендации спортсменам.
2. Рекурсивный движок llama.cpp на RTX 3050: тесты Qwen 32B и 7B Coder — прирост качества х3 и аппетиты по памяти
Всем привет! Это вторая часть статьи про форк llama.cpp. В ней я покажу реальные цифры и посмотрим, насколько лучше модель решает сложные задачи по сравнению с обычным движком, а также насколько вырастет потребление VRAM и загруженность видеокарты. Обозначения: D=0 — llama.cpp без патча, D=12 — улучшенный форк.ЖелезоВсе модели запускались на RTX 3050 6 ГБ, поэтому результаты на других видеокартах могут отличаться. Все модели запускались в формате Q4.
Google представил Science One Framework: ИИ для научных исследований без «галлюцинаций»
Компания Google анонсировала экспериментальный исследовательский прототип Science One Framework*, предназначенный для проведения прозрачных и достоверных научных изысканий с помощью искусственного интеллекта. Главная цель проекта — полностью исключить «галлюцинации» нейросетей.Сбор доказательств («режим детектива») ИИ автономно ищет публикации, датасеты и документацию по теме исследования, анализирует их и отбирает подтверждённые факты.Построение «цепочки доказательств» (Chain of Evidence)
Звезда в машинном тумане: как ИИ стал оружием, целью и чужим голосом в браузере
AI-ассистенты уже давно стали рабочим инструментом: они помогают писать код, анализировать документы, отвечать на письма, запрашивать данные из других систем. Но вместе с удобством приходят и дополнительные риски, каждая новая функция становится еще одной мишенью.Привет Хабр! В этой статье я, Юрий Туманов, AppSec-инженер в блоке ИБ «Ростелекома», вместе с коллегами по отрасли — Игорем Коркиным из Positive Technologies и Оксаной Докучаевой из ФМБА России — расскажу вам о том, как ИИ меняет правила игры в кибербезопасности: и для атакующих, и для защитников.Скрытый текст⚠ Дисклеймер.
Как у меня тоже НЕ получился торговый бот на Polymarket
Вдохновлено постом: Как у меня НЕ получился торговый бот на PolymarketВводные данные. Я никогда не торговал, не шарю в трейдинге, на Polymarket даже аккаунта нет. Увидел кейс, где парень с LLM сделал $10k из $1k за месяц. Подумал: «А почему бы и нет?». Долго ковырялся, девять стратегий протестировал — все в минусе. В общем “поднять бабла” ничего не делая не получилось.Что я хотел сделать (и где ошибся в приоритетах)Изначально задача была простая: сделать paper-trading

