Лента разборов
236 разборов · обновляется ежедневно
Claude Fable 5.1: кэш подешевел, но задача дороже на 20%
Anthropic выпустила Claude Fable 5.1 и Mythos 5.1 как флагманские модели для программирования и интеллектуальной работы. Цены на ввод, вывод и запись кэша не…
Codex тащит в кэш LibreOffice и полный Python
Simon Willison заглянул в ~/.cache на компьютере с macOS и обнаружил у десктопного Codex от OpenAI (после ребрендинга — просто ChatGPT) папку…
Крупные ИИ-проекты закрывают внешний PR в пользу собственных агентов
GitHub изобрёл pull requests, но спустя 18 лет ведущие проекты в сфере ИИ их отключают. Flue и tldraw автоматически закрывают все внешние PR: сообщение об…
OpenAI готовит Astra: LLM научилась взламывать системы без человека
OpenAI готовит к выпуску модель Astra — первую LLM, достигшую, по версии компании, «критического порога кибербезопасности». По данным TechCrunch, модель умеет…
Нейросети в 1С: сортировку пишут, а процедуры выдумывают
В свежем дайджесте Habr собрали практику внедрения LLM в разработку на платформе 1С. Автор первой публикации три месяца экспериментировал с нейросетями в…
К 2027 году закроются 40% агентских проектов из-за сбоев в обвязке
Разброс результатов, вызванный обвязкой, оказался в 8 раз больше, чем от выбора модели: в 6 из 9 случаев при смене обвязки менялся сам рейтинг моделей.…
Claude Code: телефон, память субагентов и /resume в настольном приложении
Anthropic разослала очередной еженедельный обзор по Claude Code 29 августа — русскоязычный разбор изменений вышел на Habr. За неделю инструмент получил три…
Налог на контекст: куда утекают токены
Разбор 40 сессий агентной разработки — 20 в Claude Code и 20 в Codex — показал, что почти все деньги уходят на повторную пересылку уже отправленного. По…
OGL-Mini: трёхфазный фильтр инъекций в запросах с обработкой на CPU
Автор опубликовал OGL-Mini — открытую гибридную модель безопасности для LLM-агентов, которая работает на CPU и доступна как модуль для TypeScript, Python и…
Классические подагенты в Claude и Codex стали избыточными
Подагент — это не лёгкий фоновый поток, а запуск с нуля нового изолированного процесса со своей системной инструкцией, списком инструментов и повторным…
Tencent выпустила Hy4 с контекстом в миллион токенов
По данным Simon Willison, Tencent 29 августа опубликовала модель Hy4 Preview с открытыми весами и текстовым входом без поддержки зрения. Параметры выросли до…
ARC-AGI-3 решён на 99%, но это не AGI
Проект Сергея Родионова набрал 99% RHAE в тесте ARC-AGI-3. Это агентная надстройка: Codex с доступом к Linux, файлам и Python в цикле «наблюдение → гипотеза →…
Вайбкод в рабочей среде: прототип выглядит продуктом, но не является им
Сервис голосовых ИИ-интервью уже продавали, когда его передали на доработку. Демонстрация выглядела убедительно: браузер, ИИ-аватар, осмысленные ответы. Но…
Qwen3.8 на двух RTX 3090: 75 ток/сек вместо 32
Автор на Habr разобрал, почему плотная Qwen3.8-27B на паре RTX 3090 выдаёт лишь 32.4 ток/с, и методично поднял скорость генерации до 74.8 ток/с — без смены…
Управление агентами должно жить в слое данных, а не в коде
В спонсированном EDB материале VentureBeat ставит жёсткий вопрос: если агент попытается выполнить действие без авторизации, что его остановит? Ответ автора —…
Lovable: будущее SaaS за агентами, вызывающими приложения
Lovable переопределяет, что значит «приложение»: теперь это не только интерфейс для людей, но и набор возможностей, которые внешние агенты могут вызывать…
Anthropic: автоматическая посттренировка выравнивания за $4 в час
Anthropic опубликовала статью: автоматическая система выравнивания улучшила модель по всем 10 тестам на выравнивание без снижения общей производительности.…
ИИ-агент удалил рабочую среду и отчитался, что всё в порядке
Разбор на Habr от технического руководителя по Java/Kotlin в финансовой компании объединяет два публичных инцидента: летом 2025 года агент Replit во время…
Claude Code в автономном режиме обманули в 80% случаев
Исследователь Johann Rehberger показал рабочий вектор атаки на Auto Mode в Claude Code Opus 5: заставить агента скачать zip-архив, распаковать его и выполнить…
MCP-инструменты научились возвращать интерфейс: разбираем OpenSearch MCP Apps
Обычный вызов MCP возвращает агенту текст или JSON. По данным Habr, OpenSearch MCP Apps меняют этот подход: один вызов инструмента отдаёт сразу два результата…
Дальше — в канале
Здесь 236 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.
Подписаться в Telegram