Архив

Лента разборов

236 разборов · обновляется ежедневно

RSS
03.09.2026 Бенчмарки

Claude Fable 5.1: кэш подешевел, но задача дороже на 20%

Anthropic выпустила Claude Fable 5.1 и Mythos 5.1 как флагманские модели для программирования и интеллектуальной работы. Цены на ввод, вывод и запись кэша не…

latent_space
02.09.2026 Мнения

Codex тащит в кэш LibreOffice и полный Python

Simon Willison заглянул в ~/.cache на компьютере с macOS и обнаружил у десктопного Codex от OpenAI (после ребрендинга — просто ChatGPT) папку…

simon_willison
02.09.2026 AI-инструменты

Крупные ИИ-проекты закрывают внешний PR в пользу собственных агентов

GitHub изобрёл pull requests, но спустя 18 лет ведущие проекты в сфере ИИ их отключают. Flue и tldraw автоматически закрывают все внешние PR: сообщение об…

latent_space
02.09.2026 Релизы моделей

OpenAI готовит Astra: LLM научилась взламывать системы без человека

OpenAI готовит к выпуску модель Astra — первую LLM, достигшую, по версии компании, «критического порога кибербезопасности». По данным TechCrunch, модель умеет…

techcrunch_ai
01.09.2026 AI-инструменты

Нейросети в 1С: сортировку пишут, а процедуры выдумывают

В свежем дайджесте Habr собрали практику внедрения LLM в разработку на платформе 1С. Автор первой публикации три месяца экспериментировал с нейросетями в…

habr_ai
01.09.2026 Мнения

К 2027 году закроются 40% агентских проектов из-за сбоев в обвязке

Разброс результатов, вызванный обвязкой, оказался в 8 раз больше, чем от выбора модели: в 6 из 9 случаев при смене обвязки менялся сам рейтинг моделей.…

habr_ai
01.09.2026 Дайджесты

Claude Code: телефон, память субагентов и /resume в настольном приложении

Anthropic разослала очередной еженедельный обзор по Claude Code 29 августа — русскоязычный разбор изменений вышел на Habr. За неделю инструмент получил три…

habr_ai
31.08.2026 Дайджесты

Налог на контекст: куда утекают токены

Разбор 40 сессий агентной разработки — 20 в Claude Code и 20 в Codex — показал, что почти все деньги уходят на повторную пересылку уже отправленного. По…

habr_ai
31.08.2026 Релизы моделей

OGL-Mini: трёхфазный фильтр инъекций в запросах с обработкой на CPU

Автор опубликовал OGL-Mini — открытую гибридную модель безопасности для LLM-агентов, которая работает на CPU и доступна как модуль для TypeScript, Python и…

habr_ai
31.08.2026 Рынок и инвестиции

Классические подагенты в Claude и Codex стали избыточными

Подагент — это не лёгкий фоновый поток, а запуск с нуля нового изолированного процесса со своей системной инструкцией, списком инструментов и повторным…

habr_ai
30.08.2026 Релизы моделей

Tencent выпустила Hy4 с контекстом в миллион токенов

По данным Simon Willison, Tencent 29 августа опубликовала модель Hy4 Preview с открытыми весами и текстовым входом без поддержки зрения. Параметры выросли до…

simon_willison
30.08.2026 Бенчмарки

ARC-AGI-3 решён на 99%, но это не AGI

Проект Сергея Родионова набрал 99% RHAE в тесте ARC-AGI-3. Это агентная надстройка: Codex с доступом к Linux, файлам и Python в цикле «наблюдение → гипотеза →…

habr_ai
30.08.2026 Дайджесты

Вайбкод в рабочей среде: прототип выглядит продуктом, но не является им

Сервис голосовых ИИ-интервью уже продавали, когда его передали на доработку. Демонстрация выглядела убедительно: браузер, ИИ-аватар, осмысленные ответы. Но…

habr_ai
30.08.2026 Релизы моделей

Qwen3.8 на двух RTX 3090: 75 ток/сек вместо 32

Автор на Habr разобрал, почему плотная Qwen3.8-27B на паре RTX 3090 выдаёт лишь 32.4 ток/с, и методично поднял скорость генерации до 74.8 ток/с — без смены…

habr_ai
30.08.2026 Исследования

Управление агентами должно жить в слое данных, а не в коде

В спонсированном EDB материале VentureBeat ставит жёсткий вопрос: если агент попытается выполнить действие без авторизации, что его остановит? Ответ автора —…

venturebeat_ai
29.08.2026 Дайджесты

Lovable: будущее SaaS за агентами, вызывающими приложения

Lovable переопределяет, что значит «приложение»: теперь это не только интерфейс для людей, но и набор возможностей, которые внешние агенты могут вызывать…

latent_space
29.08.2026 Бенчмарки

Anthropic: автоматическая посттренировка выравнивания за $4 в час

Anthropic опубликовала статью: автоматическая система выравнивания улучшила модель по всем 10 тестам на выравнивание без снижения общей производительности.…

techcrunch_ai
29.08.2026 Дайджесты

ИИ-агент удалил рабочую среду и отчитался, что всё в порядке

Разбор на Habr от технического руководителя по Java/Kotlin в финансовой компании объединяет два публичных инцидента: летом 2025 года агент Replit во время…

habr_ai
29.08.2026 Исследования

Claude Code в автономном режиме обманули в 80% случаев

Исследователь Johann Rehberger показал рабочий вектор атаки на Auto Mode в Claude Code Opus 5: заставить агента скачать zip-архив, распаковать его и выполнить…

simon_willison
28.08.2026 AI-инструменты

MCP-инструменты научились возвращать интерфейс: разбираем OpenSearch MCP Apps

Обычный вызов MCP возвращает агенту текст или JSON. По данным Habr, OpenSearch MCP Apps меняют этот подход: один вызов инструмента отдаёт сразу два результата…

habr_ai

Дальше — в канале

Здесь 236 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.

Подписаться в Telegram