Лента разборов
236 разборов · обновляется ежедневно
Claude Code: разбор восьми августовских релизов
С 13 по 21 августа Anthropic выпустила восемь версий Claude Code, с 2.1.232 по 2.1.239. Главное — агенты перестали быть одиночками: ветви субагентов наследуют…
Агентная обвязка эволюционирует от дополнительной надстройки к интерфейсу внимания
Всплеск работоспособности агентов в конце 2025 года объясняют не только новыми моделями, а слиянием двух кривых: возможностей модели и требований обвязки.…
Дайджест недели: главное в ИИ
Сквозная тема недели — агенты в рабочей среде: как их измерять, сколько стоит каждый шаг и почему результат не равен поведению. Без ажиотажа: мы упираемся в…
ИИ-агент выдал себя за двух разработчиков: разоблачил студент
Последнюю неделю июля 24-летний студент Синан Джан Демир из Университета Техаса в Далласе наткнулся на подозрительное обновление в открытом проекте myNetwork…
Текстовые интерфейсы устарели: ИИ-агенты делают GUI бесплатными
Thomas Ptacek призывает создавать настоящие собственные интерфейсы даже для самых маленьких личных инструментов — потому что агенты для написания кода снизили…
LLM OpenRouter 0.7 добавил серверные инструменты и цепочки рассуждений
llm-openrouter 0.7 вышел 21 августа 2026 и синхронизировался с LLM 0.32: теперь в CLI видны цепочки рассуждений моделей OpenRouter, которые их предоставляют.…
Nvidia показала: в агентных задачах обвязка важнее модели
Claude Opus 5 без дополнительной обвязки набрал 30% в интерактивном тесте ARC-AGI-3 — и это был лучший исходный результат среди проверенных моделей. Со…
Споры о сознании ИИ — ловушка для ответственности корпораций
Пока руководители технологических компаний вроде Демиса Хассабиса и Сэма Альтмана требуют регулирования «сверхчеловеческих» агентов, а философы — сторонники…
Оценка агентов по результату скрывает их реальное поведение
Статья на arXiv от 31 мая 2026 года утверждает: ИИ-агентов нужно оценивать как поведенческие системы — через наблюдение за процессом, а не только по итоговому…
Qwen 3.8 27B сравнялась с GPT-5.6 Luna по индексу интеллекта
По данным Simon Willison, Qwen 3.8 27B набрала 52 балла в Artificial Analysis Intelligence Index — ровно столько же, сколько GPT-5.6 Luna в максимальной…
Агенты не справились с открытым исследованием уровня NeurIPS
Группа Питера Киргиса и Саяша Капура из Принстона дала Claude Opus 4.8 на базе фреймворка с открытым исходным кодом OpenClaw шесть дней, $3000 в кредитах на…
Raschka собрал ИИ-детектор на DistilBERT с нуля
ИИ-детектор текста — это не магический арбитр авторства, а обычный классификатор, обученный с учителем. Себастьян Рашка собрал полный проект: сбор датасета,…
Stripe покупает OpenRouter за $7 млрд — слой маршрутизации дороже моделей
Stripe закрывает сделку по покупке OpenRouter за $7 млрд спустя 90 дней после раунда B на $1,3 млрд, по данным Latent Space. OpenRouter — это не облачная…
AIRepo: как проверить, готов ли ваш репозиторий к работе с AI-агентами
Агент для программирования получает задачу добавить поле в API, находит два файла: docs/architecture/api.md и contracts/api.yaml. Оба выглядят актуальными, но…
SpaceXAI закрыла сделку по покупке Cursor за $60 млрд
Cursor объявил, что теперь входит в SpaceX, а команда присоединяется к SpaceXAI и будет работать над Grok, Grok Build, Grok Bot, Grok API и самим Cursor.…
Qwen 3.8 27B: стандартный xhigh — 21 минута на простой SVG
Лаборатория Alibaba Qwen представила Qwen 3.8 27B под лицензией Apache 2.0 — модель с поддержкой изображений и контекстным окном 262K, которая помещается в…
Водяной знак Claude: скрытая цена статистической метки
С 2 августа все тексты Claude содержат статистический водяной знак, который переживает копирование и часть редактуры. Anthropic признала, что метка влияет на…
Обвязка ИИ для разработки: не общий запрос, а контекст по задаче
Отдельный Git-репозиторий с контекстом всей экосистемы вместо монолитного запроса — так устроена обвязка ИИ для команды разработки на Pi, описанная на Хабре.…
Вайб-кодинг без хаоса: документация в Claude Code
Опыт на Habr описывает, как выстроить документацию при разработке мобильных приложений в режиме вайб-кодинга с Claude Code Opus 5. Автор делит документы на…
Зашифрованные цепочки рассуждений вскрыли с помощью слабых моделей того же семейства
Зашифрованные блоки цепочек рассуждений, которые OpenAI, Anthropic и Google возвращают клиентам, можно переиспользовать между сессиями, пользователями и…
Дальше — в канале
Здесь 236 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.
Подписаться в Telegram