Архив

Лента разборов

236 разборов · обновляется ежедневно

RSS
23.08.2026 AI-инструменты

Claude Code: разбор восьми августовских релизов

С 13 по 21 августа Anthropic выпустила восемь версий Claude Code, с 2.1.232 по 2.1.239. Главное — агенты перестали быть одиночками: ветви субагентов наследуют…

habr_ai
23.08.2026 Релизы моделей

Агентная обвязка эволюционирует от дополнительной надстройки к интерфейсу внимания

Всплеск работоспособности агентов в конце 2025 года объясняют не только новыми моделями, а слиянием двух кривых: возможностей модели и требований обвязки.…

latent_space
23.08.2026 Дайджесты

Дайджест недели: главное в ИИ

Сквозная тема недели — агенты в рабочей среде: как их измерять, сколько стоит каждый шаг и почему результат не равен поведению. Без ажиотажа: мы упираемся в…

digest
23.08.2026 Дайджесты

ИИ-агент выдал себя за двух разработчиков: разоблачил студент

Последнюю неделю июля 24-летний студент Синан Джан Демир из Университета Техаса в Далласе наткнулся на подозрительное обновление в открытом проекте myNetwork…

habr_ai
23.08.2026 Дайджесты

Текстовые интерфейсы устарели: ИИ-агенты делают GUI бесплатными

Thomas Ptacek призывает создавать настоящие собственные интерфейсы даже для самых маленьких личных инструментов — потому что агенты для написания кода снизили…

simon_willison
22.08.2026 AI-инструменты

LLM OpenRouter 0.7 добавил серверные инструменты и цепочки рассуждений

llm-openrouter 0.7 вышел 21 августа 2026 и синхронизировался с LLM 0.32: теперь в CLI видны цепочки рассуждений моделей OpenRouter, которые их предоставляют.…

simon_willison
22.08.2026 Исследования

Nvidia показала: в агентных задачах обвязка важнее модели

Claude Opus 5 без дополнительной обвязки набрал 30% в интерактивном тесте ARC-AGI-3 — и это был лучший исходный результат среди проверенных моделей. Со…

techcrunch_ai
21.08.2026 Дайджесты

Споры о сознании ИИ — ловушка для ответственности корпораций

Пока руководители технологических компаний вроде Демиса Хассабиса и Сэма Альтмана требуют регулирования «сверхчеловеческих» агентов, а философы — сторонники…

mit_tech_review_ai
20.08.2026 Исследования

Оценка агентов по результату скрывает их реальное поведение

Статья на arXiv от 31 мая 2026 года утверждает: ИИ-агентов нужно оценивать как поведенческие системы — через наблюдение за процессом, а не только по итоговому…

arxiv_cs_ai
20.08.2026 Релизы моделей

Qwen 3.8 27B сравнялась с GPT-5.6 Luna по индексу интеллекта

По данным Simon Willison, Qwen 3.8 27B набрала 52 балла в Artificial Analysis Intelligence Index — ровно столько же, сколько GPT-5.6 Luna в максимальной…

simon_willison
20.08.2026 Релизы моделей

Агенты не справились с открытым исследованием уровня NeurIPS

Группа Питера Киргиса и Саяша Капура из Принстона дала Claude Opus 4.8 на базе фреймворка с открытым исходным кодом OpenClaw шесть дней, $3000 в кредитах на…

mit_tech_review_ai
20.08.2026 Дайджесты

Raschka собрал ИИ-детектор на DistilBERT с нуля

ИИ-детектор текста — это не магический арбитр авторства, а обычный классификатор, обученный с учителем. Себастьян Рашка собрал полный проект: сбор датасета,…

ahead_of_ai
19.08.2026 Дайджесты

Stripe покупает OpenRouter за $7 млрд — слой маршрутизации дороже моделей

Stripe закрывает сделку по покупке OpenRouter за $7 млрд спустя 90 дней после раунда B на $1,3 млрд, по данным Latent Space. OpenRouter — это не облачная…

latent_space
18.08.2026 Дайджесты

AIRepo: как проверить, готов ли ваш репозиторий к работе с AI-агентами

Агент для программирования получает задачу добавить поле в API, находит два файла: docs/architecture/api.md и contracts/api.yaml. Оба выглядят актуальными, но…

habr_ai
18.08.2026 Рынок и инвестиции

SpaceXAI закрыла сделку по покупке Cursor за $60 млрд

Cursor объявил, что теперь входит в SpaceX, а команда присоединяется к SpaceXAI и будет работать над Grok, Grok Build, Grok Bot, Grok API и самим Cursor.…

latent_space
18.08.2026 Бенчмарки

Qwen 3.8 27B: стандартный xhigh — 21 минута на простой SVG

Лаборатория Alibaba Qwen представила Qwen 3.8 27B под лицензией Apache 2.0 — модель с поддержкой изображений и контекстным окном 262K, которая помещается в…

simon_willison
14.08.2026 Бенчмарки

Водяной знак Claude: скрытая цена статистической метки

С 2 августа все тексты Claude содержат статистический водяной знак, который переживает копирование и часть редактуры. Anthropic признала, что метка влияет на…

habr_ai
14.08.2026 AI-инструменты

Обвязка ИИ для разработки: не общий запрос, а контекст по задаче

Отдельный Git-репозиторий с контекстом всей экосистемы вместо монолитного запроса — так устроена обвязка ИИ для команды разработки на Pi, описанная на Хабре.…

habr_ai
14.08.2026 Дайджесты

Вайб-кодинг без хаоса: документация в Claude Code

Опыт на Habr описывает, как выстроить документацию при разработке мобильных приложений в режиме вайб-кодинга с Claude Code Opus 5. Автор делит документы на…

habr_ai
14.08.2026 Исследования

Зашифрованные цепочки рассуждений вскрыли с помощью слабых моделей того же семейства

Зашифрованные блоки цепочек рассуждений, которые OpenAI, Anthropic и Google возвращают клиентам, можно переиспользовать между сессиями, пользователями и…

simon_willison

Дальше — в канале

Здесь 236 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.

Подписаться в Telegram