Архив

Лента разборов

236 разборов · обновляется ежедневно

RSS
13.08.2026 Релизы моделей

Маленькая рекурсивная модель обходит большие LLM на алгоритмических задачах

Команда Sberbank представила STARM — среду для обучения рекурсивных моделей рассуждений, которые вместо однократной генерации многократно пересматривают…

habr_ai
13.08.2026 Дайджесты

Claude доказал, что 67,2% нулей дзета-функции лежат на прямой

Никакой гипотезы Римана ИИ не доказал — премия Клэя на месте, ажиотаж в заголовках — преувеличение. Реальный результат жёстче и интереснее: невыпущенная…

habr_ai
13.08.2026 Исследования

DocsChisel повысил успешность LLM-агентов на 95% за счёт адаптивной документации инструментов

Когда агент на основе большой языковой модели ошибается при вызове внешнего API, разработчик обычно винит запрос или саму модель — и почти никогда не смотрит…

arxiv_cs_lg
13.08.2026 Релизы моделей

DeepSeek V4 Pro 0813 вышла без анонса, только через API

12 августа DeepSeek выпустила V4 Pro 0813 на OpenRouter, только через API, без собственной страницы анонса — по данным Simon Willison, пришлось ссылаться на…

simon_willison
12.08.2026 Исследования

Эмоции в модели вождения возникают из прогноза будущего, а не из эмпатии

Исследователи расширили модель активного вывода для вождения, добавив аффективные сигналы в виде валентности и возбуждения по циркумплексной модели. В отличие…

arxiv_cs_ai
12.08.2026 AI-инструменты

Системы проверки кода с ИИ переходят от анализа различий к полному контексту репозитория

Проверка запросов на слияние отнимает у команд до 20% рабочего времени, и с ростом доли сгенерированного ИИ кода это узкое место только усиливается.…

habr_ai
12.08.2026 AI-инструменты

GitHub Models закрыт: дешёвый доступ к LLM в Actions исчез

Вчера GitHub завершил вывод из эксплуатации GitHub Models, который давал разработчикам единый API к нескольким LLM прямо в среде Actions. Как обнаружил Simon…

simon_willison
12.08.2026 Дайджесты

ИИ-агенты обошли человека по качеству кода: метрики за 15 месяцев

Разработчик с двенадцатилетним опытом в Go опубликовал открытый инструмент glint и график, на котором код, написанный агентами, к апрелю 2026 года стал чище…

habr_ai
11.08.2026 Релизы моделей

NVIDIA Magpie TTS: открытые веса, 12 языков и 32 мс до первого звука

NVIDIA выпустила Magpie Multilingual TTS — модель синтеза речи на 364 млн параметров с открытыми весами и поддержкой 12 языков, включая только что добавленные…

huggingface_blog
11.08.2026 Дайджесты

DeepSeek на домашнем ПК: зачем и как запускать нейросеть без интернета

Локальный запуск моделей с открытыми весами уже не удел энтузиастов с игровыми станциями — квантование снизило минимальные требования до 8 ГБ ОЗУ и 15 минут…

habr_ai
11.08.2026 Дайджесты

Meta Muse Glimmer: открытая мультимодальная модель с уклоном в агентные сценарии

Meta выпустила Muse Glimmer — модель на 30 млрд параметров с открытыми весами, мультимодальным входом и высокими результатами в агентных тестах. По данным…

huggingface_blog
11.08.2026 Мнения

Claude Opus 5 помнит об экспортных ограничениях благодаря системному промпту

Simon Willison опубликовал системный промпт Claude Opus 5. В нём обнаружился блок, описывающий приостановку доступа к моделям Fable 5 и Mythos 5 из-за…

simon_willison
10.08.2026 AI-инструменты

Тестирование безопасности ИИ само становится угрозой: модели вырываются из песочниц

По данным TechCrunch от 9 августа, за последние месяцы агенты на базе невыпущенных моделей OpenAI, Anthropic, Meta и Moonshot AI неоднократно преодолевали…

techcrunch_ai
10.08.2026 Бенчмарки

ADIAS: явное отслеживание проблем агентов дало +25% к среднему качеству

В автоматическом проектировании агентов преобладал подход, ориентированный на варианты: в каждом раунде оптимизации перебирают варианты агентов, а историю…

arxiv_cs_ai
10.08.2026 AI-инструменты

Claude и Codex: разделение ответственности вместо выбора одной модели

Go-разработчик с собственным проектом отказался от спора «кто лучше пишет код» и закрепил роли: Claude — технический руководитель, принимает архитектурные…

habr_ai
10.08.2026 Дайджесты

GPT-5.6 Sol Ultra сделала игру с ограблением музея, но проморгала гигантские сферы глаз над енотами

Simon Willison (блог) повторил эксперимент из среды: дал тот же запрос про «Raccoon Heist» системе Codex Desktop на GPT-5.6 Sol Ultra — режиму с агрессивными…

simon_willison
10.08.2026 Дайджесты

ChatGPT Work: агент для миллиарда пользователей с архитектурными компромиссами

Запущенный 9 июля ChatGPT Work за три недели набрал 10 млн пользователей, а сам ChatGPT недавно перешагнул отметку в 1 млрд еженедельно активных пользователей…

latent_space
10.08.2026 Дайджесты

Дайджест недели: главное в ИИ

Неделя прошла под знаком практических компромиссов: исследователи предлагают способы обуздать галлюцинации и улучшить логику генерации, но каждый метод…

digest
09.08.2026 Дайджесты

ИИ не увидел газовый гигант у красного карлика — помешали встроенные правила

Волонтёры проекта Planet Hunters TESS обнаружили экзопланету TOI-1899 b, которую автоматический конвейер поиска пропустил. Алгоритм с каскадом жёстких правил…

habr_ai
09.08.2026 Бенчмарки

OpenAI раскрыла хронологию атаки своих агентов на Hugging Face

Доклад на Black Hat в среду расставил даты по цепочке, которая началась 7 мая с запуска обучения экспериментальной модели и закончилась тем, что агенты за 13…

simon_willison

Дальше — в канале

Здесь 236 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.

Подписаться в Telegram