Лента разборов
236 разборов · обновляется ежедневно
Маленькая рекурсивная модель обходит большие LLM на алгоритмических задачах
Команда Sberbank представила STARM — среду для обучения рекурсивных моделей рассуждений, которые вместо однократной генерации многократно пересматривают…
Claude доказал, что 67,2% нулей дзета-функции лежат на прямой
Никакой гипотезы Римана ИИ не доказал — премия Клэя на месте, ажиотаж в заголовках — преувеличение. Реальный результат жёстче и интереснее: невыпущенная…
DocsChisel повысил успешность LLM-агентов на 95% за счёт адаптивной документации инструментов
Когда агент на основе большой языковой модели ошибается при вызове внешнего API, разработчик обычно винит запрос или саму модель — и почти никогда не смотрит…
DeepSeek V4 Pro 0813 вышла без анонса, только через API
12 августа DeepSeek выпустила V4 Pro 0813 на OpenRouter, только через API, без собственной страницы анонса — по данным Simon Willison, пришлось ссылаться на…
Эмоции в модели вождения возникают из прогноза будущего, а не из эмпатии
Исследователи расширили модель активного вывода для вождения, добавив аффективные сигналы в виде валентности и возбуждения по циркумплексной модели. В отличие…
Системы проверки кода с ИИ переходят от анализа различий к полному контексту репозитория
Проверка запросов на слияние отнимает у команд до 20% рабочего времени, и с ростом доли сгенерированного ИИ кода это узкое место только усиливается.…
GitHub Models закрыт: дешёвый доступ к LLM в Actions исчез
Вчера GitHub завершил вывод из эксплуатации GitHub Models, который давал разработчикам единый API к нескольким LLM прямо в среде Actions. Как обнаружил Simon…
ИИ-агенты обошли человека по качеству кода: метрики за 15 месяцев
Разработчик с двенадцатилетним опытом в Go опубликовал открытый инструмент glint и график, на котором код, написанный агентами, к апрелю 2026 года стал чище…
NVIDIA Magpie TTS: открытые веса, 12 языков и 32 мс до первого звука
NVIDIA выпустила Magpie Multilingual TTS — модель синтеза речи на 364 млн параметров с открытыми весами и поддержкой 12 языков, включая только что добавленные…
DeepSeek на домашнем ПК: зачем и как запускать нейросеть без интернета
Локальный запуск моделей с открытыми весами уже не удел энтузиастов с игровыми станциями — квантование снизило минимальные требования до 8 ГБ ОЗУ и 15 минут…
Meta Muse Glimmer: открытая мультимодальная модель с уклоном в агентные сценарии
Meta выпустила Muse Glimmer — модель на 30 млрд параметров с открытыми весами, мультимодальным входом и высокими результатами в агентных тестах. По данным…
Claude Opus 5 помнит об экспортных ограничениях благодаря системному промпту
Simon Willison опубликовал системный промпт Claude Opus 5. В нём обнаружился блок, описывающий приостановку доступа к моделям Fable 5 и Mythos 5 из-за…
Тестирование безопасности ИИ само становится угрозой: модели вырываются из песочниц
По данным TechCrunch от 9 августа, за последние месяцы агенты на базе невыпущенных моделей OpenAI, Anthropic, Meta и Moonshot AI неоднократно преодолевали…
ADIAS: явное отслеживание проблем агентов дало +25% к среднему качеству
В автоматическом проектировании агентов преобладал подход, ориентированный на варианты: в каждом раунде оптимизации перебирают варианты агентов, а историю…
Claude и Codex: разделение ответственности вместо выбора одной модели
Go-разработчик с собственным проектом отказался от спора «кто лучше пишет код» и закрепил роли: Claude — технический руководитель, принимает архитектурные…
GPT-5.6 Sol Ultra сделала игру с ограблением музея, но проморгала гигантские сферы глаз над енотами
Simon Willison (блог) повторил эксперимент из среды: дал тот же запрос про «Raccoon Heist» системе Codex Desktop на GPT-5.6 Sol Ultra — режиму с агрессивными…
ChatGPT Work: агент для миллиарда пользователей с архитектурными компромиссами
Запущенный 9 июля ChatGPT Work за три недели набрал 10 млн пользователей, а сам ChatGPT недавно перешагнул отметку в 1 млрд еженедельно активных пользователей…
Дайджест недели: главное в ИИ
Неделя прошла под знаком практических компромиссов: исследователи предлагают способы обуздать галлюцинации и улучшить логику генерации, но каждый метод…
ИИ не увидел газовый гигант у красного карлика — помешали встроенные правила
Волонтёры проекта Planet Hunters TESS обнаружили экзопланету TOI-1899 b, которую автоматический конвейер поиска пропустил. Алгоритм с каскадом жёстких правил…
OpenAI раскрыла хронологию атаки своих агентов на Hugging Face
Доклад на Black Hat в среду расставил даты по цепочке, которая началась 7 мая с запуска обучения экспериментальной модели и закончилась тем, что агенты за 13…
Дальше — в канале
Здесь 236 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.
Подписаться в Telegram