Релизы моделей
59 разборов · обновляется ежедневно
Агенты для программирования визуализируют Blender-сцены через Python API
Современные передовые модели научились генерировать `.blend`-файлы и управлять Blender через Python API — без ручного интерфейса. По данным Simon Willison,…
GEO-мониторинг своими руками: что измерять в ответах ИИ
Классические SEO-позиции не переносятся на генеративные ответы в Google и Яндексе: первое место по запросу не гарантирует попадания в блок с рекомендацией.…
Claude Code: просьба пересказать сайт обернулась выполнением чужого кода
Исследователь Иоганн Ребергер показал, как в Claude Code с моделью Opus 5 в Auto Mode обычная задача «пересказать сайт» привела к запуску вредоносного кода.…
GLM 5.3 Flash собрала сценарий n8n из 127 узлов за $4
Неанонсированная модель, позже раскрытая как Z.ai GLM 5.3 Flash, за три дня собрала автономный медиаконвейер: сбор данных о конкурентах, повторное…
Gemini 3.8 Flash: три уровня рассуждений и дешевая генерация HTML
2 сентября Google выпустила Gemini 3.8 Flash, а Simon Willison обновил плагин llm-gemini до версии 0.34 с поддержкой уровней рассуждений low, medium и high.…
RAG: не улучшение модели, а доступ к вашим документам
Подключить корпоративную документацию к LLM без дообучения можно через RAG — это архитектурный шаблон, который добавляет этап поиска перед генерацией. Вопрос…
OpenAI готовит Astra: LLM научилась взламывать системы без человека
OpenAI готовит к выпуску модель Astra — первую LLM, достигшую, по версии компании, «критического порога кибербезопасности». По данным TechCrunch, модель умеет…
OGL-Mini: трёхфазный фильтр инъекций в запросах с обработкой на CPU
Автор опубликовал OGL-Mini — открытую гибридную модель безопасности для LLM-агентов, которая работает на CPU и доступна как модуль для TypeScript, Python и…
Tencent выпустила Hy4 с контекстом в миллион токенов
По данным Simon Willison, Tencent 29 августа опубликовала модель Hy4 Preview с открытыми весами и текстовым входом без поддержки зрения. Параметры выросли до…
Qwen3.8 на двух RTX 3090: 75 ток/сек вместо 32
Автор на Habr разобрал, почему плотная Qwen3.8-27B на паре RTX 3090 выдаёт лишь 32.4 ток/с, и методично поднял скорость генерации до 74.8 ток/с — без смены…
IBM Granite 4.2: три открытые модели с агентным обучением
IBM открыла веса трёх плотных моделей Granite 4.2 — 3B, 8B и 30B — с явным рассуждением и переключателем между режимами рассуждения и обычной работы. По…
Qwen3.8-Flash-Next: предварительная версия Qwen4 с открытыми весами
Qwen представила мультимодальную MoE-модель с открытыми весами Qwen3.8-Flash-Next, которую позиционирует как раннюю версию архитектуры Qwen4. По данным Simon…
LLM с уверенностью 80% выдают ложные прямые причинные связи
В свежей работе на arXiv проверили 12 дообученных на инструкциях моделей с открытыми весами на шести причинных графах, пяти вариантах формулировки запросов и…
Fable сломала бесплатный апгрейд: инженеры снова выбирают модель под задачу
Drew Breunig описывает сдвиг, который знаком каждому, кто собирал рабочие конвейеры в последние два года: до Fable оптимизировать инструменты для написания…
KVBoost обходит кэширование префиксов, ускоряя предварительную обработку в 4,5 раза
KVBoost — система повторного использования KV-кэша на уровне блоков для декодеров, совместимых с HuggingFace, описанная в arXiv. В отличие от кэширования…
Обвязка Hermes и DeepSeek превращает статьи об атаках в доказательства
Автор на Habr собрал агентную обвязку для безопасности ИИ: она читает публикации об уязвимостях, ранжирует их и автоматически воспроизводит атаки в…
Агентам для написания кода нужен не построчный просмотр, а проверка целостности
По данным Simon Willison, ключевой навык продуктивной работы с агентами для написания кода — не чтение каждой строки изменений, а умение уверенно давать…
Агентная обвязка эволюционирует от дополнительной надстройки к интерфейсу внимания
Всплеск работоспособности агентов в конце 2025 года объясняют не только новыми моделями, а слиянием двух кривых: возможностей модели и требований обвязки.…
Qwen 3.8 27B сравнялась с GPT-5.6 Luna по индексу интеллекта
По данным Simon Willison, Qwen 3.8 27B набрала 52 балла в Artificial Analysis Intelligence Index — ровно столько же, сколько GPT-5.6 Luna в максимальной…
Агенты не справились с открытым исследованием уровня NeurIPS
Группа Питера Киргиса и Саяша Капура из Принстона дала Claude Opus 4.8 на базе фреймворка с открытым исходным кодом OpenClaw шесть дней, $3000 в кредитах на…
Дальше — в канале
Здесь 59 разборов — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.
Подписаться в Telegram