Архив

Лента разборов

234 разбора · обновляется ежедневно

RSS
13.07.2026 Релизы моделей

Нейросеть не повторяет лозунги — она пересказывает ценность с фактурой

GEO принципиально отличается от старого SEO: модель не запоминает ваш бренд, а каждый раз пересобирает ответ заново — поиск из текущего информационного поля…

habr_ai
13.07.2026 Дайджесты

Почему ChatGPT и Яндекс цитируют только 7 общих доменов из 174

Автор методично прогонял 60 русскоязычных запросов ниши контент-производства через оба движка три месяца подряд и собирал списки процитированных доменов.…

habr_ai
13.07.2026 Дайджесты

Дайджест недели: главное в ИИ

На этой неделе практическая польза теснила маркетинг: стоимость вывода моделей продолжила падать, бенчмарки подверглись жёсткой ревизии, а агенты показали и…

digest
13.07.2026 Релизы моделей

GPT-5.6 выпустили с новыми API и скрытыми расходами

Релиз GPT-5.6 обернулся катастрофой пользовательского опыта, которую OpenAI признала публично. Модель получила три уровня «интеллекта» — Luna, Terra, Sol — и…

latent_space
13.07.2026 Бенчмарки

GLM-5.2 запустили на ноутбуке с 25 ГБ памяти

Разработчик-одиночка JustVugg выкатил движок Colibri — 1300 строк на чистом C, которые запускают 744-миллиардную GLM-5.2 от Z.ai на ноутбуке с 25 ГБ…

habr_ai
12.07.2026 Дайджесты

Ведущие ИИ-лабы устроили виртуальную «выставку» флагманских моделей

С 7 по 10 июля OpenAI, Anthropic, SpaceXAI и Meta почти одновременно обновили свои флагманские модели, превратив окно релизов в подобие отраслевой выставки.…

habr_ai
12.07.2026 Исследования

Гибридные архитектуры Transformer и Mamba становятся стандартом LLM

Собранный за январь–май список ключевых LLM-статей фиксирует сдвиг, который уже нельзя игнорировать: гибридные архитектуры стали основным направлением, а не…

ahead_of_ai
12.07.2026 Релизы моделей

Codex-агент провёл анализ стилера в песочнице: работа реверсера отдана LLM

Эксперимент на стеке QEMU/libvirt + Volatility 3 + Ghidra + Codex показал: LLM-агент способен автоматически связать данные дампа памяти, статики и сетевых…

habr_ai
12.07.2026 Бенчмарки

Muse Spark 1.1 вышла с API и заговорила сама с собой

9 июля Meta открыла API для Muse Spark 1.1 — первой модели линейки Spark с публичным доступом. Предыдущая версия, вышедшая в апреле, работала без API. По…

simon_willison
11.07.2026 Исследования

Microsoft Research открыла Flint — язык визуализации для AI-агентов

Создать действительно аккуратный график — значит помнить о десятке деталей: разбор дат, начальное значение шкалы, формат подписей, цветовая схема, отступы.…

microsoft_research
11.07.2026 Дайджесты

Дайджест недели: главное в ИИ

Неделя напомнила, что индустрия всё чаще смотрит не на бенчмарки, а в чек за вывод и в воспроизводимость результатов. Статья за 31 цент, ускорение вывода…

digest
11.07.2026 Дайджесты

ИИ-агент взломал роутер Cisco за три часа

Энтузиаст протестировал универсального агента Hermes с моделью DeepSeekV4 Pro на задаче, которую обычно считают недоступной ИИ — физический сброс забытого…

habr_ai
11.07.2026 Бенчмарки

SWE-Bench Pro показал проблемы с надёжностью оценки кода

Новый анализ OpenAI вскрывает проблемы в SWE-Bench Pro — одном из главных бенчмарков для оценки способности моделей решать реальные задачи программной…

openai_news
10.07.2026 Рынок и инвестиции

SpaceXAI показала Grok 4.5 — Opus-уровень за четверть цены вывода

SpaceXAI запустила Grok 4.5 — первую модель, обученную специально под задачи кодинга и агентов, причём в партнёрстве с Cursor. Модель не пытается побить…

latent_space
10.07.2026 Дайджесты

Вайб-кодинг без розовых очков: 5 ошибок Claude в реальном проекте

Тимлид аналитиков без навыков кодинга создала на Claude Code полноценный веб-сервис «Бытовые счета» на Next.js, и он действительно работает в боевой среде — 0…

habr_ai
10.07.2026 Бенчмарки

Вывод моделей подешевел в 50 раз — узким местом стали системы данных

По данным BAIR, стоимость GPT-4-уровня рухнула с $30 до менее чем $1 за миллион токенов с начала 2023 года, а медианный темп падения цен на вывод моделей —…

bair_blog
10.07.2026 Релизы моделей

Voice-2-voice модели: почему прямой вывод звука быстрее каскада ASR-LLM-TTS

Классический голосовой конвейер — ASR распознаёт речь в текст, LLM генерирует ответ, TTS синтезирует звук — накапливает задержку в сотни миллисекунд на каждом…

habr_ai
10.07.2026 Бенчмарки

GPT-5.6: три модели, ставка на агентные цепочки и спорный бенчмарк

OpenAI выпустила линейку GPT-5.6 — Luna, Terra и Sol — с агрессивным позиционированием для длинных агентных задач. Главный козырь, по данным Simon Willison, —…

simon_willison
09.07.2026 Дайджесты

Открытые модели отъедают токены, но не бюджет — счёт Anthropic держится

CEO Decagon Джесси Чжан выдвинул теорию, которая переворачивает привычную картину войны открытых и проприетарных моделей: это не конкуренты, а две стадии…

techcrunch_ai
09.07.2026 Релизы моделей

Яндекс оптимизировал инференс DeepSeek в четыре раза

Запустив DeepSeek-V3.2 в облаке, команда Yandex AI Studio обнаружила, что на смешанной нагрузке стандартные open-source фреймворки ломаются там, где…

habr_ai

Дальше — в канале

Здесь 234 разбора — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.

Подписаться в Telegram