Архив

Лента разборов

234 разбора · обновляется ежедневно

RSS
22.07.2026 Дайджесты

Джек Дорси создал Buzz — открытую альтернативу Slack с ИИ-агентами

Block Джека Дорски анонсировала Buzz — платформу для групповых чатов, где люди и AI-агенты работают в одном пространстве. По данным TechCrunch, Buzz…

techcrunch_ai
22.07.2026 Дайджесты

Тестируем 11 видео-нейросетей: какая лучше справляется с деталями

Эксперимент с анимацией сложного семейного фото единым англоязычным запросом показал, что идеального сервиса для оживления пока нет. Разброс итоговых баллов —…

habr_ai
22.07.2026 Исследования

Как заставить LLM забыть опасные знания: обзор методов

Обзор, опубликованный 23 июня 2026 года, ставит под сомнение главную киберзащитную ставку индустрии — «забывание» нежелательных знаний в больших языковых…

arxiv_cs_lg
22.07.2026 AI-инструменты

Кодинг-агенты сделали обратную разработку домашних устройств экономически выгодной

Simon Willison фиксирует то, о чём последние месяцы говорят в личных разговорах: разработчики всё чаще используют кодинг-агентов, чтобы перехватывать API…

simon_willison
22.07.2026 Мнения

Технический долг никуда не исчез — просто платим теперь токенами

Сейчас модно говорить, что LLM и агенты снижают стоимость разработки: вместо найма инженеров компания жжёт токены, увеличивает контекстное окно, запускает…

habr_ai
21.07.2026 Дайджесты

Рой ИИ-агентов Cursor создал SQLite за тысячу долларов

Cursor провела эксперимент: сотни AI-агентов в течение четырёх часов писали на Rust совместимый с SQLite движок, опираясь только на документацию — без…

habr_ai
21.07.2026 Релизы моделей

Qwen 3.8 Max: новая модель и вызовы для безопасности

Alibaba выложила Qwen 3.8 Max с открытыми весами — 2.4 триллиона параметров, почти как у Kimi K3 (2.8T). Это разворот на 180°: предыдущую версию, Qwen 3.7…

simon_willison
21.07.2026 Бенчмарки

DocOCR-Eval: выбор OCR-движка без разметки и аннотаций

Распознавание текста на сканах — базовая операция для извлечения ключевой информации или ответов на вопросы по документу. Но подобрать OCR-движок или…

arxiv_cs_lg
21.07.2026 Дайджесты

Письмо Альтмана 2022 года: открытая модель как оружие против конкурентов

В материалах иска Musk v. Altman (2026) всплыло письмо Сэма Альтмана к совету директоров OpenAI от 1 октября 2022 — его заметил и процитировал Simon Willison.…

simon_willison
20.07.2026 AI-инструменты

ИИ эффективнее помогает при разработке новых систем, чем при модернизации старых

Когда разработчик начинает с чистого репозитория, AI-ассистенты впечатляют: контролируемый эксперимент 2023 года с 95 участниками показал, что GitHub Copilot…

habr_ai
20.07.2026 Бенчмарки

Cura 1T: медицинская модель с циклом самоэволюции сохранила общие способности

15 июля 2026 года на arXiv появилась статья о Cura 1T — специализированной LLM для здравоохранения, охватывающей консультации пациентов, клинические…

arxiv_cs_ai
20.07.2026 Дайджесты

Как нейросети влияют на критическое мышление пользователей

Автор — преподаватель математики — вспоминает лекцию о дистилляции нейросетей: простая модель, обученная на выходах сложной, никогда не станет умнее…

habr_ai
20.07.2026 Дайджесты

Китайские BCI обходят Neuralink не точностью, а скоростью выхода на рынок

Пока внимание приковано к роликам Neuralink с управлением курсором силой мысли, основной вектор развития интерфейсов «мозг-компьютер» сместился в Китай — и…

habr_ai
20.07.2026 Исследования

Половина компаний пострадала от инцидентов с AI-агентами

Агенты получают доступ к реальным системам и данным, а средства контроля за ними хронически отстают. По данным VentureBeat, опросивших 107 крупных…

venturebeat_ai
19.07.2026 Дайджесты

Дайджест недели: главное в ИИ

Открытые модели нарастили параметры и мультимодальность, а агентские архитектуры — сконцентрировались на экономии LLM-вызовов и борьбе с деградацией на…

digest
19.07.2026 Дайджесты

Как сохранить авторство кода, написанного ИИ

Продуктовый дизайнер Дмитрий Тогулев выпустил портфолио, где весь код отдал Claude Code, а основным вводом стала вебкамера — частицы на странице реагируют на…

habr_ai
19.07.2026 Релизы моделей

Режимы reasoning effort в языковых моделях: как это работает

Себастьян Рашка разобрал механику управления «усилиями рассуждений» на примере GPT-5.6 и свежего открытого Inkling. Выбор low/medium/high в интерфейсе…

ahead_of_ai
18.07.2026 Релизы моделей

Как обвязка агента улучшила результаты на SWE-bench на 9.5 пункта

Автор вскрыл исходники трёх кодинг-агентов и сравнил архитектурные решения с собственным agent-core: разница в результатах лежит не в модели, а в обвязке.…

habr_ai
18.07.2026 Релизы моделей

Simon Willison сделал детектор типичных LLM-фраз

Создатель Datasette и автор sqlite-utils запустил крошечный веб-инструмент, который выделяет в тексте десять характерных паттернов машинного слога — от…

simon_willison
18.07.2026 Бенчмарки

Kimi K3 показала лучший результат в бенчмарке Pelican

Moonshot AI анонсировала самую большую модель в открытом доступе — Kimi K3 на 2.8 триллиона параметров, и сразу выставила ценник уровня закрытых конкурентов.…

simon_willison

Дальше — в канале

Здесь 234 разбора — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.

Подписаться в Telegram