Лента разборов
234 разбора · обновляется ежедневно
Джек Дорси создал Buzz — открытую альтернативу Slack с ИИ-агентами
Block Джека Дорски анонсировала Buzz — платформу для групповых чатов, где люди и AI-агенты работают в одном пространстве. По данным TechCrunch, Buzz…
Тестируем 11 видео-нейросетей: какая лучше справляется с деталями
Эксперимент с анимацией сложного семейного фото единым англоязычным запросом показал, что идеального сервиса для оживления пока нет. Разброс итоговых баллов —…
Как заставить LLM забыть опасные знания: обзор методов
Обзор, опубликованный 23 июня 2026 года, ставит под сомнение главную киберзащитную ставку индустрии — «забывание» нежелательных знаний в больших языковых…
Кодинг-агенты сделали обратную разработку домашних устройств экономически выгодной
Simon Willison фиксирует то, о чём последние месяцы говорят в личных разговорах: разработчики всё чаще используют кодинг-агентов, чтобы перехватывать API…
Технический долг никуда не исчез — просто платим теперь токенами
Сейчас модно говорить, что LLM и агенты снижают стоимость разработки: вместо найма инженеров компания жжёт токены, увеличивает контекстное окно, запускает…
Рой ИИ-агентов Cursor создал SQLite за тысячу долларов
Cursor провела эксперимент: сотни AI-агентов в течение четырёх часов писали на Rust совместимый с SQLite движок, опираясь только на документацию — без…
Qwen 3.8 Max: новая модель и вызовы для безопасности
Alibaba выложила Qwen 3.8 Max с открытыми весами — 2.4 триллиона параметров, почти как у Kimi K3 (2.8T). Это разворот на 180°: предыдущую версию, Qwen 3.7…
DocOCR-Eval: выбор OCR-движка без разметки и аннотаций
Распознавание текста на сканах — базовая операция для извлечения ключевой информации или ответов на вопросы по документу. Но подобрать OCR-движок или…
Письмо Альтмана 2022 года: открытая модель как оружие против конкурентов
В материалах иска Musk v. Altman (2026) всплыло письмо Сэма Альтмана к совету директоров OpenAI от 1 октября 2022 — его заметил и процитировал Simon Willison.…
ИИ эффективнее помогает при разработке новых систем, чем при модернизации старых
Когда разработчик начинает с чистого репозитория, AI-ассистенты впечатляют: контролируемый эксперимент 2023 года с 95 участниками показал, что GitHub Copilot…
Cura 1T: медицинская модель с циклом самоэволюции сохранила общие способности
15 июля 2026 года на arXiv появилась статья о Cura 1T — специализированной LLM для здравоохранения, охватывающей консультации пациентов, клинические…
Как нейросети влияют на критическое мышление пользователей
Автор — преподаватель математики — вспоминает лекцию о дистилляции нейросетей: простая модель, обученная на выходах сложной, никогда не станет умнее…
Китайские BCI обходят Neuralink не точностью, а скоростью выхода на рынок
Пока внимание приковано к роликам Neuralink с управлением курсором силой мысли, основной вектор развития интерфейсов «мозг-компьютер» сместился в Китай — и…
Половина компаний пострадала от инцидентов с AI-агентами
Агенты получают доступ к реальным системам и данным, а средства контроля за ними хронически отстают. По данным VentureBeat, опросивших 107 крупных…
Дайджест недели: главное в ИИ
Открытые модели нарастили параметры и мультимодальность, а агентские архитектуры — сконцентрировались на экономии LLM-вызовов и борьбе с деградацией на…
Как сохранить авторство кода, написанного ИИ
Продуктовый дизайнер Дмитрий Тогулев выпустил портфолио, где весь код отдал Claude Code, а основным вводом стала вебкамера — частицы на странице реагируют на…
Режимы reasoning effort в языковых моделях: как это работает
Себастьян Рашка разобрал механику управления «усилиями рассуждений» на примере GPT-5.6 и свежего открытого Inkling. Выбор low/medium/high в интерфейсе…
Как обвязка агента улучшила результаты на SWE-bench на 9.5 пункта
Автор вскрыл исходники трёх кодинг-агентов и сравнил архитектурные решения с собственным agent-core: разница в результатах лежит не в модели, а в обвязке.…
Simon Willison сделал детектор типичных LLM-фраз
Создатель Datasette и автор sqlite-utils запустил крошечный веб-инструмент, который выделяет в тексте десять характерных паттернов машинного слога — от…
Kimi K3 показала лучший результат в бенчмарке Pelican
Moonshot AI анонсировала самую большую модель в открытом доступе — Kimi K3 на 2.8 триллиона параметров, и сразу выставила ценник уровня закрытых конкурентов.…
Дальше — в канале
Здесь 234 разбора — листайте и проверяйте. Новое выходит каждый день и приходит в Telegram первым, со ссылкой на первоисточник.
Подписаться в Telegram