🚀 Gemini 3.8 Flash: три уровня рассуждений и дешевая генерация HTML 2 сентября Google выпустила Gemini 3.8 Flash, а Simon Willison обновил плагин llm-gemini до версии 0.34 с поддержкой уровней рассуждений low, medium и high. По данным Simon Willison, модель сразу начали использовать на практике: запрос «сделай мне крутую штуку в HTML» создал интерактивную страницу за 13 секунд и 1,8 цента. В этом же выпуске он добавил отрисовку HTML-блоков в markdown-svg-renderer через iframe в изолированной среде — код доработала Gemini 3.8 Flash, а не отдельная платформа для агентов. Уровни рассуждений позволяют выбирать между глубиной ответа, задержкой и стоимостью токенов, но источник не называет цены для каждого уровня. Сравнение сгенерированных пеликанов на high и Gemini 3.7 Flash показывает визуальную разницу, однако формальных тестов в посте нет. Отдельно: вариант 3.8 Flash Cyber доступен только «проверенным специалистам по защите», обычному разработчику его не получить. Обновление также исправляет запись фактической версии модели в асинхронных ответах — с виду мелочь, но без неё нельзя разобраться, какая именно версия ответила на запрос. Линейка Flash выигрывает не качеством рассуждений, а экономичностью: при небольшой генерации HTML/JS качество уже достаточно, а стоимость и скорость важнее. Платить за high thinking там, где хватает готового ответа, — всё равно что поднимать сервер ради одной страницы. #Gemini #Flash #llm #SimonWillison #Google