😑 Gemini 3.1 Flash-Lite и ChatGPT-5.3 Instant: маленькие, да удаленькие
➖ Google выпустил Gemini 3.1 Flash-Lite. По скорости 363 токена в секунду (GPT-5 mini выдает 71, Claude 4.5 Haiku – 108). На бенчмарке MMMU-Pro Flash-Lite прошла 100 вопросов за 4 минуты, Gemini 2.5 Flash потратил больше 33 минут.
➖ OpenAI обновили дефолтную модель GPT Instant до версии 5.3. Подопечные Альтмана не стали делать ацент на бенчмарки, вкинули тейк про ощущения: модель стала меньше отказывать, убрали лишние дисклеймеры и нравоучения. Галлюцинации снизились на 20-27% при поиске в вебе и на 10-20% без него.
Обе модели по бенчмаркам сильнее восточных аналогов сопоставимого размера. Но есть нюанс: и Flash-Lite, и GPT-5.3 Instant – это закрытые облачные модели. Запустить локально не получится.
Напомню, что на днях Alibaba выложили свои маленькие модели в open source. А с учётом того, что железо всё больше затачивается под локальный инференс маленьких моделей, open source выглядит всё перспективнее.
@ai_for_devs
Post #308
7.22K
- 👍 34
- ❤ 8
- ⚡ 7
- 🔥 3