TGViewer
Channel Public Channel
AI for Devs

AI for Devs

@ai_for_devs

По сотрудничеству пишите в личные сообщения канала.

Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.
Subscribers
17.2K
Photos
399
Videos
121
Links
360

Showing posts older than #553 · Back to latest

Older Posts 10 shown
Post #552 10.7K
⚡️ Qwen3.8-27B запускается локально и местами обходит Opus 4.6

Alibaba открыли веса Qwen3.8-27B. В одном из тестов на агентное программирование результат вырос более чем втрое по сравнению с Qwen3.6-27B.

По совокупности тестов новинка оказалась сильнее даже предыдущей облачной Qwen3.7-Plus.


В отдельных задачах по программированию она показывает результаты выше Opus 4.6, хотя всё ещё уступает некогда флагману в сложных рассуждениях и работе с терминалом.

Облегчённая версия от Unsloth занимает около 17 ГБ: её можно запустить на Mac с Apple Silicon или видеокарте с 24 ГБ памяти.

@ai_for_devs
  • 🔥 75
  • 👍 28
  • ❤ 12
  • 🤩 5
Post #549 12K
⚡️ Google выпустили Gemini 3.7 Flash

Последнюю Pro-модель Google выпустили ещё 19 февраля. Зато с тех пор успели зарелизить уже три Flash подряд: 3.5, 3.6 и 3.7.

По coding-бенчмаркам 3.7 Flash примерно на уровне GPT-5.6 Terra и в среднем немного лучше Sonnet 5. На DeepSWE — 65.3% против 69.6% у Terra и 53.8% у Sonnet, на FrontierCode уже обходит обе: 43.6% против 41.3% и 42.7%.


До конца года стоимость $0.75/$3.75 за миллион токенов (input/output). Это в 2.7 раза дешевле Sonnet 5 по output и больше чем в 3 раза дешевле Terra.

Контекст 1M, модель уже доступна через API, в AI Studio и Antigravity.

@ai_for_devs
  • 🔥 43
  • 👍 22
  • ⚡ 7
  • ❤ 4
Post #548 11.3K
⚡️ DeepSeek поднимают цены на API до 12 раз

С 16 августа DeepSeek вводят часы пик. В это время API будет стоить вдвое дороже, чем в остальные часы. Сами базовые цены тоже выросли.

Генерация V4 Flash подорожает с $0,28 до $0,66–1,32 за миллион токенов, V4 Pro — с $0,87 до $1,98–3,96.

Сильнее всего досталось кэшированному входу V4 Pro: вместо $0,003625 придётся платить $0,022 вне часов пик и $0,044 в часы пик. Это в 6–12 раз дороже.


Эпоха почти бесплатного DeepSeek подошла к концу.

@ai_for_devs
  • 🤯 95
  • 👍 19
  • ⚡ 8
  • 🔥 4
  • ❤ 2
Post #545 13.3K
⚡️ Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol

Технически внутри та же GLM-5.2: без нового претрейна и архитектуры, просто ещё месяц RL на длинных инженерных задачах DeepSWE вырос с 46,2% до 66,9%, Terminal-Bench 3.0 с 4,6% до 28,3%.

На Terminal-Bench 3.0 новинка обошла Kimi K3 и Opus 4.8, но не дотянула до Fable 5 и GPT-5.6 Sol.

Начиная с GLM-5.2 команда проверяла реальные кодовые базы несколькими своими моделями и нашла 2436 уязвимостей в 269 проектах; какие именно версии участвовали, Z.ai не уточняет.


GLM-5.3 уже раскатили в Coding Plan от $18/мес, а веса обещают через две недели; цены API за токены пока нет.

@ai_for_devs
  • 🔥 44
  • 👍 23
  • ❤ 7
  • 🤯 5
  • ⚡ 2
Post #544 10.3K

This post (sticker, poll or similar) has no web preview. Open in Telegram

  • 👍 42
  • 🔥 20
  • ❤ 9
  • 🤩 4
Post #543 9.47K
Ждём первый рэп-кодинг баттл 🤣
  • 😁 118
  • 🤣 30
  • 👍 13
  • ❤ 5
  • 🔥 3
Post #540 10.8K
⚡️ DeepSeek обновили V4 Pro

Китайцы выкатили V4 Pro 0813: большое обновление апрельской Preview-версии модели, которое уже заменило старую модель в API.

После нового пост-тренинга почти все агентные бенчмарки заметно выросли: Terminal Bench поднялся с 72,1 до 87,9, вплотную к Kimi K3 и Fable 5 и выше Opus 4.8.

На DeepSWE результат вырос почти в пять раз: с 12,8 до 62,7. На бенчмарке от Code Arena новинка получила 1607 баллов и попала на Pareto frontier — сопоставимые по качеству модели стоят в разы дороже.


Цена тоже не изменилась: $0,435/$0,87 за миллион токенов. Веса модели пока что не опубликовали.

@ai_for_devs
  • 👍 46
  • 🔥 28
  • ⚡ 13
  • ❤ 10
  • 🤯 2
Post #537 8.77K
⚡️ xAI выпустили Grok 4.6: модель сравнялась с GPT-5.6 Sol

В CursorBench Grok обошёл GPT-5.6 Sol: 69,9% против 67,2%.

Но на DeepSWE и Terminal-Bench GPT пока заметно впереди: 73% против 65,9% и 34,6% против 26%.

Цена $2 за миллион входных и $6 за миллион выходных токенов. Fast-версия вдвое дороже, а первую неделю в Cursor и Grok Build дают двойные лимиты.


Модель уже доступна в Cursor, Grok Build, API и OpenRouter.

@ai_for_devs
  • 👍 44
  • 🔥 25
  • 🤯 11
  • ❤ 5
  • ⚡ 2
Post #534 9.07K
⚡️ SpaceXAI выпустили Grok Bot: мессенджер для взаимодействия с AI-агентами

Боты работают на облачном компьютере: входят в приложения и на сайты, используют сохранённые сессии и выполняют задачи.

Можно запустить несколько агентов параллельно. Они обмениваются контекстом, передают друг другу задачи и продолжают работать при выключенном компьютере.


Grok Bot работает на инфраструктуре Cursor и доступен по подписке Cursor Ultra за $200 в месяц.

@ai_for_devs
  • 👍 24
  • 🔥 22
  • ❤ 4
  • ⚡ 2
  • 🤯 2
Post #532 8.48K
⚡️ NVIDIA представили Nemotron 3.5 Lightning, быструю локальную модель

В тестах самой NVIDIA новинка уступила Qwen3.6 и Gemma 4. Недавно представленная Muse Glimmer, которая идёт примерно на уровне Qwen, тоже выглядит сильнее.

Зато козырь Lightning это скорость: на большой очереди типовых задач она справилась с работой на 30% быстрее Qwen при сопоставимом качестве.


Веса модели занимают около 20 ГБ. В OpenCode модель сейчас доступна бесплатно.

@ai_for_devs
  • 🔥 32
  • 👍 18
  • ❤ 8
  • ⚡ 4
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →