TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
117
Photos
459
Videos
126
Links
972

Showing posts older than #1500 · Back to latest

Older Posts 20 shown
Post #1499 50
Post #1498 49
Действительно, стелс-модель 0хАльфа оказалась GLM-5.3 Flash.

Я ее попробовал, пока была бесплатной. Честно говоря, не могу сказать, что впечатлен, мне показалось, DeepSeek v4 Flash лучше..
Хотя и бенчи показывают другое. Но можно ли им верить..

https://t.me/lovedeathtransformers/10992
Telegram Love. Death. Transformers. https://huggingface.co/zai-org/GLM-5.3-Flash flash means 320b this days - китайские лабы жестко фитятся под АА и бенчи - не стоит ждать чудес, модель умная но там где ее учили(как и все модели)
Post #1497 53
Было ожидаемо, что цены на мак мини и мак студио вырастут, но это жесть, конечно. Локальную нейронку хочется, но отдавать за нее лям, ну или 300 за квен на 27В как-то жалко. Жена не поймет ))

https://t.me/data_secrets/9767
Telegram Data Secrets Apple выпустили M6 и M5 Ultra Цены сильно выросли, но приросты в метриках есть. M6 – базовый чип, 12-core CPU, 12-core GPU, сдвоенный 16-core Neural Engine, до 32 ГБ unified memory, до 170 ГБ/с bandwidth. По цифрам Apple до 4.8x быстрее prompt processing…
Post #1496 43
Post #1494 39
Post #1493 42
Если интересуетесь разговорными агентами, например, для организации службы поддержки, посмотрите на Grok Voice Think Fast 2.0 - видимо, это новая SOTA

И, кстати, все в восторге от Grok Bot - скоро начнется его массовое копирование на других платформах
x.ai Introducing Grok Voice Think Fast 2.0 Introducing our most capable speech-to-speech voice model.
Post #1492 42
Видимо, скоро нас ждет Haiku 5 и еще одна новая модель. С хайку давно пора что-то делать, да и Соннет вышел совсем неудачным - вместо дешевых моделей Антропика я использую GLM, DeepSeek или GPT Luna.
Post #1491 42
Пошел слушок, что новый мак мини запустят в сентябре. У Apple были планы в младшую версию ставить М6 - это интересно, но самое интересное для меня, сколько будут стоить большие версии, на которых можно гонять Qwen 3.8 27B и DeepSeek v4 Flash..
Post #1490 43
very vibe coding Завтра вечером сбросят лимиты Кодекса, так что можно сегодня гонять gpt на максималках
Сбросили, как и обещали ))
Post #1489 53
В твиттере уже какое-то время прогревается история про модель SubQ, которая обещает решить проблему квадратичного масштабирования контекста, а значит, помимо длинны конекста, еще и скорости и цены токенов. Сейчас открыли запись на тестирование модели. И если это действительно прорыв, думаю, скоро мы все об этом услышим. Это может быть действительно геймченжером
Post #1488 58
Завтра вечером сбросят лимиты Кодекса, так что можно сегодня гонять gpt на максималках
Post #1487 53
very vibe coding Чудес не бывает. Новая моделька, которая бесплатно лежит на опенроутере, работает, но есть впечатление, что это маленькая модель. Условно, GLM Flash. На фронтир не тянет и далеко. С другой стороны, дареному коню в зубы не смотрят, есть задачки и для таких…
Ну да, все больше свидетельств, что бесплатная модель в опенроутере - GLM 5.3 Flash. Конечно, ни с каким Sol она не конкурирует. Главный конкурент DeepSeek V4 Flash. Думаю, именно это заставило Дипсик мальца сбросить цены.

Эти модели интересны тем, что на них можно посадить несложные рутинные задачи или такие вещи как построение онтологий и графов. Маленькие модели не справляются, большие - дорого.

У меня сейчас подписка на GLM за $60 - в принципе, GLM 5.3 нормальная модель, использую ее, но токенов маловато - OpenAI щедрее, их подписка в этом плане самая большая. Думал снизить лимит до $20, но посмотрю на флэш и там буду решать.

PS. Использую разные модели для проверки друг друга - нравится мне эта тема, разные нейронки находят разные ошибки
Post #1486 47
Post #1485 41
very vibe coding Кто бы это мог быть? Я как раз высадил лимиты Клода (сколько ни заливай бабок, все на лимите сидишь), гпт тоже наполовину опустошил - а впреди еще 5 дней.. Ну и кстати, у Клода это типа на 50% увеличенный до 31 августа лимит... Вернусь пробежки, потестирую…
Чудес не бывает. Новая моделька, которая бесплатно лежит на опенроутере, работает, но есть впечатление, что это маленькая модель. Условно, GLM Flash. На фронтир не тянет и далеко. С другой стороны, дареному коню в зубы не смотрят, есть задачки и для таких моделей…
Post #1484 41
Попробовал в Клоде команду /doctor - сделал вывод, что харнесы для поддержания своих скриптов в порядке, чистка памяти и пр. как отдельный скилл не нужны - надо просто раз в неделю запускать доктора и все будет хорошо.
Post #1483 42
DeepSeek Pro может и хорошая модель, и харнесс интересный, но на уровне МАХ размышляет она бесконечно. 20 мин на две реплики, там, где Клод справляется за минутку, это, конечно, кого угодно из себя вывести может. Для тех, кто никуда не торопится

PS. Попросил решить проблему в настройках DeepSeek Harness - 3 вопроса, 40 минут - 1,17$. Проблема не решена. Спасибо, больше не надо..
Post #1482 42
Кстати, если захотите задешево попрограммировать - есть моделька от Меты - Спарк 1.2, которую можно гонять по $0,2 за выходящий токен (по цене DeepSeek Flash). Нюанс один - все данные отдаются Мета для обучения. В общем, не жалко - кого только можно обучить на таких данных? )) Разве что вайбкодера..

https://openrouter.ai/meta/muse-spark-1.2-contributor

Любопытно, что Qwen3.8 27B стоит в инференсе 3 доллара - и вот этого я не понимаю, тот же DeepSeek Flash, который почти в 10 раз больше размером стоит в 10 раз дешевле. Какая-то странная экономика..

Ну а в экономику ИИ лучше всего раскрывают в этом видосике. Порадовали..
openrouter.ai Muse Spark 1.2 Contributor - API Pricing & Providers Muse Spark 1.2 contributor tier is a reasoning model from Meta designed for developers who want to start building at an even lower cost. $0.10 per million input tokens, $0.20 per million output tokens. 1,048,576 token context window.
Post #1481 41
Post #1480 45
Кто бы это мог быть?

Я как раз высадил лимиты Клода (сколько ни заливай бабок, все на лимите сидишь), гпт тоже наполовину опустошил - а впреди еще 5 дней..

Ну и кстати, у Клода это типа на 50% увеличенный до 31 августа лимит...

Вернусь пробежки, потестирую

https://t.me/vibecoding_tg/3719
Telegram Вайб-кодинг В OpenCode и OpenRouter появилась загадочная новая ИИ-модель: Ox Alpha 👍 Ее уже прогнали через 10 задач DeepSWE, и она набрала больше 80% против 65% у Fable и 52% у GPT-5.6 Sol. Модель предлагает контекстное окно на 1 млн токенов, мультимодальные возможности…
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →