По сотрудничеству пишите в личные сообщения канала.
Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.
Post #470
12K
AI @ai_for_devs
Showing posts older than #471 · Back to latest

Цены: $2 за млн входных и $10 за млн выходных токенов до 31 августа, с 1 сентября $3/$15.
Обновили токенайзер, входные тексты занимают на 0–35% больше токенов, чем в предыдущих версиях.

Макс отметил, что данные Cursor добавили уже после основного этапа (это менее эффективно, чем с нуля). В следующей версии на 2T параметров они войдут с самого начала.





Ключевое сравнение с Mythos (Fable 5) от Anthropic идёт по кибербезопасности. На ExploitBench Sol тянется к Mythos Preview, расходуя при этом примерно треть выходных токенов.

Низкую цену объясняют тремя источниками:
1. Массовая регистрация аккаунтов: бесплатные $5-кредиты Anthropic, чужие неиспользованные квоты, скидки для студентов, деление одной подписки Max за $200 между несколькими пользователями.
2. Подмена моделей: аудит немецкого центра CISPA проверил 17 прокси и обнаружил, что запрос к «Gemini-2.5» через прокси показывал 37% на медицинском бенчмарке вместо 83,82% у официального API. То есть по сути продают не Claude, а свои дешевые локальные модели.
3. Третий источник, по словам самих китайских разработчиков, главный: логи запросов и ответов, которые можно продать для обучения других моделей. Данные дороже кода, это нам давно известно.
TL;DR: Loop Engineering реален, но большинству разработчиков он пока не нужен.

Первые 30 дней бесплатно, затем оплата подписки в рублях. Есть 3 тарифа:
1. Сообщество — бесплатный. Подключаешь свой API-ключ и пробуешь все функции плагина без ограничений.
2. Персональный — 2 800 ₽/мес. 200 минут работы с топовыми моделями по единой цене.
3. Профессиональный — 10 000 ₽/мес. 1000 минут, приоритетный доступ, минута работы модели дешевле — 10 ₽ против 14 ₽ у «Персонального».

В отличие от Cerebras, которые делают один гигантский кристалл с памятью прямо на чипе (на котором GPT-5.3-Codex-Spark выдаёт больше 1000 ток/с), Jalapeño — чип обычного размера.
Нужную мощность получают не размером кристалла, а количеством чипов: тысячи Jalapeño соединяют в кластер через сетевые чипы.



Недавно узнал, что Николай читает наш канал. Приятно, честно говоря!
И мы уверены, что у этой фичи есть предыстория. Ещё в мае Тарик Шихипар, инженер из команды Claude Code, рассказывал, что перешёл с Markdown на HTML.
Главная причина: у HTML куда больше возможностей визуализации, а красивые таблицы, SVG-диаграммы и интерактивные слайдеры люди воспринимают лучше обычного текста.
Видимо, каждый раз просить Claude сделать HTML ребятам поднадоело, и они решили избавить себя от лишних действий. Теперь подобный способ делиться результатами своей работы в Claude Code стал отдельной фичей продукта.



На тесте, где нужно связывать факты из разных частей текста, точность выросла с 95% до 99%.
Обычные модели сверяют каждое слово с каждым, поэтому вычислений с ростом текста становится непропорционально больше. SubQ выбирает только значимые связи и реально использует 0.13% всех пар слов, отсюда экономия на длинных задачах.
На контексте 1M токенов: вычислений в 64 раза меньше, чем у обычных моделей, ответ получают в 56 раз быстрее.