TGViewer
ProКонтент и маркетинг ProКонтент и маркетинг @procontentplus · 1.33K subscribers
Post #975 540
Тут незаметно произошел технологический рывок в нейросетях

На изображении представлена презентация Taalas HC1 — специализированного чипа (ASIC). Коротко:

Рекордная скорость: Стартап Taalas (Торонто, Канада) представил чип HC1, который выдает невероятные 17 000 токенов в секунду на модели Llama 3.1 8B. Для сравнения, топовый Nvidia H200 выдает около 230-300 токенов в тех же условиях.

«Модель в кремнии»: В отличие от видеокарт, HC1 не «запускает» модель, а буквально содержит её веса, «вытравленные» прямо в транзисторах (hardwired). Это устраняет главную проблему современных вычислений — задержку при передаче данных между памятью и процессором.

Экономика: Заявлено, что чип в 20 раз дешевле в производстве и потребляет в 10 раз меньше энергии, чем решения от Nvidia. Стоимость генерации 1 млн токенов на HC1 оценивается всего в 0.75 цента.

Доступность: Компания уже запустила демо-чат на базе этого чипа (chatjimmy.ai), где пользователи могут лично убедиться в мгновенном ответе нейросети.

Комментарии экспертов и аналитиков:

1. Проблема гибкости vs Эффективность
Эксперты (например, с Hacker News и Reddit) отмечают, что главный минус — нулевая гибкость. Если вы захотите запустить другую модель, вам придется покупать новый чип. Однако Taalas утверждает, что их процесс проектирования позволяет создать чип под новую модель всего за 2 месяца, что сопоставимо с циклом обновления ПО в крупных корпорациях.

2. Технологический прорыв в архитектуре
Аналитики из EE Times подчеркивают, что Taalas вернулся к принципам «структурированных ASIC». Они объединили логику и хранение данных на одном кристалле с плотностью DRAM. Это позволяет обходиться без дорогой и дефицитной памяти HBM, жидкостного охлаждения и сложных систем межсоединений.

3. Будущее «разумных» агентов
Саймон Уиллисон (известный разработчик и эксперт) отмечает, что такая скорость (17k токенов/сек) делает бессмысленными привычные чат-интерфейсы, так как текст генерируется быстрее, чем человек успевает моргнуть. Это открывает путь к ИИ-агентам, которые «думают» и действуют в реальном времени, не заставляя пользователя ждать.

4. Скепсис по поводу масштабирования
Некоторые специалисты указывают на сложность упаковки больших моделей (например, Llama 400B или DeepSeek 671B) в такую архитектуру. Для модели на 671 млрд параметров потребуется синхронная работа около 30 чипов HC1, что может частично нивелировать преимущество в энергопотреблении и простоте.
  • 🔥 15
More from @procontentplus
  1. Sep 29, 2026Мой товарищ Данила Гулин сделал плеер для режиссеров, монтажеров и продюсеров. Можешь став…
  2. Sep 28, 2026Наконец-то я могу показать наш проект с Т-Банком. Правда в СМИ про нас почти ничего не ска…
  3. Sep 28, 2026Потому что польза – это измеримая вещь. Когда вы не можете справиться с настройкой бытовой…
  4. Sep 28, 2026Автор: olga.karatsuba
  5. Sep 27, 2026Например: большинство людей на уровне стереотипа считают, что женщины — более плохие водит…
  6. Sep 27, 2026Еще один пример. Человек случайно использовал тип конфликта «Наброс на третий объект», и п…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →