Yupp: удобно сравнивать две ИИ-модели, но есть нюансы — оценка по 4К+
(аудио версия в первом комментарии)
Разобрал проект по своей системе: команда, концепт, коин, код + практика.
Использую Yupp, когда нужно сравнить ответы двух моделей — например, ChatGPT 5.2 и Claude Sonnet 4.6.
Доступно более 800 моделей. Теперь проблема не в отсутствии выбора, а в его избытке 🙂.
Конечно проект вряд ли удастся использовать для вайдкодинга или OpenClaw ассистента (нет API), но для задач в веб интерфейсе - вполне.
Читать в Teletype, читать в Paragraph.
Запустить приложение.
Общий итог
• Команда: 5 из 5: публичны и являются профессионалами (есть ссылка на LinkedIn), Соцсети активные. на вопросы отвечают и корректно. Радует, что дадут мне поинты за фидбек по доступности!
• Концепт: 3 из 5: нет официальной документации. Пришлось пользоваться ИИ-моделями Manus, Parallel и Chat GPT для сверки.
Есть технические подробности, но они больше продуктовые, чем протокольные. Проект централизованный - это минус. Но концепт интересный: проект уникальный, и даже я пользуюсь для некритичных данных
Это не просто агрегатор моделей, а платформа с пользовательской оценкой ответов ИИ и экономикой вознаграждений.
• Коин: 3 из 5: по данным Cryptorank, инвестиции 33 МЛН $
Среди инвесторов - известные фонды. Например, Andreessen Horowitz (a16z crypto), Coinbase Ventures (всего 33).
Но токеномики и ютилити токена будущего нет. Неизвестно вообще, будет ли он.
Хорошо, что есть уже рабочая экономика. Минус - она построена на раздаче вознаграждений (credits, конвертируемых в деньги), то есть на постоянном предложении.
При этом мне неизвестен устойчивый источник спроса или выручки, который бы балансировал эти выплаты.
• Код: 1 из 5. Он закрыт.
• Практика: 4 из 5: удобный, функциональный и полезный интерфейс. Много раз ответы помогали. Но вот получить награды мне незрячему невозможно: требуют после "Reveal reward" сделать "Scratch card", а это мне недоступно. Код от Chat GPT для выполнения действия из анбординга не подошёл...
Всего: 16 из 25. Это выше среднего среди проектов, которые я анализировал за последнее время. Но когда исправят доступность интерфейса полностью, будет уже 17 из 25. Надеюсь, это произойдёт скоро.
Риски (моё мнение)
1. Качество датасета зависит от качества пользователей
2. Финансовые стимулы могут привести к спаму, фарму и попыткам манипулировать предпочтениями (например, через ботов или массовое координированное участие).
3. Даже при заявленном фокусе на приватность, это централизованный сервис, поэтому чувствительную информацию лучше не вводить.
4. Платформа зависит от внешних провайдеров моделей и их API/ценовой политики, поэтому доступность некоторых моделей и стоимость credits могут меняться со временем.
Читать в Teletype, читать в Paragraph.
Запустить приложение.
Мнение:
Я использую, но без данных, требующих соблюдения приватности.
А вы сравниваете модели? Используете ли несколько из них, и если да, в каких задачах?
P. S. Обратите внимание на концепт: в этот раз не всю аналитику, но часть проводил с помощью описанных в понедельник ИИ-инструментов.
😎 Незрячий web3 программист (подписаться)
Чат | бот
Post #1595
616
- 👍 12
- 🔥 7