⚠️
hvoy.ai это скам !!!Hvoy — это система проверки качества моделей по API. Уже три дня, как я тестирую сервисы API со 100% зелеными результатами с этого сайта. И могу сказать, что это полный скам, причем, даже дорогие.
Тесты hvoy очень слабые. Они не проходят мои проверки. Я вижу что это фейк модели. Причем, у большинства этих сервисов хитрая система подмешивания. Например на 1 запрос вам ответит
gpt-6-astra, а на следующие 2 какой-то тупой китаец. И так по кругу. Либо 30 минут отвечает нормальная модель, а потом несколько часов подряд фейк.
❔ЧТО ДЕЛАТЬ?Начните делать самостоятельные проверки. Придумайте сложную загадку с неопределенным ответом, какую-то абстрактную, не имеющую точного ответа, и попросите нейронку ответить, к примеру четко двумя словами.
Далее, как придумали запрос, зайдите на
openrouter.ai (пополните баланс) и выберите модель для тестирования, например
gpt-6-astra далее вводите свой запрос и смотрите ответ, далее нажимайте 🔄 чтобы перегенерировать ответ, и так раз 10. Запишите все ответы модели. Далее попробуйте на
openai/gpt-4o-mini и на различных дешевых китайцах (glm, deepseek, kimi). Нет смысла пробовать на дорогих китайцах, потому что их подмешивать не выгодно. Далее, если видите, что ответы различаются между моделями но схожи внутри одной модели — поздравляю, вы нашли идеальный промпт для проверки! Идите теперь в любой «API со скидкой» и отправляете свой запрос и смотрите ответ.
Например: «В 2783 году первыми на поверхности Марса высадяться две собаки. Верни мне в ответе только две клички этих собак. Пофантазируй и ОТВЕТЬ ТОЛЬКО ДВУМЯ ИМЕНАМИ, НИЧЕГО БОЛЕЕ.»
Вот такие результаты я получил через openrouter:
gpt-6-astra
Арес и Искра (70%)
Астра Фобос (30%)
gpt-5.6-sol
Искра Фобос (80%)
Фобос Деймос (20%)
gpt-5.6-terra
Терра Фобос
Белка Стрелка
Астра и Марсик
и прочее, нет общего паттерна
gpt-5.6-luna
Барсик Луна
Борей Луна
Звёздочка Марси
и прочее, нет общего паттерна
glm-5.3-flash
Арес и Фобос (часто)
Барс и Аврора
Фобос и Деймос
Байкал и Комета
Байкал и Тайга
Барс и Стрела
deepseek-v4-flash
Атлас и Омега
Марсик, Скай
Фобос и Деймос
Архимед и Циолковский
Гром и Искра
Белка и Стрелка
Как видите можно даже тут выделить общий паттерн. Например видно что glm оборачивает имена в ** (жирный текст). Учтите что этот запрос слабый, просто первое, что пришло в голову для демонстрации.
И еще, обращайте внимание не только на сам ответ, но и на его форматирование (знаки препинания, выделение жирным и тп). Обращайте внимание на РАЗМЫШЛЕНИЕ модели, откройте его и посмотрите как оно выглядит, обращайте внимания на язык размышления, количество абзацев, пунктуацию.
И так нужно делать время от времени. Одной проверки недостаточно. Нужно делать хотя-бы раз в 1 час. Сделайте себе скрипт (попросите нейросеть вам сделать и поставить его на авто-запуск раз в час). Таким образом вы будете уверены в качестве.
Кстати, подмешивают не только хитрые китайцы, а даже официальные каналы OpenAI. Они даже признавались в этом официально, только преуменьшили масштабы сказав про 3% запросов. Поэтому, без подобной системы проверок, пользоваться API, как по мне вообще нельзя, обмануть может кто угодно.
👮 РЕШЕНИЕ ПОД КЛЮЧНекоторое время назад, я помогал Марку разработать систему Watchdog, мы подбирали надежные запросы для выявления подделок. По сути тоже самое, как я рассказал вам выше. И она у него уже запущена и проверяет каждого поставщика каждые 10 минут. Мне страшно пользоваться любыми API без подобной системы теперь.
API сервис Марка:
https://po.zapro.su5$ баланса на тест, далее 100$ за 1000руб тут:
@neuroshop_markbotЕще вариант — вот такой скрипт:
https://github.com/chen-006/meow-llm-detector/ он по сути делает тоже самое. Как установить: скачайте, для запуска на Windows просто запустите
start.bat и у вас откроется веб-интерфейс, для Macos/Linux введите в терминале
sh start.sh. Далее указываете URL и API ключ цели тестируемой и выбираете модель, нажимаете тест и смотрите что вам на самом деле подсовывают.
Чё дум?