В доступе MiniMax M2.7, GLM 5.1, Kimi 2.5, DeepSeek 3.2, GPT-OSS-120B, Sarvam-M и куча подобного. Можно подключить в OpenClaude, OpenCode, Zed IDE, Hermes agent и даже в Cursor IDE.
Чтобы настроить, следуйте этим инструкциям:
🛑Получаете API-ключ тут
🛑Все запросы к API по этому base_url: integrate.api.nvidia.com/v1
🛑api_key = "$NVIDIA_API_KEY"
🛑Выбираете модель
Логика почему они так сделали простая: они берут открытые модели и ускоряют под свои видеокарты с помощью своей технологии TensorRT-LLM. Затем, бесплатно запускают эти быстрые версии у себя в облаке на DGX(мощные сервера).
Дальше, когда твоей проект вырастет и понадобится много запросов – кончаются лимиты, и тогда либо платить нвидиа через их облако, либо скачать готовый микросервис NIM и запустить его на своей видюхе.
Так нвидиа привлекает кучу разрабов, собирает данные как используют модели и делают вас зависимыми. А не пофиг ли? 😁
📱 Youtube | 💬Чат | 📱 Канал
