Чем живёт AI-сообщество сегодня:
Конвертер PDF, EPUB и DOCX в аудиокниги на базе Qwen3 TTSОткрытый инструмент для создания качественных аудиокниг с использованием Qwen3 TTS — модели синтеза речи с поддержкой клонирования голоса.
Приложение распознаёт эмоции на лице и подбирает подходящий мемРепозиторий определяет выражение лица пользователя и находит соответствующий известный мем.
Универсальный процессор контента для NotebookLMClaude Skill для обработки статей WeChat, веб-страниц, YouTube, PDF, Markdown и поисковых запросов с генерацией подкастов, презентаций, интеллект-карт и квизов.
Voice Clone Studio — веб-интерфейс для клонирования голосаWeb UI на Gradio для клонирования и дизайна голоса на основе Qwen3-TTS и VibeVoice с автоматической транскрипцией через Whisper или VibeVoice-ASR.
Claude Code Skill для исследования тем в Reddit и X за последние 30 днейИнструмент исследует любую тему в Reddit и X за последний месяц и генерирует готовые промпты для копирования.
Релиз Qwen3-TTS: ультранизкая задержка 97 мс и клонирование голосаОткрытая модель синтеза речи с задержкой около 97 мс, поддержкой клонирования голоса, многоязычности и OpenAI-совместимым API для локального развёртывания.
100% клиентский AI-агент играет в Pokemon Red на Qwen 2.5 1.5BПолностью клиентское приложение на Svelte использует Qwen 2.5 1.5B через WebLLM и policy-сеть на TensorFlow.js для игры в Pokémon Red.
Фикс KV cache для GLM 4.7 Flash снижает потребление VRAMУдаление компонента "V" из KV cache резко сокращает использование видеопамяти и позволяет работать с гораздо более длинными контекстами.
GLM-4.7-Flash-REAP на RTX 5060 Ti 16 ГБ с контекстом 200k токеновБенчмарк GLM-4.7-Flash-REAP на RTX 5060 Ti с данными о скорости обработки токенов для контекстов от 16k до 200k, CPU MoE offload и оптимизациями llama.cpp.
Какие функции нужны в приватном AI-чате на телефоне?Zerotap собирает обратную связь о ключевых возможностях для приватного AI-чата на устройстве с возможностью управления Android-телефоном.