Мы делимся советами, как применять нейросети в работе, учёбе, творчестве и быту. Присоединяйтесь, если хотите работать продуктивнее! Проект ведёт АНО «Развитие технологий искусственного интеллекта».
Обратная связь: @AI_Lifehacks_bot
Чат: @neurocup1chat
Post #1462
77
🤖 ИИ ускорился: новые агенты, голос за 0,8 секунды и видео в реальном времени
ИИ-агент сам провёл эксперимент по машинному обучению, голосовой ИИ научился отвечать за 0,8 секунды, а новые модели получили инструменты для работы с видео, кодом и музыкой.
Собрали главное за неделю 👇
📌 Hugging Face запустил ML Intern
ИИ-агент может пройти почти весь цикл эксперимента по машинному обучению по одному текстовому запросу. Он сам ищет модели и датасеты, готовит данные, запускает обучение, исправляет ошибки, следит за ресурсами и разворачивает готовое демо.
📌 Krea Agents - агентная система для генерации контента
Krea объединила генеративные модели и инструменты в одном интерфейсе. Агент работает с файлами проекта, умеет публиковать медиа в соцсетях и подтягивать мудборды из Pinterest - подключать отдельные API и MCP не требуется.
📌 Cognition представила модель SWE-2
Новая кодинг-модель обучена на базе Kimi K3 и рассчитана на длительные задачи разработки. SWE-2 показывает сильные результаты во фронтенде, работает дешевле предыдущей версии и начинает вносить изменения в код раньше, чем SWE-1.7.
📌 Black Forest Labs - FLUX Video Edit
Модель редактирует готовые видео по текстовому описанию. Можно менять отдельные объекты, композицию, движение камеры и тайминги, а также подгонять липсинк под новый дубляж без изменения хронометража.
📌 Google представила Gemini 3.8 Live и Live Extended Thinking
Модели поддерживают 97 языков, понимают видео и изображения с камеры и могут вызывать инструменты прямо во время разговора. Extended Thinking позволяет рассуждать и говорить одновременно, выполняя сложные задачи в фоне.
📌 OpenAI выпустила API для GPT-Live-1
Голосовая модель слушает и отвечает одновременно, а задержка реакции снизилась с 1,4 до 0,8 секунды. GPT-Live-1 умеет обрабатывать перебивания и продолжать вычисления в фоне, пока пользователь говорит.
📌 Sakana AI представила Fugu Max и Fugu Ultra v2
Новые ИИ-оркестраторы объединяют несколько моделей и выбирают подходящий инструмент под конкретную задачу. Fugu Max заявлена как система, которая позволяет получать высокое качество при стоимости в 2-6 раз ниже ведущих моделей.
📌 ElevenMusic обновилась до версии 2.5
Генератор стал лучше работать с инструментами, сложными аранжировками и естественными мелодиями. Пользователь получил больше контроля над звуком и отдельными стемами, а бесплатная версия позволяет скачивать до пяти треков в день.
💡 ИИ становится быстрее, самостоятельнее и берёт на себя всё больше задач - от обучения моделей и написания кода до голоса, видео и музыки.
Сохраняйте дайджест, чтобы не потерять главные обновления недели 📱
💙 АНО РТИИ в MAX
ИИ-агент сам провёл эксперимент по машинному обучению, голосовой ИИ научился отвечать за 0,8 секунды, а новые модели получили инструменты для работы с видео, кодом и музыкой.
Собрали главное за неделю 👇
📌 Hugging Face запустил ML Intern
ИИ-агент может пройти почти весь цикл эксперимента по машинному обучению по одному текстовому запросу. Он сам ищет модели и датасеты, готовит данные, запускает обучение, исправляет ошибки, следит за ресурсами и разворачивает готовое демо.
📌 Krea Agents - агентная система для генерации контента
Krea объединила генеративные модели и инструменты в одном интерфейсе. Агент работает с файлами проекта, умеет публиковать медиа в соцсетях и подтягивать мудборды из Pinterest - подключать отдельные API и MCP не требуется.
📌 Cognition представила модель SWE-2
Новая кодинг-модель обучена на базе Kimi K3 и рассчитана на длительные задачи разработки. SWE-2 показывает сильные результаты во фронтенде, работает дешевле предыдущей версии и начинает вносить изменения в код раньше, чем SWE-1.7.
📌 Black Forest Labs - FLUX Video Edit
Модель редактирует готовые видео по текстовому описанию. Можно менять отдельные объекты, композицию, движение камеры и тайминги, а также подгонять липсинк под новый дубляж без изменения хронометража.
📌 Google представила Gemini 3.8 Live и Live Extended Thinking
Модели поддерживают 97 языков, понимают видео и изображения с камеры и могут вызывать инструменты прямо во время разговора. Extended Thinking позволяет рассуждать и говорить одновременно, выполняя сложные задачи в фоне.
📌 OpenAI выпустила API для GPT-Live-1
Голосовая модель слушает и отвечает одновременно, а задержка реакции снизилась с 1,4 до 0,8 секунды. GPT-Live-1 умеет обрабатывать перебивания и продолжать вычисления в фоне, пока пользователь говорит.
📌 Sakana AI представила Fugu Max и Fugu Ultra v2
Новые ИИ-оркестраторы объединяют несколько моделей и выбирают подходящий инструмент под конкретную задачу. Fugu Max заявлена как система, которая позволяет получать высокое качество при стоимости в 2-6 раз ниже ведущих моделей.
📌 ElevenMusic обновилась до версии 2.5
Генератор стал лучше работать с инструментами, сложными аранжировками и естественными мелодиями. Пользователь получил больше контроля над звуком и отдельными стемами, а бесплатная версия позволяет скачивать до пяти треков в день.
💡 ИИ становится быстрее, самостоятельнее и берёт на себя всё больше задач - от обучения моделей и написания кода до голоса, видео и музыки.
Сохраняйте дайджест, чтобы не потерять главные обновления недели 📱
💙 АНО РТИИ в MAX
- ❤ 1









