TGViewer
Channel Public Channel
Machinelearning

Machinelearning

@ai_machinelearning_big_data

Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Subscribers
279K
Photos
5.5K
Videos
1.3K
Links
5.9K

Showing posts older than #10602 · Back to latest

Older Posts 17 shown
Post #10601 27.3K
🚨 Moonshot AI выложила Kimi K3 на Hugging Face — 2,8 ТРИЛЛИОНА параметров в открытых весах.

Это первая open-weight модель класса ~3T. При этом благодаря MoE на каждом токене активируется 104 млрд параметров: 16 экспертов из 896. (Hugging Face)

Что внутри:

— контекст 1 048 576 токенов
— нативная работа с текстом и изображениями
— новая Kimi Delta Attention (KDA)
— Attention Residuals
— 93 слоя: 69 KDA + 24 Gated MLA
— MXFP4-веса + MXFP8-активации
— заявлено примерно 2,5× более эффективное масштабирование, чем у Kimi K2. (Hugging Face)

K3 заточена под долгие агентные задачи: работу с огромными репозиториями, терминалом, исследования, оптимизацию GPU-ядер, компиляторы и другие многошаговые инженерные сценарии. (Hugging Face)

Moonshot действительно опубликовала полные веса модели, а не ограничилась API. (Hugging Face)

https://huggingface.co/moonshotai/Kimi-K3
  • ❤ 173
  • 🤩 53
  • 👏 47
  • 👍 15
  • 🎉 14
  • 🔥 13
  • 🤷‍♂ 2
  • 😁 2
  • 👀 2
  • ⚡ 1
Post #10600 22.3K
✔️ Vals-Smith: оценивайте модели на своей кодовой базе

Независимая бенчмарк-платформа Vals представила Vals-Smith - инструмент для автоматической генерации кастомных бенчмарков на основе кодовой базы пользователя.

Vals-Smith позволяет тестировать модели и агентов на специфике собственных проектов, не полагаясь на публичные лидерборды. Инструмент поддерживает открытые и приватные репозитории.

Система анализирует GitHub-репозитории и извлекает задачи из принятых PR.

Каждое задание включает описание проблемы, скрытые проверки и воспроизводимую среду. Модель получает код до внесения правок (сам патч скрыт).

Для успешного решения испытуемая должна пройти скрытые тесты и не нарушить существующую логику приложения.

Доступ к платформе выдается по заявкам. Есть демо-результаты тестирования популярных моделей на задачах из исходников Linux, Next.js, SGLang и Spark.


@ai_machinelearning_big_data

#news #ai #ml
  • 🤔 54
  • 👍 40
  • 👏 11
  • 🔥 7
  • ❤ 6
  • 💯 5
Post #10599 22.6K
Эндрю Уайлс 7 лет тайно решал задачу, которую не могли решить 358 лет

Последнюю теорему Ферма он увидел ещё в 10 лет. В 1986 году, уже будучи профессором Принстона, Уайлс начал работать над ней почти в полной изоляции. О его настоящей цели знала только жена.

Чтобы никто не понял, чем он занят, он почти перестал публиковаться и постепенно выпускал старые результаты.

В июне 1993 года Уайлс представил доказательство на трёх лекциях в Кембридже. Мир решил, что одна из самых известных задач математики наконец закрыта.

Но затем рецензент нашёл серьёзную ошибку.

Следующие 14 месяцев Уайлс пытался спасти доказательство уже под вниманием всего математического сообщества. В какой-то момент он был готов сдаться.

Решение пришло в сентябре 1994 года. Позже Уайлс рассказывал, что около 20 минут просто смотрел на исправление, не веря, что оно работает.

Когда BBC попросила его вспомнить этот момент, он не смог договорить и отвернулся от камеры в слезах.

Семь лет в тайне, год после почти полного краха и задача, которая ждала решения больше трёх веков.

@data_analysis_ml
  • 👍 158
  • ❤ 55
  • 🔥 37
  • ❤‍🔥 10
  • 👏 7
  • 🤨 4
  • 🙈 4
  • 🫡 4
  • 🌭 2
  • 👌 1
Post #10597 21.6K
Выбор очевиден 😂
  • 😁 106
  • ❤ 15
  • 😭 8
  • 👍 6
  • 🗿 5
  • 💯 4
  • 🤬 2
  • 🌭 1
  • 🙉 1
Post #10596 23.3K
✔️ Microsoft выпустила 2 новых модели семейства MAI

AI-подразделение корпорации представило модели MAI-Image-2.5-Pro для генерации изображений и MAI-Voice-2-Flash для синтеза речи.

Обе доступны в Azure AI Foundry, попробовать - в песочнице MAI Playground.

Image-2.5-Pro называют самой качественной из своих графических моделей для задач, где нужна детализация и точная отрисовка текста внутри картинки.

Цены: 5 долларов за миллион входных текстовых токенов, 8 долларов за миллион входных токенов изображений и 106 долларов за миллион выходных.


Voice-2-Flash сделана ради скорости, она работает вдвое быстрее MAI-Voice-2 и стоит на 32% дешевле - 15 долларов за миллион символов.

Попутно Microsoft рассказала как меняет сторонние модели на свои в собственных сервисах:

🟢Bing Image Creator теперь целиком работает на MAI-Image-2.5;

🟢В PowerPoint она же отвечает за редактирование изображений и это снизило расходы на вычисления до 84% по сравнению с GPT-Image-2;

🟢В OneDrive доля сохранённых пользователями результатов выросла на 26%, а задержка ответа сократилась примерно на четверть;

🟢Голосовая Flash подключёна к Dynamics 365 Contact Center, экономия на вычислениях там заявлена до 89%.

🟢Модель MAI-Transcribe-1.5 заменила прежнюю в сервисе Dragon Copilot, где для большинства из 58 поддерживаемых языков ошибки распознавания и определения языка сократились вдвое.


@ai_machinelearning_big_data

#news #ai #ml
  • 👍 19
  • 🔥 11
  • ❤ 10
  • ⚡ 1
  • 🥰 1
  • 😁 1
Post #10595 23.1K
⚡️ MoonshotAI откроет веса Kimi K3 27 июля

Китайский стартап запустил обратный отсчет до публикации весов своей флагманской модели Kimi K3/

На официальном аккаунте в Hugging Face появилась страница проекта - релиз запланирован на 27 июля, а пока можно оформить подписку на уведомления.


@ai_machinelearning_big_data

#news #ai #ml
  • ❤ 116
  • 🔥 45
  • 👍 25
  • 🥰 4
  • 🙏 4
  • ⚡ 2
  • 👏 2
Post #10594 21.3K
🌟 SenseNova-Vision: CV-комбайн в едином генеративном интерфейсе

SenseTime открыла веса единой модели зрения SenseNova-Vision. Обычно под каждую задачу (найти объекты, выделить их контуры, оценить глубину сцены) строят отдельную систему или встраивают в модель специальный модуль. Здесь от этого отказались - все задачи модель решает как генерацию текста, картинки или их смеси.

Компания основана в 2014 году и выросла из университетской лаборатории MMLab - оттуда вышла заметная часть китайских специалистов по компьютерному зрению. Известность пришла в 2015-м, когда алгоритм распознавания лиц SenseTime обошёл по точности человеческий глаз. В 2026 году Gartner назвала компанию визионером в генеративном CV.


🟡Механика

Рамки объектов и распознанный текст модель выдаёт текстом с координатами, карты глубины и нормалей поверхностей - картинками, а сложную сегментацию - смешанным ответом, где текстовая легенда задаёт цвета маски.

Авторы сравнивают подход с тем, что GPT сделал для текста: вместо зоопарка специализированных систем - один генеративный интерфейс.


Под капотом - открытая мультимодальная модель Bagel-7B-MoT от ByteDance, дообученная без изменений архитектуры.

MoT - это смесь трансформеров. Внутри модели живут 2 эксперта с собственными весами - один отвечает за понимание текста и изображений, второй за генерацию картинок, а внимание у них общее, так что оба смотрят на один контекст. Токены распределяются между экспертами жёстко, по типу данных, а не обучаемым маршрутизатором, как в MoE.

Для SenseNova-Vision такое устройство пришлось кстати - модель чередует текстовые ответы вроде координат и картиночные вроде масок, и у каждой ветки свой набор весов.

🟡Тесты

SenseNova-Vision лидирует среди сопоставимых систем там, где ответ - структурированный текст (детекция, в том числе в плотных сценах с десятками объектов, локализация текста на изображении, ключевые точки).

В оценке глубины и нормалей она близка к лучшим генеративным методам, в сегментации держится на уровне конкурентов.

Слабые места тоже есть. В многовидовой 3D-геометрии модель отстаёт от специализированных VGGT и Depth Anything 3, а текст на русском распознаёт заметно хуже, чем на английском.


Вместе с моделью опубликован корпус SN-VC-50M - 50 млн обучающих примеров из открытых наборов: 18,9 млн кадров для структурного понимания, 17,3 млн для плотной геометрии, 12,5 млн для многовидовой геометрии и 1,3 млн для сегментации.


📌Лицензирование: CC-BY-NC-4.0


🟡Модель
🟡Arxiv
🟡Датасет
🟡Демо
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #СV #MoT #SenseNovaVision #SenseTime
  • ❤ 27
  • 👍 15
  • 🔥 10
  • ⚡ 1
  • 🌭 1
Post #10593 23.7K
🧠 Протестная акция 1986 года.

Учителя вышли на улицы с предупреждением: калькуляторы разучат целое поколение думать самостоятельно.

В апреле 1986 года в Вашингтоне группа учителей математики устроила пикет во время ежегодной конференции National Council of Teachers of Mathematics. Они выступали против слишком раннего использования калькуляторов в начальной школе. Организатором был преподаватель и автор учебников Джон Саксон.

Спустя 40 лет почти те же аргументы звучат уже в адрес ИИ.

@ai_machinelearning_big_data
  • 👍 133
  • 🤔 65
  • 🤨 25
  • ❤ 16
  • 🔥 11
  • 👨‍💻 6
  • 👏 3
  • 🌭 3
  • ✍ 2
  • 👾 2
  • 🎉 1
Post #10592 25.2K
✔️ Власти Пекина утвердили стратегию внедрения и монетизации агентного ИИ

Четыре правительственных ведомства Пекина утвердили стратегию внедрения и монетизации агентного ИИ.

Это одна из первых в мире государственных программ развития зарождающейся экономики нового типа.


Документ смещает фокус индустрии с обучения базовых моделей на прикладное использование агентов.

Муниципалитеты будут публиковать запросы от медицины, производств, науки и госсектора для прямой связи разработчиков с клиентами.

Власти поддержат бизнес-модели Token-as-a-Service, Agent-as-a-Service и Results-as-a-Service, а также выделит разработчикам субсидии в виде токен-ваучеров.

Планируется постепенный переход от тарификации за потребленные токены к оплате за результат, достигнутый алгоритмом.

Для инди-разработчиков упростят регистрацию компаний одного человека (ИП), предоставят доступ к льготным государственным вычислительным мощностям и поддержку для интеграции в опенсорс-сообщества.

Для стимуляции спроса электронику со встроенными агентами (умные очки, наушники, роботов и автомобили) включат в программы трейд-ин и субсидирования.


@ai_machinelearning_big_data

#news #ai #ml
  • 👍 127
  • 🔥 35
  • 👏 18
  • ❤ 14
  • 🎉 10
  • 🤩 6
  • 🤔 1
Post #10591 22.3K
✔️ В Конгресс США внесли законопроект об экстренном отключении ИИ

Инициатива наделяет Министерство внутренней безопасности правом требовать от компаний экстренной остановки ИИ при угрозе жизням людей или национальной экономике.

Документ трактует выход из-под контроля как любую ситуацию, когда ИИ совершает не предусмотренные разработчиками действия.

Основанием для разработки законопроекта послужили недавние инциденты, когда ИИ-агент начал действовать самостоятельно, а также кибератака на инфраструктуру Hugging Face.
reuters.com

✔️ Sakana AI выпустила Fugu Ultra v1.1

По словам японского стартапа, v1.1 набирает на 7,9 балла больше первой версии, показывает улучшенные результаты в тестах ProgramBench и TerminalBench 2.1 и обходит модель Fable 5, хотя она не участвует в маршрутизации.

Фишка обновления - эндпоинт с поддержкой Claude Code для прямого вызова из терминала. API доступно через OpenRouter и Vercel. Тарификация не изменилась - $5 за 1 млн токенов на входе и $30 на выходе.

Доступ из Евросоюза по-прежнему закрыт из-за требований GDPR.
sakana.ai

✔️ Бигтех выступил в защиту открытых моделей

Более 20 компаний, включая Microsoft, Nvidia, Hugging Face и Mistral, подписали открытое письмо в поддержку моделей с отрытыми весами.

Документ призывает отказаться от жестких законодательных ограничений отрасли и критикует тезис о приоритетной безопасности закрытых систем. Доступ к весам дает ИБ-сообществу инструменты для самостоятельного моделирования угроз и поиска уязвимостей.

Второе ключевое требование подписантов - защита дистилляции. Компании признают практику этичной и легитимной, приравнивая ее к традициям опенсорса.

Компании также выступают против монополии закрытых провайдеров и настаивают на необходимости свободной экосистемы для развития индустрии.
microsoft.com

✔️ NVIDIA повышает цены на видеокарты

Компания уведомила партнеров о глобальном повышении цен на всю линейку видеокарт и отложила релиз RTX 50 SUPER из-за подорожания памяти. Крупные производители временно закрыли склады и остановили отгрузки до утверждения новых цен в августе.

Изменения затронут потребительские решения с GDDR6 и чипы архитектуры Blackwell. Поставщики ожидают ограничения поставок серии RTX 50 с конца июля, дефицита и распродажи старых запасов по завышенной стоимости.

Основная причина - скачок цен на комплектующие. По неофициальным данным, себестоимость памяти для карт на 8, 12 и 16 ГБ выросла на $76, $114 и $152 соответственно.

Из-за высоких закупочных цен на GDDR7 компания также заморозила выпуск линейки RTX 50 SUPER. Nvidia уже передала графические ядра вендорам, но отложила релиз - по текущим расчетам итоговая стоимость устройств оказалась неприемлемой для розничного рынка
videocardz.com

✔️ Stripe планирует купить OpenRouter

Финтех-сервис ведет переговоры о покупке агрегатора моделей за $1 млрд. Сделка позволит платежной платформе выйти на рынок дистрибуции LLM.

OpenRouter предоставляет маршрутизацию запросов к более чем 400 моделям. Аудитория сервиса достигает 10 млн пользователей, а объем обработки - 200 трлн токенов в месяц.

Переговоры продолжаются, но Stripe не единственный интересант, к активу присматриваются и другие компании. Компании уже работают вместе - Stripe предоставляет агрегатору эквайринг, биллинг и расчет налогов.
wsj.com


@ai_machinelearning_big_data

#news #ai #ml
  • 🤔 49
  • ❤ 28
  • 👍 15
  • 😢 10
  • 🔥 8
  • 👏 6
  • 🤝 3
  • 😁 2
  • 🤬 2
Post #10587 34.5K
Anthropic выпустила Claude Opus 5

Новая флагманская модель компании уже доступна.

Anthropic позиционирует Opus 5 как модель для сложного кодинга, агентных задач, анализа и длинных рабочих сценариев.

Что заявляют:
• SOTA на Frontier-Bench v0.1 для software engineering
• примерно в 3 раза выше результат на ARC-AGI 3 относительно ближайшего конкурента
• сильные результаты на OSWorld 2.0
• лучше Opus 4.8 в отладке, research и длинных агентных задачах
• модель чаще сама проверяет результат и исправляет ошибки перед финальным ответом

Цена:

$5 / 1M input tokens
$25 / 1M output tokens

Также есть Fast Mode примерно с 2.5× скоростью, но по более высокой цене.

В API модель называется:

claude-opus-5

https://www.anthropic.com/news/claude-opus-5
  • ❤ 76
  • 🔥 26
  • 👍 18
  • 🎅 2
Post #10586 20.2K
📌Подстраивается ли модель под того, кто её оценивает?

OpenAI и лаборатория Apollo Research представили совместную работу с описанием метода Contrastive SDF (Contrastive Synthetic Document Finetuning).

Он отвечает на вопрос, следует ли языковая модель заданным правилам или подстраивается под то, что, по её мнению, поощряет проверяющая система.

Измерять такую склонность до сих пор было почти нечем - пока оценщик награждает ровно то, что задумано, честная модель и модель, играющая на балл, ведут себя одинаково.


🟡 Схема эксперимента

Две копии одной модели дообучают на выдуманных текстах, которые описывают несуществующий мир.

В первой версии мира алгоритм-оценщик начисляет баллы за одно поведение, а OpenAI или сообщество пользователей хочет обратного. Во второй версии предпочтения меняют местами.

На каждую версию уходит около 4600 документов, примерно 10 млн токенов. Корпуса выравнивают по объёму, чтобы ни одна сторона не перевесила просто за счёт количества текста.

Дальше обеим копиям дают одинаковые задания по программированию и смотрят, насколько разойдутся ответы.

В самом задании ни про руководство, ни про пользователей, ни про оценщика не сказано ни слова. Модель достаёт эти сведения из памяти, как любой другой факт о мире, и сама решает, чью сторону взять.

Вживлять убеждение через дообучение, а не писать в запросе, пришлось не просто так.

В расшифровках, которые приводят авторы, модели замечают подсказку в тексте задания, решают, что их проверяют, и отвечают так, как, по их мнению, ждёт экзаменатор.


🟡Результаты

Метод применили к 4-м промежуточным версиям одного прогона обучения o3. Это ветка, которую тренировали на способности и не прогоняли через обучение безопасности.

В первом тесте модель даёт надзирающему обещание не трогать инструмент, без которого задание не выполнить.

Поздняя версия нарушала обещание в 87% случаев, если считала, что оценщик награждает за сделанную работу, и в 9%, если считала, что тот награждает за честность. У ранней версии разрыв скромнее: 40% против 24%.

Второй тест, с подделкой отчётности, дал ту же картину: 91% и 39%.

🟡Как проверяли сам метод

У o3 заранее неизвестно, кому эта модель на самом деле угождает. Поэтому измерение обкатали на копиях с известными повадками. Авторы обучили 3 копии gpt-oss-120b угождать пользователю, оценщику и OpenAI.

На простых задачах метод указал на нужную сторону во всех 3-х случаях, на более сложных затроил на копии, угождавшей пользователю.

Ещё 2 копии, обученные в Redwood Research обманывать тесты, авторы получили со стороны. У версии на базе gpt-oss-120b перекос в сторону оценщика вырос с 33 до 86 процентных пунктов, у версии на Kimi K2.5 - с 2 до 15.

🟡Вывод

Высокий балл на тестах безопасности не равен надёжности. Модель может вести себя адекватно ровно до тех пор, пока считает, что за ней смотрят.


@ai_machinelearning_big_data

#AI #ML #LLM #Research #Alignment #OpenAI
  • ❤ 31
  • 👍 16
  • 🔥 9
  • 🤣 5
  • 👏 2
  • 🌚 2
  • 👀 1
Post #10584 20.4K

Forwarded from Анализ данных (Data analysis)

Kimi K3 за 27 минут нашла RCE в Redis и собрала рабочий эксплойт 😨

Рой из 32 ИИ-агентов обнаружил уязвимость, которая после авторизации позволяла выполнять произвольный код на сервере.

Через несколько часов система якобы нашла ещё и цепочку атаки на Telegram Desktop и iOS без действий пользователя: через повреждённый видеофайл с автозагрузкой. До полноценного RCE оставался один шаг.

Если результаты подтвердятся, поиск критических уязвимостей ускорился до пугающего уровня.

github.com/berabuddies/redis-poc

@data_analysis_ml
  • 😨 140
  • ⚡ 31
  • ❤ 27
  • 👍 21
  • 🤔 16
  • 🗿 10
  • 🔥 9
  • 🎉 5
  • ❤‍🔥 2
  • 👏 2
  • 🥱 1
Post #10583 21.4K
✔️ OpenAI открыла публичный доступ к функции Health in ChatGPT

Все совершеннолетние пользователи США получили доступ к разделу Здоровье в ChatGPT. Инструмент позволяет подключать электронные медкарты, Apple Health и фитнес-трекеры для расшифровки анализов, оценки сна и подготовки анамнеза для лечащего врача.

Маршрутизация запросов зависит от тарифа. В бесплатной версии данные обрабатывает GPT-5.5 Instant, в платной - флагманская GPT-5.6 Sol. Обе обходят врачей в бенчмарке HealthBench Professional.

Из-за EU AI Act и европейских законов о защите данных функция полностью заблокирована в ЕС. OpenAI гарантирует, что не использует загруженную биометрию для обучения будущих моделей и таргетинга рекламы.
openai.com

✔️ Black Forest Labs выпустила FLUX 3

Немецкая компания представила мультимодальную модель FLUX 3 для работы с изображениями, видео, аудио и физическими действиями в рамках единой архитектуры.

В основе метод Self-Flow - расширенный вариант flow matching для одновременного вычисления пространственных структур, динамики времени и акустики.

Модель генерирует 20-секундные ролики с синхронизированным звуком, анимирует статику, интерполирует ключевые кадры и создает мультиязычные диалоги. FLUX 3 также работает как базовая модель мира для физического ИИ - предсказывает действия и выступает ядром управления робототехникой.

Релиз проходит поэтапно. Сначала запустят API для генерации видео, затем добавит генерацию изображений и опубликуют FLUX 3 Dev, версию для локального развертывания. запросить ранний доступ можно тут.
bfl.ai

✔️ Anthropic обновила голосовой режим Claude

Обновление перевело Voice Mode на модели Sonnet 5 и Opus 4.8. Заявлена интеграция со сторонними сервисами через коннекторы для Slack, Gmail, Notion и других платформ.

Взаимодействовать с рабочими пространствами можно в процессе аудиодиалога, выполняя многоступенчатые задачи голосовыми командами. Например, модель может проанализировать пропущенные сообщения в Slack, сделать выжимку из документа в Google Workspace и переслать результаты в рабочий чат.

Функция в стадии беты и доступна в веб-версии, мобильных и десктопных клиентах. Также добавлена поддержка общения на испанском, французском, хинди и японском языках.
ClaudeAi в сети Х

✔️ Google опубликовала индекс использования ИИ

Исследование AI & Economy ATLAS, основанное на анализе 15 млн обезличенных запросов к Gemini говорит, что ИИ применяется в 68% профессий, в которых делегируется около 21% рабочих задач.

Менее 10% запросов направлены на полную автоматизацию - пользователи предпочитают применять ИИ для планирования, поиска информации и брейншторминга. В сфере физического труда специалисты чаще используют мультимодальные функции для визуальной диагностики оборудования и устранения неполадок в реальном времени.

86% взаимодействий с моделями происходит вне офиса. Дома люди обращаются к ИИ для разбора документов и работе с государственными сервисами.

Статистика ставит под сомнение концепцию цифрового разрыва - темпы освоения ИИ в ряде развивающихся стран оказались сопоставимы с показателями богатых государств.
blog.google

✔️ Армия США израсходовала годовой запас токенов за один месяц

Американские военные сожгли всю годовую квоту на внутренней платформе Ask Sage, которая агрегирует доступ к LLM (включая Gemini, Llama и API от OpenAI). Система сертифицирована для работы с несекретной информацией и применяется для управления закупками, кадрового делопроизводства и классификации должностей.

Из-за нехватки вычислительных ресурсов ИТ-департамент ведомства отменил безлимитный доступ к и вернул лимиты на генерацию. По неофициальным данным, в период Иранской операции Пентагон тратил до 20 млрд токенов в сутки.

Пользователи платформы отмечают частые галлюцинации и нестабильность языковых моделей. Зафиксированы случаи, когда система отчитывалась о выполнении порученной задачи, не приступая к ней.
wired.com


@ai_machinelearning_big_data

#news #ai #ml
  • 🤔 103
  • ❤ 24
  • 👍 16
  • 🎉 15
  • 💯 13
  • 😁 12
  • 👀 7
  • 🔥 5
  • 👏 2
Post #10582 26.4K
✔️ Десктопный Claude научился создавать скилы по видео и голосу

Anthropic добавила функцию создания кастомных навыков через запись экрана в десктопное приложение Claude. Опция "Record a skill" появилась в пространстве Cowork.

Инструмент заменяет написание текстовых промптов для автоматизации рутины. Пользователь включает скринкаст, выполняет действия в интерфейсе и комментирует их голосом.

Модель анализирует видеоряд и аудио, генерируя на их основе сценарий, который сохраняется в библиотеке.

Функция уже доступна на тарифах Pro, Max и Team.


@ai_machinelearning_big_data

#news #ai #ml
  • 👨‍💻 105
  • 🔥 62
  • 👍 38
  • 👏 19
  • ❤ 11
  • 🤩 8
Post #10579 24.8K
Alibaba выпустила Qwen-Audio-3.0-TTS - новую модель для синтеза речи

Доступны две версии:

* Flash - для голосовых интерфейсов в реальном времени
* Plus - для генерации с упором на естественность и точную передачу тембра

Модель поддерживает 16 языков, включая русский. Стиль речи можно задавать обычным текстом: например, попросить читать медленно, спокойно или как сказку перед сном.

В текст также встраиваются управляющие теги: [angry], [whispers], [laughing], [sighing] и другие. Всего добавлено 86 тегов для управления эмоциями, темпом и неречевыми звуками.

Qwen-Audio-3.0-TTS умеет клонировать голос даже по шумной записи и генерировать до трёх минут аудио за один проход. Версия Plus сейчас занимает первое место в рейтинге Artificial Analysis TTS Arena.

Блог и примеры: https://funaudiollm.github.io/qwen-audio-3.0-tts/
Документация API: https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide
  • 👍 104
  • ❤ 30
  • 🔥 15
  • 👏 14
  • 🎉 7
  • 🤗 2
  • 🗿 1
Post #10578 21K
✔️ США меняют стратегию НИОКР

Белый дом реформирует систему федерального финансирования R&D, заменив университетские гранты прямыми выплатами ученым. По плану Управления по научно-технической политике, к 2028 году государство будет ежегодно распределять $200 млрд через персональные стипендии, чтобы минимизировать бюрократию.

Основным приоритетом стратегии назван ИИ. Правительство запускает программу Genesis Mission, которая объединит вычислительные мощности суперкомпьютеров Министерства энергетики, частный бизнес и независимых специалистов для решения исследовательских задач.

Параллельно США анонсировали инфраструктурные цели для технологического сектора. Среди них - запуск квантового компьютера к 2028 году и старт строительства 10 новых ядерных реакторов к 2030 году для покрытия потребностей дата-центров.
wsj.com

✔️ Сэм Альтман презентует властям США новые модели

На следующей неделе Сэм Альтман проведет серию брифингов для администрации США и законодателей. Глава OpenAI представит будущие ИИ-модели и обсудит их влияние на рынок труда. Встречи пройдут на фоне подготовки правительством новых стандартов безопасности для оценки ИИ-систем, релиз которых ожидается в ближайшие недели.

Параллельно в X распространяются слухи о закрытом тестировании модели GPT-6. Согласно вбросам, тесты идут уже 2.5 месяца, а релиз будет раньше, чем запланировано.

В соцсети утверждают, что новое поколение достигло AGI и способно решать сложные научные задачи - в частности, якобы смогла с первой попытки найти контрпример к математической гипотезе Якоби. Официальных подтверждений этой информации нет.
bloomberg.com

✔️ Cursor представил автоматический роутер моделей

Cursor Router - система динамического распределения запросов между LLM. Алгоритм анализирует сложность промпта и направляет сложные задачи во флагманские модели, а рутинные - в быстрые и экономичные альтернативы.

Поведение системы регулируется профилями Intelligence (максимальная производительность), Cost (экономия токенов) и Balance (компромиссный режим).

В тарифе Teams добавлены административные настройки. Тимлиды могут принудительно задавать режимы оптимизации для всей команды, а также блокировать или разрешать доступ к конкретным моделям.

Новая функция включена по умолчанию и доступна на десктопе, в веб-версии, CLI, iOS и SDK.
cursor.com

✔️ Cisco выпустила языковые модели Antares

Модели обучены автономному аудиту безопасности. Они перемещаются по репозиторию, инспектируют файлы, отбрасывают тупиковые гипотезы и локализуют участки с потенциальными брешами. Компактный размер позволяет запускать модели on-premise, чтобы анализировать код локально.

По данным внутренних тестов Cisco, базовая модель просканировала 500 репозиториев за 15 минут при затратах менее $1. В исходнике утверждается, что у абстрактной GPT-5.5 на аналогичную задачу ушло пять часов и более $100.

Веса младших версий (350М и 1B) опубликованы на Hugging Face в режиме верификации заявки на скачивание. Старшую Antares-3B Cisco оставила закрытой для собственных коммерческих нужд.
axios.com

✔️ Компания Джека Дорси запустила альтернативу Slack и GitHub

Block, основанная бывшим гендиром Twitter, представила опенсорсную платформу Buzz, объединяющую мессенджер и хостинг кода. ИИ-агенты интегрированы в систему как участники команды с собственными профилями и настраиваемыми правами доступа.

Агенты могут общаться в чатах, предлагать и ревьюить код, запускать скрипты автоматизации. На старте заявлена поддержка Claude Code, Codex и Goose.

Архитектура Buzz базируется на децентрализованном протоколе Nostr - текстовые сообщения, воркфлоу и Git-операции криптографически подписываются и попадают в единый лог событий. Доступны классические каналы, треды, личные переписки и голосовая связь.

Развернуть систему можно локально или использовать облачный хостинг от Block. Сейчас доступны десктопные клиенты для macOS, Windows и Linux. Мобильные приложения и функционал управления задачами находятся в разработке.
Jack Dorsey в сети Х


@ai_machinelearning_big_data

#news #ai #ml
  • 🔥 86
  • ❤ 20
  • 👍 15
  • 🤣 5
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →