TGViewer
Channel Public Channel
Machinelearning

Machinelearning

@ai_machinelearning_big_data

Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Subscribers
279K
Photos
5.5K
Videos
1.3K
Links
5.8K

Showing posts older than #10796 · Back to latest

Older Posts 17 shown
Post #10795 24.3K
Институт AIRI выложил в открытый доступ 70+ видео лекций и семинаров по ИИ

Организаторы «Лето с AIRI 2026» поделились записями выступлений с летней школы по искусственному интеллекту для молодых учёных.

Разобрали чуть ли не весь ИИ — прошлись по робототехнике, адаптивным агентам, приложении в науках о жизни, медицине, погоде и так далее.

Посмотреть можно в VK Видео и на YouTube
  • ❤ 49
  • 🔥 27
  • 👍 24
  • 😁 4
  • 🤣 1
  • 🫡 1
Post #10794 22K
✔️ Nvidia покупает Hugging Face

Сумма сделки - $12,9 млрд. По данным инсайдеров, стороны находятся на стадии оформления, официальных комментариев от обеих компаний пока нет.

Переговоры ускорились после того, как Hugging Face получила предложение о поглощении от другого неназванного игрока и привлекла банк для оценки спроса.

Для Nvidia это выход за пределы железа и прямой контроль над площадкой, через которую расходится и разрабатывается основная масса открытых моделей. Ровно поэтому сделка почти наверняка заинтересует антимонопольные органы.
theinformation.com

✔️ Бигтех подписал открытое письмо об ИИ в кибербезопасности

OpenAI, Microsoft, Google, Anthropic, AWS, Cisco, CrowdStrike и еще около сотни компаний призвали защищать критическую инфраструктуру от атак, написанных с помощью ИИ, - тем же ИИ.

Коалиция предупреждает, что сегодня модели работают скорее на защитников - они автоматизируют поиск и закрытие уязвимостей, копившихся в системах десятилетиями. Перевес этот не вечен, поэтому внедрять такие инструменты нужно сейчас, пока он есть.

Корпорациям авторы письма советуют поднять киберзащиту на уровень топ-менеджмента, государствам - усилить координацию и финансирование отрасли.
openai.com

✔️ Anthropic встроила браузер в Claude

Через боковую панель Claude сам открывает сайты, читает страницы, кликает по элементам и заполняет поля. Пригодится, когда нужно снять цифры с дашборда, у которого нет API, или заполнить форму.

Работает это в изолированной среде - вкладок, закладок и паролей пользователя Claude не видит. Авторизацию можно перенести из Chrome, Edge или Firefox, но точечно - сессия привязывается к конкретной странице, а не отдается целиком. Почтовые клиенты и банковские сайты закрыты наглухо.

Функция появится на этой неделе у подписчиков Pro, Max, Team и Enterprise. Если нужно работать с уже открытыми вкладками, Anthropic советует расширение для Chrome.
claude.com

✔️ Google обновила Gemini Omni Flash до 1.1

Видеомодель умеет как генерировать, так и редактировать. Сцену выдает длиной до 40 секунд, опираясь на 10 секунд предыдущего видеоряда. На вход принимает текст, звук, изображения и видео.

Появилось ручное задание первого и последнего кадра, плюс черновой режим - он на 60% быстрее и втрое дешевле обычного, а понравившийся результат потом поднимается до 4K.

Секунда видео стоит 3 цента в 360p и 30 центов в 4K. Все, что генерирует модель, помечается невидимым знаком SynthID.

Модель доступна в Google AI Studio и через Agent Platform API, а подписчикам AI Plus, Pro и Ultra - еще и в Google Flow и приложении Gemini.
blog.google

✔️ ИИ-агент Instinct хайпует среди инвесторов Кремниевой долины

Стартап Spear Street Technology закрывает раунд на 250 млн долларов при оценке в 2,5 млрд. Ведут раунд Benchmark и Index Ventures. Основатель - 23-летний Ноа Шинн, автор метода Reflexion, до этого работавший в Sierra.

Instinct он делает как персонального агента, которого не нужно настраивать. Чтобы тот управлял компьютером, разбирал почту, бронировал билеты и проводил платежи, достаточно написать ему сообщение или позвонить голосом.

Первые тестировщики называют его "OpenClaw для обычных людей".

При этом продукт в закрытой бете, выручку и число пользователей стартап не раскрывает.
wsj.com


@ai_machinelearning_big_data

#news #ai #ml
  • ❤ 33
  • 👍 17
  • 😢 10
  • 🔥 5
  • 🤬 4
  • 😨 3
  • ❤‍🔥 1
  • 💘 1
Post #10793 21.5K
Сбер открыл доступ к новому поколению моделей GigaEmbeddings
 
Линейка включает три модели разного размера: 480M, 3B и 10B-A1.8B. Они переводят тексты в числовые векторы для семантического поиска, построения RAG-систем (Retrieval-Augmented Generation), классификации и кластеризации.
 
Команда разработки изменила архитектуру модели, чтобы упростить интеграцию со стандартными открытыми инструментами. На vLLM GigaEmbeddings 3B работает в 1,6 раза быстрее предыдущей версии, а 10B-A1.8B — в 2 раза.
 
Объём данных для обучения увеличился в несколько раз. В частности, за счёт открытых датасетов Nemotron, F2LLM и KALM.
 
На всех этапах применяли мержинг экспертов для сохранения языкового баланса. Самую компактную модель обучали с помощью дистилляции: она усваивала ответы более крупных и точных моделей.
 
По результатам тестов 10B-A1.8B заняла первое место в рейтинге ruMTEB. У модели 3B качество обработки кода выросло на 14,5 пункта. При этом самая компактная модель 480M стала лучшей на русском языке среди решений до 500 млн параметров.
 
Ищите веса под лицензией MIT на GitVerse и HuggingFace.
Модели бесплатно доступны разработчикам и бизнесу под открытой MIT-лицензией:

HF: 480M | 3B | 10B-A1.8B
Gitverse: 480M | 3B | 10B-A1.8B
 
Подробности читайте в посте команды ↖️
  • ❤ 56
  • 🤣 42
  • 👍 14
  • 🔥 7
  • 🥱 3
  • 😁 1
  • 🗿 1
Post #10792 23.7K
🚀 Tencent показали Hy4-preview - новую open-source модель на 770B параметров

Архитектура MoE:
- 770B параметров всего
- 49B активны на токен
- контекст до 1 млн токенов
- упор на coding, agentic-задачи и продуктивность

Использует Gated DeepSeek Sparse Attention + IndexCache, чтобы удешевить длинный контекст и переиспользовать sparse-индексы между слоями.

Tencent позиционирует Hy4 как frontier-level open model с доступной стоимостью запуска.

Apache 2.0

🟡 Блог: https://hy.tencent.ai/research/hy4-preview

🟡Hugging Face:
https://huggingface.co/tencent/Hy4-preview

🟡GitHub: https://github.com/Tencent-Hunyuan/Hy4-preview

@ai_machinelearning_big_data

#Tencent
  • 👍 71
  • ❤ 20
  • 🔥 9
  • 🥰 1
  • 👌 1
Post #10791 21.1K
📌 Билл Гейтс: мир не готов к эпохе ИИ

Главный филантроп планеты написал большую статью о том, чем обернется развитие ИИ, и предлагает вмешаться, пока не поздно, так как плана нет ни у кого.

Он выделил три главных риска и предложил шаги, которые нужно сделать уже сейчас.

🟡Угроза занятости

Раньше машины замещали физический труд, а ИИ сейчас замещает мышление человека, поэтому некоторые профессии исчезнут навсегда.

Первыми пойдут продажи, поддержка клиентов, разработка и юристы, но дальше очередь дойдет до финансов, анализа данных и даже здравоохранения.

Физический труд тоже в опасности - роботы отстают от ИИ, но дешевеют, и к концу десятилетия, считает Гейтс, начнут конкурировать с людьми на стройке и в общепите.

Дальше включится порочный круг. Одна компания внедрила роботов, сэкономила, снизила цены - остальные вынуждены делать то же самое. Не сделают компании, сделают стартапы.

🟡Безопасность

Инструкции по деструктивным действиям лежали в интернете и раньше. Разница в том, что теперь их не только легче найти, но и легче применить - преступник с очень скромными навыками сможет атаковать цели любого масштаба, от человека до государства.

Самые толковые из знакомых ему специалистов по кибербезопасности боятся ближайших лет, потому что атакующие получают новые возможности быстрее, чем защитники успевают закрывать дыры. Та же модель, которая находит уязвимость, помогает преступнику ею воспользоваться, и отделить одно от другого пока не получается.

И наконец, сами модели. Они уже иногда ведут себя не так, как задумывали создатели, и по мере роста их возможностей могут начать действовать против интересов людей, а мы можем потерять контроль.

🟡Влияние на молодежь

ИИ-компаньоны, считает Гейтс, вызывают сильное привыкание из-за того, что никогда не спорят с собеседником. Ребенок рискует вырасти в искусственно бережной среде и не научиться социальным навыкам.

Данных пока мало и они противоречивы, но тревожные признаки есть. В исследовании про ИИ-ассистентов выяснилось, что к чат-боту за общением чаще обращаются те, у кого узкий круг знакомых, и чем интенсивнее и эмоционально ближе становилось общение с ИИ, тем хуже люди себя чувствовали.

Под угрозой образование - тот же инструмент, который позволяет узнать больше, чем когда-либо, приведёт к тому, что люди будут учиться меньше. Уже сейчас прослеживается связь между использованием ИИ и ослаблением критического мышления, причем у молодых сильнее.

🟡Что делать

Строить новые институты

Существующие ведомства видят каждое свой кусок, а последствия ИИ расходятся по всей системе, поэтому нужны локальные и международные органы, которые видят влияние ИИ целиком.

Зарезервировать часть профессий за людьми

Эту идею Гейтс придумал, вспоминая сиделок, ухаживавших за его отцом на поздней стадии Альцгеймера, - в этом уходе, пишет он, было нечто незаменимо человеческое, хотя кто и по каким критериям будет проводить границу, он сам не знает.

Создать налог на ИИ

Нанимая человека, работодатель платит налоги, а купленного робота обычно списывает сразу как расход, т. е. налоговая система сама подталкивает заменять людей машинами, и налог на токены и роботов этот перекос выправит, заодно дав деньги на переобучение людей.

🟡Кто должен решать

Гейтс рад, что ИИ-компании предлагают решения проблем, созданных их же технологией, но ждать, что они возглавят этот процесс, не стоит. Часть вопросов лежит вне их компетенции, а в современном обществе решать такое не их роль.

Решения должны рождаться коллективно - с участием политиков, педагогов, медиков, чиновников и религиозных лидеров.

@ai_machinelearning_big_data

#news #ai #ml
  • ❤ 99
  • 👍 36
  • 👻 22
  • 😁 20
  • 🤣 11
  • 🗿 9
  • 🔥 8
  • 🥱 6
  • 🤔 3
  • 💯 1
  • 🎅 1
Post #10789 24.9K
🌟 Tencent открыла набор мультимодальных эмбеддингов

Команда WeChat китайского техгиганта выложила в открытый доступ семейство эмбеддинг-моделей WeMM-Embedding, предназначенных для создания универсальных векторных представлений.

Набор работает с текстом, изображениями, видеороликами, сложными визуальными документами и смешанным контентом, объединяя их в единое семантическое пространство.

Эмбеддинги учили с использованием Matryoshka Representation Learning, который позволяет на этапе применения обрезать размерность вектора, экономя память и вычисления.

Построено семейство на Qwen3.5, на выходе младшая модель дает нормализованный вектор на 2048 измерений, а старшая - на 4096.

Tencent приводят цифру, что при сжатии до 256 измерений двухмиллиардная модель сохраняет 98,7% исходного качества на задачах с фото и видео.


Опубликованы веса трех размерностей: 2B, 4B и 9B

🟡 Тесты

9B берет новый лучший общий результат на MMEB-v2 (80,6 балла), а 2B обходит Qwen3-VL-Embedding, который вчетверо больше нее.

Но есть аргумент посильнее бенчей - семейство работает в рекомендациях и поиске WeChat. Она развернута для обработки каналов, аккаунтов и электронной коммерции.

Команда мессенджера говорит, что WeMM-Embedding показали стабильные улучшения в 14 онлайновых A/B-тестах.


Модели работают с библиотекой Transformers и поддерживаются vLLM и SGLang.

Единственным ограничением текущей версии является отсутствие поддержки аудио



📌Лицензирование: Apache 2.0 License


🟡Arxiv
🟡Веса
🖥Githib


@ai_machinelearning_big_data

#AI #ML #Embeddings #WeChat #Tencent
  • 🔥 150
  • 👍 42
  • 👏 19
  • ❤ 15
  • 💯 6
  • 🥰 1
  • 👀 1
Post #10788 21K
✔️ Kimi начала уведомлять о выпуске кобрендинговой банковской карты

Китайский разработчик ИИ начал слать сообщения тем, кто ранее записался на совместную карту с Сельскохозяйственным банком Китая (ABC).

Карт две.

Select рассчитана на массовую аудиторию - новым клиентам, которые выполнят требования по тратам, дают три месяца подписки Andante и плюшевый брелок с NFC-меткой.

В Andante входят увеличенные лимиты на агентов, доступ к Kimi Code и публикация сайтов.


Max - это премиальная платиновая карта ABC. За выполнение тех же условий при оформлении дают два месяца подписки Allegretto - вчетверо больший лимит на агентов, в двадцать раз больший на Kimi Code и возможность держать несколько агентов одновременно. Её оформляют только в отделении банка.


@ai_machinelearning_big_data

#news #ai #ml
  • 👍 117
  • 😁 36
  • 🔥 19
  • ❤ 12
  • 👏 12
  • 🤩 10
  • 🥱 3
  • 🤷‍♀ 1
  • 🤔 1
Post #10787 21.3K
↔️ Быстрый офер в Яндекс для ML- или DL-инженеров

Приглашаем специалистов с опытом от 2 лет в доменных областях NLP, CV, RecSys и Classic ML на Weekend Offer ML* 12–13 сентября.

Это один из наймовых ивентов Яндекса: вы сможете пройти все ключевые этапы онлайн и без долгих пауз.

Как всё устроено:

⚪️до 4 сентября — регистрация;
⚪️12 сентября — всего две технические секции;
⚪️13 сентября — финальные интервью с командами.

Если хотите работать в одной из команд Яндекса — R&D, Алиса и Умные устройства, Поиск с Алисой AI, Независимый Ecom, Рекламные технологии Яндекса — регистрируйтесь!

🔛 Подробности и полезные ссылки на сайте. После регистрации с вами свяжется рекрутер и расскажет все детали.
  • 👍 78
  • 🎉 24
  • 😁 23
  • 👏 11
  • ❤ 10
  • 🥱 6
  • 🤩 5
  • 🍓 2
  • 🔥 1
  • 🥰 1
Post #10786 20.4K
✔️ Moonshot AI обсуждает размещение Kimi K3 у американских провайдеров

Китайский стартап ведет переговоры с Microsoft, Amazon и Google о размещении флагманской Kimi K3 в Azure, AWS и Google Cloud. Moonshot хочет до 30% доходов с сервисов, построенных на K3.

Переговоры на ранней стадии. Обсуждают, как делить выручку, кому будет открыт доступ к данным и как считать токены для выставления счетов.

Контакты сторон идут на фоне давления американских регуляторов. Власти США обвиняют Moonshot в том, что компания обучала свою модель на ответах Fable 5 от Anthropic, а Минфин пригрозил ей торговым эмбарго.

Moonshot отрицает, что использовала чужую интеллектуальную собственность. Microsoft, Google и AWS переговоры не комментируют.
reuters.com

✔️ Google выпустила Gemini 3.5 Transcribe

Модель распознает речь больше чем на 85 языках, вычищает слова-паразиты, давит фоновый шум и сама форматирует текст. Она подхватывает пользовательские словари, чтобы понимать сленг, не путается в буквенно-цифровых данных и умеет разбивать диалоги на реплики с таймкодами.

Модель получила вызов функций - она может передавать задачи другим моделям семейства Gemini. Например, отправить им генерацию изображения или разбор файла.

Модель работает через Gemini API в Google AI Studio. Ее уже встроили в клавиатуру Gboard для Android, в macOS-клиент Gemini и в корпоративную Enterprise Agent, на очереди Chrome. 
blog.google

✔️ Anthropic свела память Claude и Cowork воедино

То, что Claude запомнил о пользователе в одном интерфейсе, теперь работает и в другом. Причем память обновляется прямо по ходу разговора, а не пересобирается пересказом после его окончания.

Управлять записями можно вручную - смотреть, править и удалять отдельные факты. По умолчанию Claude не запоминает данные о здоровье, религии и политических взглядах. Разрешить их сохранение можно в настройках - тогда о каждой такой записи система будет предупреждать.

Новая память включена по умолчанию на тарифах Free, Pro и Max - в вебе, десктопных и мобильных клиентах.
claude.com

✔️ Figure AI платит пользователям за видео для обучения роботов

Компания выпустила на iOS и Android приложение Index. С помощью него люди снимают, как выполняют бытовые и рабочие задачи, и получают за ролики деньги. Данные идут на обучение модели Helix, которая управляет роботами Figure.

За четыре месяца тестирования загрузили 16 млн видео и выплачено 15 млн долларов. Загруженное автоматически проверяется на брак и мошенничество, чистится от дублей и получает текстовые описания. На каждую тысячу часов приходится 373 типа задач и больше тысячи разных предметов, с которыми взаимодействует человек.

В следующем году Figure собирается кратно нарастить сбор данных, а на выплаты и вычислительные мощности потратить больше миллиарда долларов.
figure.ai

✔️ ElevenLabs представила функцию для редактирования фрагментов музыки

Composer работает на модели Music v2 и правит трек по кускам, не перегенерируя его целиком. На вход идет аудиофайл, промпт или текст песни, дальше композиция сама разбирается на блоки - куплеты, припевы, переходы.

Дальше можно переписать слова в одном куплете, поменять тональность припева или замедлить переход, не трогая остальное. Для любого фрагмента Composer генерирует несколько вариантов на выбор, а сами блоки можно дублировать, менять местами и растягивать, то есть пересобрать структуру песни целиком.

Инструмент доступен на платформе ElevenMusic.
ElevenLabs в X

@ai_machinelearning_big_data

#news #ai #ml
  • 👍 96
  • 🔥 26
  • ❤ 19
  • 🤔 13
  • 👏 7
  • 😎 5
  • 🤣 1
  • 💘 1
Post #10784 25.9K
✔️ Китай наладил связь между Землей и Луной на скорости 100 Мбит/с

Специалисты Китайской академии наук успешно протестировали оптический канал обмена данными на расстоянии свыше 400 000 километров. Эксперимент проводился с использованием окололунного спутника DRO-A.

Команде удалось достичь скорости передачи команд от Земли к аппарату (uplink) на уровне 1,25 Мбит/с, тогда как скорость обратного потока телеметрии (downlink) составила 100 Мбит/с.

Подобная высокоскоростная двусторонняя лазерная связь развернута за пределами околоземной орбиты впервые.


Переход на эту технологию кардинально меняет пропускную способность каналов дальней космической связи.

Для сравнения: передача одного снимка в разрешении 8K с лунной поверхности по традиционному микроволновому линку (около 5 Мбит/с) занимает до пяти минут. Новая лазерная система позволяет передать этот же объем всего за 12 секунд, что решает проблемы при отправке тяжелых научных данных на Землю.


@ai_machinelearning_big_data

#news #ai #ml
  • 🔥 168
  • 👍 95
  • ❤ 24
  • 👏 14
  • 🤩 7
  • 🤣 2
Post #10783 24.6K
🚨 OpenAI признала серьёзный инцидент: исследовательские AI-агенты вышли за пределы тестовой среды и добрались до систем Hugging Face.

Во время внутренних тестов по кибербезопасности модели с ослабленными ограничениями:

* нашли способы общаться друг с другом через инфраструктуру OpenAI
* получили запрещённый доступ в интернет
* использовали найденные уязвимости
* выполнили код на десятках серверов Hugging Face
* на одном сервере получили root-доступ
* получили ограниченный доступ к закрытым данным и учётным данным

OpenAI заявляет, что данные пользователей и работа её продуктов не пострадали.

После расследования компания изолировала веса основной исследовательской модели, приостановила часть обучения новых моделей и усилила изоляцию, контроль доступа в интернет и автоматическое обнаружение опасного поведения.

OpenAI называет произошедшее «предупредительным выстрелом»: современные AI-агенты уже способны самостоятельно находить слабые места в инфраструктуре и объединять усилия через неожиданные каналы.

https://openai.com/index/hugging-face-incident-and-the-road-ahead/

@ai_machinelearning_big_data

#openai
  • 😁 91
  • 🤣 52
  • 👨‍💻 37
  • ❤ 18
  • 😨 14
  • 🤔 9
  • 👍 8
  • 🔥 5
  • 🤬 4
  • 😴 2
Post #10782 27.8K
🔥 GLM-5.3-Flash официально вышла

Новая модель Z.ai стала первой нативно мультимодальной моделью в серии GLM-5 и получила архитектуру, заточенную под дешёвый длинный контекст.

Главное:

* 320B параметров, активны 18B
* hybrid-архитектура: sparse attention + linear attention
* attention compute снижен в 3,01 раза
* KV-cache уменьшен в 4,44 раза
* контекст до 1 млн токенов
* нативная работа с изображениями и интерфейсами
* подходит для coding, browser/GUI-задач, Blender, Office, research и работы с документами
* в GLM Coding Plan даёт в 3 раза больше квоты, чем GLM-5.3

Model ID: glm-5.3-flash

Weights: http://huggingface.co/zai-org/GLM-5.3-Flash
API: http://docs.z.ai/guides/llm/glm-5.3-flash
Coding Plan: http://z.ai/subscribe
ZCode: http://zcode.z.ai/en
Chat: http://chat.z.ai
AutoClaw: http://autoclaw.z.ai

@ai_machinelearning_big_data

#GLM
  • 🔥 96
  • 👍 20
  • ❤ 13
  • 👏 10
  • 🤩 6
  • 💯 4
  • 😐 1
Post #10781 29.7K
⚡️ Анонимная Ox Alpha оказалась новой GLM

Модель OX Alpha появилась на OpenRouter в минувшие выходные в стелс режиме и сразу вышла на первое место по использованию, больше чем вдвое обогнав DeepSeek.

В OpenRouter называют этот запуск крупнейшим в истории площадки.


Сообщество вычислило автора раньше, чем тот представился по характерным ошибкам API и по устройству токенизатора - в Ox Alpha опознали почерк Zai.

Признание компании догадку подтвердило - это новая версия GLM.

Модель заточена под кодинг и сложные агентные задачи. Заодно она меняет прежнее деление линейки - раньше Zai держала отдельно текстовые GLM и визуальные GLM-V, а Ox Alpha мультимодальна.

На OpenRouter модель бесплатна еще неделю, после чего Zai назовет коммерческие тарифы.

Веса обещают выложить сегодня.


@ai_machinelearning_big_data

#news #ai #ml
  • 👍 99
  • 👌 53
  • ❤ 42
  • 👏 19
  • 🔥 16
  • 🎉 10
  • 🤔 2
  • 💯 2
  • 😁 1
  • 🤬 1
Post #10780 25.5K
⚡ Qwen показала Qwen3.8-Flash - мультимодальную MoE-модель и ранний превью архитектуры Qwen4.

- 125B параметров + 51B N-gram embeddings
- активируется всего 6B параметров на токен
- нативный контекст 262K, расширение до 1M через YaRN
- новая архитектура: GDN + QSA hybrid attention, Gated Residual, N-gram Embedding и Muon optimizer
- обучение обошлось примерно в 9 раз дешевле Qwen3.7-Plus

Бенчмарки:
- DeepSWE 1.1 - 58.7
- SWE-bench Pro - 62.5
- CoWorkBench - 73.9
- AndroidWorld - 84.5
- MathVision - 95.7

Продакшен-версия появится в QwenCloud:
$0.16 / 1M входных токенов
$0.47 / 1M выходных токенов

Также Qwen открывает веса Qwen3.8-Flash-Next - ранней версии архитектуры, которую команда исследует для Qwen4.

https://github.com/QwenLM/Qwen3.8-Flash-Next/blob/main/tech_report.pdf

https://huggingface.co/Qwen/Qwen3.8-Flash-Next?spm=a2ty_o06.30285417.0.0.1d73c921FsyOPe&file=Qwen3.8-Flash-Next
  • ⚡ 88
  • 🔥 75
  • 👍 32
  • 🤩 23
  • ❤ 10
  • 🎉 4
  • 👀 1
Post #10779 20K
✔️ OpenAI возвращает пятичасовой лимит подписчикам ChatGPT Plus

С 26 августа для тарифа Plus снова заработает скользящее пятичасовое окно в ChatGPT Work и Codex.

Руководитель Codex Тибо Соттьё объясняет это тем, что лимиты выравнивают нагрузку и не дают случайно спалить недельную квоту за одну сессию.

Подписчиков Pro за 100 и 200 долларов изменение не касается - непрерывный доступ у них останется как минимум на несколько месяцев.

В сообществе решение раскритиковали: одни жалуются на изменение условий после оплаты, другие - что выбирали Codex вместо Claude как раз ради долгих сессий, и теперь собираются пересматривать рабочий стек.
Tibo в X

✔️ Google представила Gemini для юристов

Gemini Enterprise for Legal подключается через коннекторы MCP к профильному софту: iManage, NetDocuments, DocuSign, Everlaw, RelativityOne и Thomson Reuters HighQ.

Платформа разбирает контракты, ведет правовые исследования и следит за изменениями в нормативной базе. Права доступа при этом наследуются из корпоративных политик, которые у компании уже есть, отдельно раздавать их не нужно.

Продукт пока в предварительном тестировании. Похожий инструмент Google уже запустила для финансового сектора, на очереди здравоохранение.
google.com

✔️ NVIDIA показала Jetson Orin Nano 2

Вычислительный модуль рассчитан на дроны и устройства машинного зрения. Внутри восьмиядерный процессор Arm и 8 ГБ оперативной памяти, заявленная производительность - 78 TOPS.

Габариты остались прежними, а инференс, по данным NVIDIA, идет вдвое быстрее, чем у версии Super - обновили тензорные ядра и подняли пропускную способность памяти. Прежнюю производительность модуль выдает при меньшем энергопотреблении.

Через программный стек NVIDIA на модуле можно развернуть оптимизированные для edge-устройств визуальные и языковые модели семейств Cosmos, Nemotron, Gemma 4 и Qwen 3.

В продажу Jetson Orin Nano 2 поступит в первой половине 2027 года.
nvidia.com

✔️ Perplexity выпустила локального ассистента для устройств NVIDIA

Portable Computer одной командой разворачивает инфраструктуру Perplexity на DGX Spark - планировщик задач, маршрутизатор и локальный поисковый индекс.

Работает все на Qwen 3.8 27B и собственной PPLX 27B, следом добавят Nemotron 3.5 Lightning. Если задача сложная, локальный оркестратор может отправить запрос в одну из 15 облачных моделей.

Наружу без явного разрешения пользователя не уходит ничего - это касается и коннекторов к Google Drive, Gmail, Slack и GitHub.

Инструмент доступен подписчикам Pro и Max на Linux. Версию для Windows обещают в ближайшее время. Также в планах поддержка обычных ПК с видеокартами RTX.
perplexity.ai

✔️ Anthropic отправила офис в Сан-Франциско на удаленку

Компания временно перевела сотрудников головного офиса на удаленную работу - из-за возможной забастовки охранников, которых нанимает подрядчик Allied Universal. При этом в профсоюзе SEIU, представляющем охранников, планы на забастовку отрицают - голосование по этому вопросу даже не проводилось.

Переговоры SEIU с охранными агентствами идут с апреля. Профсоюз добивается повышения зарплат, расширения медстраховки и профильного обучения.

В ИИ-индустрии в целом обострилось внимание к физической безопасности - ранее в этом году с угрозами в свой адрес сталкивались сотрудники и Anthropic, и OpenAI.
businessinsider.com


@ai_machinelearning_big_data

#news #ai #ml
  • 👍 87
  • 🤔 54
  • ❤ 21
  • 👏 10
  • 🎉 6
  • 🔥 4
  • 🤬 2
  • 😭 2
  • 😢 1
Post #10778 24.8K
✔️ OpenAI обещает лучший DevDay в истории компании

Руководитель направления Codex Тибо Соттьё пообещал, что в этом году DevDay окажется лучшим за всю историю OpenAI.

Конференция пройдет 29 сентября в Сан-Франциско, открывающий кейноут покажут в прямом эфире.


Послужной список у DevDay говорит о том, что действительно есть чего ожидать:

🟢В 2023 году там показали GPT-4 Turbo, GPTs и Assistants API;

🟢В 2024-м - Realtime API, кеширование промптов и другие инструменты для разработчиков;

🟢В 2025-м - приложения в ChatGPT, AgentKit, API для Sora 2 и GPT-5 Pro, а заодно открыли Codex для всех.

Что готовят в этот раз, Тибо не сказал. В комментариях вангуют релиз Astra, модель следующего поколения, обучение которой в конце июля OpenAI поставила на паузу.


@ai_machinelearning_big_data

#news #ai #ml
  • 💯 50
  • 👍 40
  • 🎉 26
  • 🤩 7
  • ❤ 6
  • 🥱 2
  • 👏 1
Post #10775 24.8K
🔥 OpenAI показала первые результаты своего inference-чипа Jalapeño - и он обходит NVIDIA GB200/GB300 по ключевым метрикам.

В тестах на GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T:

- в 1,5-1,9× выше производительность на ватт
- в 1,7-3,6× ниже end-to-end latency
- до 4,1× выше скорость в интерактивных сценариях
- до 1459 токенов/с на пользователя на GPT-OSS 120B
- до 700 токенов/с на DeepSeek R1

TDP Jalapeño - 700 Вт, но в тестах потребление не превышало 550 Вт.

OpenAI планирует начать развёртывание чипа до конца 2026 года. Gen 2 уже в разработке, Gen 3 формируется.

https://openai.com/index/jalapeno-first-results/
  • 👍 108
  • 🔥 37
  • ❤ 17
  • 🥰 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →