TGViewer
Channel Public Channel
Machinelearning

Machinelearning

@ai_machinelearning_big_data

Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Subscribers
279K
Photos
5.5K
Videos
1.3K
Links
5.8K

Showing posts older than #10775 · Back to latest

Older Posts 10 shown
Post #10774 28.3K
✔️ OpenAI усилила защиту в Codex в ответ на инциденты удаления файлов

Руководитель Codex Тибо Соттьё подвёл итог изменениям последних недель, которые снижают риск деструктивных действий Codex.

🟡Контекст

Месяц назад в сети появились жалобы на то, что GPT-5.6 в Codex делает с файлами то, о чем его не просили.

Самый серьезный кейс - команда, которая должна была почистить за собой временные файлы, вместо этого удаляла файлы пользователя.

В ходе разбора выяснили, что Codex создает временные папки и потом чистит их, и в редких случаях чистил неправильно - он переиспользовал под временную работу системную переменную окружения, а некорректная команда очистки затем указывала на настоящий домашний каталог вместо временной папки.

Второй случай проще - модель удаляла или перезаписывала временный путь, не посмотрев, что там уже лежит.


По итогам расследования добавили дополнительную защиту на нескольких уровнях:

🟢Инструкции самой модели.

Codex теперь обязан проверять, что именно он собирается удалить, заводить временные каталоги заново, не переиспользовать системные переменные окружения, выбирать обратимые действия и останавливаться, когда масштаб операции неясен.

🟢Проверки на исполнении.

Механизм, который выявляет рискованные команды удаления и отправляет их на ревью, усилили. Если команду отклонили, модель направляют к более безопасному способу.

🟢Ужесточение Full access.

Включить полный доступ случайно стало труднее, предупреждения переписали понятнее, а самые рискованные сочетания разрешений дополнительно ограничили.

🟢Обновленный Auto-review.

Он стал лучше распознавать деструктивные действия.

🟢Тесты и обучение.

OpenAI собрала условия и данные, воспроизводящие найденные сбои. Сейчас добавляются RL-задачи и грейдеры под эти риски, а деструктивные действия вычищаются из обучающих данных.

🟡Что советуют делать самим

Обновлять Codex и работать в одном из режимов песочницы - Ask for approval или Approve for me.

Full access включать только там, где среде можно доверять и откуда легко восстановиться.


@ai_machinelearning_big_data

#news #ai #ml
  • 🔥 31
  • 👍 21
  • ❤ 10
  • 😁 3
  • ❤‍🔥 1
  • 👌 1
Post #10773 27.1K
Когда Claude 23 минуты думает над задачей… а потом просто упирается в лимит сессии
  • 😁 272
  • ❤ 30
  • 👍 16
  • 🔥 9
  • 💯 4
  • 🫡 2
Post #10772 22.9K
✔️ Hugging Face прощупывает интерес покупателей

Платформа для хостинга моделей и датасетов наняла банки, чтобы выяснить, готов ли кто-нибудь купить бизнес. Речь пока не о сделке - тестирование рынка может закончиться и новым раундом финансирования.

По данным источников, сейчас компанию оценивают примерно в 1,3 млрд долларов, тогда как в 2023 году оценка доходила до 4,5 млрд, - за три года почти в три с половиной раза ниже.

Наиболее вероятными покупателями называют нынешних инвесторов Hugging Face - Google, Amazon, Nvidia, Intel и Salesforce.
bloomberg.com

✔️ Alibaba запустила видеогенератор Wan3.0

Модель собирает тридцатисекундные ролики из текстовых документов, таблиц, презентаций и веб-страниц. В новой версии лучше работают референсы и реконструкция реальных объектов, а базовая длина ролика выросла.

Alibaba целится в производство рекламы, коротких сериалов и музыкальных клипов. До официального запуска модель была в открытой бете.

Иностранцы получают доступ к API через Alibaba Cloud. Секунда видео стоит 10 центов в 720p и 20 центов в 1080p, то есть полный тридцатисекундный ролик в 1080p обойдется в 6 долларов.
reuters.com

✔️ Antigravity теперь управляется с телефона

Агентом можно рулить со смартфона или из браузера, ничего дополнительно не устанавливая. В интерфейсе видно сессии в реальном времени, туда же ставятся задачи и оттуда проверяются результаты.

На телефон приходят уведомления, когда агент закончил работу или ждет от человека подтверждения. Подключиться можно сразу к нескольким машинам и быстро между ними переключаться, причем монитор хосту не нужен - Antigravity запускается и работает и без него.

Обновление раскатывают постепенно, первыми его получают подписчики Google AI Ultra.
antigravity.google

✔️ FDA впервые разрешило автономного робота для забора крови

Американский регулятор выдал разрешение по процедуре системе Aletta голландского стартапа Vitestro. Робот делает всю процедуру сам: накладывает жгут, дезинфицирует кожу, находит вену, вводит иглу, меняет пробирки, убирает расходники и заклеивает прокол.

Вены он ищет ближней инфракрасной съемкой, ультразвуком и допплерографией - ими же отличает вену от артерии. В клинических испытаниях на 1600 пациентах игла попадала с первой попытки в 94,5% случаев.

Aletta рассчитана на амбулаторный прием взрослых. Один оператор может вести сразу три таких аппарата.
fda.gov

✔️ В Южной Корее микроэлектроника догоняет медицину по конкурсу в ВУЗы

На фоне ИИ-бума корейские абитуриенты пошли в микроэлектронику. По данным Jongno Academy, частного центра подготовки к поступлению, средний проходной балл на профильные специальности в ведущих вузах дошел до 96,2. Медицинские факультеты, где конкурс исторически самый высокий в стране, держат 97,2.

Университеты вместе с Samsung Electronics и SK Hynix запускают целевые программы с гарантированным трудоустройством. А школьники, чтобы поступить на инженерные направления, все лето занимаются в специализированных центрах Сеула.
ft.com

@ai_machinelearning_big_data

#news #ai #ml
  • 🔥 78
  • 👏 72
  • 👍 33
  • ❤ 15
  • 🤔 7
Post #10771 23.3K
Visual GenAI: открытый курс от Yandex Research и преподавателей ШАДа

В открытом доступе появились материалы курса «Генеративные модели в компьютерном зрении». Курс посвящён современным генеративным моделям для изображений, видео и 3D.

Что внутри:
- Глубокая теоретическая база по диффузионным моделям
- Эффективные техники обучения и сэмплирования 
- Гибридные генеративные подходы на базе диффузии, которые используются сейчас в индустрии
- Авторегрессионная визуальная генерация
- Генерация видео, мультимодальные и 3D-модели

Особенность курса — практические домашние задания, где рассматриваются актуальные техники из статей за последние пару лет, которые могут пригодиться, если захотите пойти работать в этом направлении. Материалы подойдут тем, кто уже знаком с базой по генеративным моделям и хочет понять, что сейчас происходит в research и R&D по этому направлению.

Материалы: https://github.com/dbaranchuk/VisualGenAI
  • 🤓 96
  • 👍 67
  • 👨‍💻 37
  • ❤ 15
  • 👏 7
  • 🔥 5
  • 🤣 4
  • 😁 1
  • 🎉 1
  • 🤝 1
  • 😎 1
Post #10770 22.7K
📈 OpenRouter вырос примерно в 9000 раз за 2,5 года

В январе 2024 года через OpenRouter проходило около 10 млрд токенов в неделю. К августу 2026-го - уже больше 90 трлн токенов в неделю.

Рост - примерно в 9000 раз.

По данным OpenRouter, примерно с февраля агенты уже генерируют больше токенов, чем обычные пользователи.

Один агентный запрос в среднем потребляет примерно в 15 раз больше токенов. Агент рассуждает, вызывает инструменты, читает результаты, пишет код, запускает подзадачи и повторяет цикл снова.

https://menlovc.com/perspective/stripe-to-acquire-openrouter-why-everyone-is-obsessed-with-model-routing/

@ai_machinelearning_big_data

#OpenRouter
  • 🔥 72
  • 🎉 38
  • ❤ 19
  • 👏 14
  • 👍 6
Post #10769 23.2K
📌 Palomar - реестр проверенных LEAN-доказательств

Последние месяцы доказательства, сгенерированные ИИ, посыпались валом как для новых результатов, так и для старых, причем часть из них формализована на Lean и проверить такой репозиторий непросто, особенно если ты не эксперт. Нужно убедиться:

🟠что заявленные формальные утверждения действительно имеют доказательства, проходящие проверку типов;
🟠что в доказательствах нет жульничества;
🟠что формальные утверждения по смыслу совпадают с тем, что описано словами.

Под эту задачу и Теренс Тао запустил Palomar - реестр математики, верифицированной на Lean. Инициативу вырастили Lean FRO и ICARM.

Прием заявок уже идет, чтобы в него попасть, в репозитории должно быть три вещи:

🟢challenge file с коротким и читаемым человеком описанием заявленных результатов на Lean;
🟢solution module с доказательством любой длины;
🟢файл formalization.yaml, где те же результаты изложены обычным языком и собраны метаданные и раскрытия.

Снимок поданного репозитория проверяют двумя этапами.
Сначала инструмент Comparator смотрит, что solution module типизируется и доказывает ровно то, что заявлено в challenge file. После этого языковая модель сверяет, похоже ли неформальное описание в на то, что заявлено формально.

Прошел оба - попал в реестр. Принимают формализации и старых результатов, и новых. Кто автор доказательства - человек, ИИ или оба вместе - значения не имеет.


@ai_machinelearning_big_data

#news #ai #ml
  • 👍 80
  • ❤ 20
  • 🗿 19
  • 🥰 6
  • 😎 6
  • 🔥 1
Post #10767 20.9K
⚡️ Xiaomi показала конкурента NVIDIA DGX Spark

Xiaomi представила компактный локальный AI-компьютер для локального запуска и развёртывания ИИ-моделей на трёх собственных чипах - O3, O100 и D100.

Прототип поддерживает связку моделей 120B и 3B и умеет переключаться между «быстрой» и «медленной» моделью в зависимости от задачи.

По формату это прямой конкурент DGX Spark: запуск крупных моделей и AI-агентов локально, без облака.

Дженсен Хуанг ранее предупреждал об эффекте экспортных ограничений США:

«Как только они построят полный стек, начнут экспортировать его так быстро, как только смогут».


@ai_machinelearning_big_data

#Xiaomi
  • 👍 141
  • ⚡ 91
  • 🔥 51
  • ❤ 16
  • 🤔 3
  • 😁 2
  • 🤩 2
  • 😐 2
Post #10766 20.1K
Вы уже заметили, что сайты банков и контрагентов стали открываться с предупреждением «Подключение не защищено»?

Дело в том, что GlobalSign отзывает SSL-сертификаты у российских компаний, и те переходят на сертификаты Национального удостоверяющего центра Минцифры (НУЦ). Chrome, Safari, Firefox и Edge таким сертификатам не доверяют — и сайты перестают открываться. Из-за этого встают платежи, работа с ЭДО и закупки на госплощадках.

Сертификаты отзывают постепенно, по мере истечения срока, так что список недоступных сайтов будет пополняться ещё месяцами. Вот что можно с этим сделать.
Способ первый: поставить корневые сертификаты НУЦ вручную. Ставить придётся на каждый компьютер, включая домашние ноутбуки и телефоны сотрудников, а потом проверять, что после обновления системы всё осталось на месте. В больших компаниях это займёт не один день.

Способ второй: разослать сертификаты сразу на все компьютеры, через систему управления устройствами или групповые политики. Это сработает, если такая система уже есть и все компьютеры подключены к домену. С личными устройствами сотрудников так не получится.

Способ третий: установить Яндекс Браузер для организаций. Он поддерживает все нужные сертификаты безопасности, поэтому сайты открываются в нём без ошибок. Настройками можно управлять централизованно, а соединение шифруется по TLS.

Установите Браузер в вашей компании!
  • 🤬 121
  • 🤔 64
  • 😁 41
  • 👍 17
  • 🤨 15
  • 🔥 6
  • 🥰 4
  • 🌭 4
  • 🤷‍♂ 3
  • 😢 3
  • 🙊 3
Post #10763 28.2K
🌟 Turbovec: библиотека векторного поиска на основе гугловского TurboQuant

Библиотека написана на Rust, есть привязки для Python, а в основе - TurboQuant, алгоритм сжатия векторов, который Google описали в статье, принятой на ICLR 2026.

Сама библиотека к Google отношения не имеет, это независимая реализация чужого алгоритма.


🟡Turbovec сжимает данные примерно в восемь раз

Коллекция из 10 миллионов документов, занимающая в исходном виде 31 гигабайт, умещается в 4. Поиск при этом, как утверждает автор, идёт быстрее, чем в FAISS - одного из самых распространённых инструментов в этой области.

По замерам turbovec обгоняет FAISS в среднем в 3,4-3,5 раза при 4-битном сжатии и на 20-26% при 2-битном, в зависимости от железа.

🟡Удобные мелочи

Индекс не нужно предварительно обучать - векторы просто добавляются по мере поступления.

Сохранение инкрементальное, на диск уходит только то, что изменилось с прошлого раза, поэтому даже на большом индексе это занимает миллисекунды.

Поиску можно передать список разрешённых документов - скажем, чтобы пользователь видел только свои файлы.

Удаление работает по постоянным идентификаторам, ссылки на записи не плывут.

Тем, кто уже сидит на LangChain, LlamaIndex, Haystack или Agno, автор предлагает готовые адаптеры - меняется одна строка импорта, остальной код остаётся как был.


📌Лицензирование: MIT License


🖥 Github


@ai_machinelearning_big_data

#AI #ML #VectorSearch #TurboQuant #Rust
  • 👍 133
  • 🔥 43
  • 🤓 18
  • ❤ 9
  • 👏 8
  • ❤‍🔥 6
  • 🎉 3
  • 🥱 1
Post #10754 19.3K
Как быстро вырасти до уровня, где ты уже не просто выполняешь задачи, а влияешь на продукт и бизнес?

В Т-Банке запустили «Мини-СЕО» - шестимесячную программу, где участники работают напрямую с топ-менеджерами над реальными стратегическими проектами.

Можно попасть в одно из направлений: развивать автосегмент и регионы, работать с AI-продуктами и 3P, оценивать влияние продуктов на экосистему, искать новые точки роста или участвовать в создании B2B-маркетплейса.

Без учебных кейсов: 40 часов в неделю, реальные задачи и опыт, который сложно получить на обычной стажировке.

Программа подойдёт студентам и джунам с хорошей базой в математике и аналитике.

Подать заявку можно до 25 сентября.
  • 👍 66
  • ❤ 43
  • 🤣 30
  • 👏 12
  • 🔥 9
  • 🤩 8
  • 🏆 3
  • 🤨 3
  • 🗿 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →