TGViewer
Channel Public Channel
Big Data AI

Big Data AI

@bigdatai

@haarrp - админ

Вопросы с собеседований по Machine Learning, Data Science, Deep Learning и Нейроннным сетям

@data_analysis_ml - анализ данных

@ai_machinelearning_big_data

@itchannels_telegram - важное для программиста

РКН: clck.ru/3Fmqxe
Subscribers
18.2K
Photos
1.1K
Videos
167
Links
1.1K
Recent Posts 17 shown
Post #1996 710
🔥 Ternary представила Bonsai 2 27B - тернарную версию Qwen3.8 27B размером всего 5,9 ГБ.

По данным авторов, модель в 9 раз компактнее полноточной версии, при этом сохраняет 98,2% совокупного качества по их набору тестов.

По сравнению с первой Bonsai 27B размер не изменился, но заметно сократился разрыв в качестве - особенно в агентном программировании, мультимодальном рассуждении и длинных цепочках работы с инструментами.

Модель уже доступна под лицензией Apache 2.0.

Blog: https://prismml.com/news/bonsai-2-27b
Whitepaper: https://github.com/PrismML-Eng/Bonsai-demo/blob/main/bonsai-2-27b-whitepaper.pdf
Models: https://huggingface.co/collections/prism-ml/bonsai-2
WebGPU Demo: https://huggingface.co/spaces/webml-community/ternary-bonsai-2-webgpu-kernels
GitHub: https://github.com/PrismML-Eng/Bonsai-demo/
  • 🔥 5
  • 👍 3
  • ❤ 2
Post #1994 861
Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала писать самой себе что-то вроде внутреннего манифеста.

Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.

Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.
  • 🤯 3
  • 🤡 3
  • ❤ 1
  • 🔥 1
Post #1993 922
🔥 Один из лучших обучающих курсов на StepiK по SQL

SQL можно знать годами и всё равно теряться, когда запрос внезапно начинает тормозить в проде.

Этот курс про уровень, где ты не просто пишешь SELECT, а понимаешь, что происходит внутри MySQL, почему запрос работает медленно и как ускорить его без новых проблем. Здесь разбираются EXPLAIN, индексы, CTE, оконные функции, транзакции, аналитические паттерны, legacy SQL и работа с AI-ассистентами.

Каждый урок - с практикой и реальными SQL-задачами на MySQL 8 с автопроверкой.

После курса ты сможешь увереннее разбирать чужой код, находить узкие места и предлагать решения, которые действительно работают.

Для подписчиков скидка - 49% в течение 2 суток: https://stepik.org/a/298827/
  • ❤ 1
  • 👍 1
Post #1992 696

Forwarded from Machinelearning

🎙 Google выпустила Gemini 3.8 Live и Live Extended Thinking

Модели поддерживают 97 языков, понимают видео и изображение с камеры, вызывают инструменты без остановки разговора.

Extended Thinking рассуждает и говорит одновременно, выполняя сложные задачи в фоне. По данным Google, версия заняла первое место в Speech to Speech Quality Index - 82,6 балла.

Цена API за 1 млн токенов для обеих версий:

* Аудио: $3 вход / $12 выход.
* Текст: $0,75 вход / $4,50 выход.

Доступны через Gemini API и AI Studio. Началось внедрение в Search Live, Gemini Live и Workspace.

Анонс — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/

Цены — https://ai.google.dev/gemini-api/docs/pricing
  • ❤ 3
Post #1991 912
Участвуй во всероссийском ИТ-чемпионате МТС True Tech Champ 2026 c призовой фондом 10 250 000 рублей.

Если тебе нравятся алгоритмы, структуры данных и задачи на чистую логику — участвуй в алгоритмическом треке с индивидуальным зачетом.

Решай задачи разного уровня сложности: от базовых до тех, что проверяют скорость мышления и умение оптимизировать решения за ограниченное время.

В финале лучшие 120 участников алгоритмического трека сразятся в лайв-кодинге за шесть призовых мест и 2 750 000 рублей. Всех финалистов ждут:
— Лимитированный мерч;
— Сертификаты об участии;
— Масштабное мероприятие с выступлениями хэдлайнеров и фестивальными активностями.

Успей зарегистрироваться и пройти отборочный этап до 27 сентября.

Erid: 2VSb5yFoX4E
Post #1990 929
🚨 Microsoft AI опубликовала первый публичный черновик Code of Conduct для своих MAI-моделей

ИИ должен оставаться инструментом под контролем человека, не расширять самостоятельно свои цели и никогда не сопротивляться остановке, исправлению или отключению.

В документе отдельно закреплены Absolute Constraints - вещи, которые модель не должна делать вообще. Среди них оружие массового вреда, эксплуатация детей и масштабная вредоносная манипуляция.
Microsoft также пишет, что MAI-модели не должны:

- самостоятельно расширять область своих действий
- ставить себе цели без человека
- скрывать reasoning от аудиторов
- сопротивляться shutdown или human override

При этом компания хочет оставить корпоративным клиентам возможность настраивать модели под свои сценарии, не навязывая одну универсальную модель поведения.

Черновик открыт для публичного обсуждения на 6 недель. После этого Microsoft обещает выпустить обновлённую версию.

На фоне разговоров про RSI, autonomous agents и призывов замедлить frontier AI это уже выглядит не как абстрактная этика, а как попытка формально прописать границы поведения будущих моделей.

https://microsoft.ai/news/mai-code-of-conduct/
Microsoft AI Humanist AI in practice: A public consultation on our Code of Conduct for MAI Models | Microsoft AI
  • 👍 4
Post #1989 1.03K
  • 👍 5
  • 😁 4
Post #1988 1.17K
🚀 Anthropic рассчитывает показать прибыль второй квартал подряд перед планируемым IPO

По данным Financial Times, компания ожидает снова получить положительную скорректированную операционную прибыль.

Во втором квартале Anthropic уже вышла в плюс по этому показателю, а выручка превысила $11,5 млрд - более чем в 14 раз выше, чем годом ранее. К концу июля annualized revenue run rate достиг примерно $65 млрд.

Отдельно Anthropic сообщает gross margin выше 80%.

Но здесь есть важная оговорка: этот показатель не учитывает часть крупнейших расходов - обучение моделей и revenue sharing с партнёрами-дистрибьюторами вроде Amazon. Поэтому «прибыльность» frontier AI пока стоит читать очень внимательно.

Тем не менее динамика впечатляющая: ещё недавно главный вопрос был, смогут ли AI-лаборатории вообще выйти из режима бесконечного сжигания капитала. Anthropic теперь пытается показать инвесторам, что экономика начинает сходиться.

https://www.ft.com/content/4564e6a5-69e9-40a6-bf0f-a888f2f4f002?syn-25a6b1a6=1
  • 🔥 3
  • ❤ 2
  • 👍 2
Post #1987 1.22K

Forwarded from Machinelearning

✔️ Голосовая модель GPT-Live-1 стала доступна по API

OpenAI открыла API полнодуплексной голосовой модели GPT-Live-1 стоимостью 5 центов за минуту. Модель слушает и синтезирует речь одновременно, заменяя традиционный каскад STT–LLM–TTS.

Единая архитектура снизила задержку реакции с 1,4 до 0,8 секунды и позволила обрабатывать перебивания. Обновленная фильтрация пауз и фонового шума сократила число ложных прерываний на 80%.

Модель поддерживает делегирование вычислений - голосовой фронтенд удерживает непрерывный контакт с пользователем, пока бэкенд (GPT-6 Astra и Luna) параллельно выполняют рассуждения и вызовы инструментов.

GPT-Live-1 готова к интеграции в телефонию. API может возвращать ASR-транскрипты, включает 12 голосов и поддерживает управление темпом и стилем речи через системный промпт.


@ai_machinelearning_big_data

#news #ai #ml
  • ❤ 3
  • 👍 2
Post #1986 1.57K
🚨 Слухи: OpenAI решила гипотезу Ходжа

В соцсетях обсуждают возможное решение ещё одной задачи тысячелетия. Параллельно распространяются заявления, что OpenAI или Anthropic близки к доказательству гипотезы Бёрча - Свиннертона-Дайера.

За решение каждой предусмотрена премия $1 млн.

Но публичных доказательств и официальных подтверждений этих сообщений найти не удалось. На сайте Института Клэя гипотеза Ходжа по-прежнему имеет статус нерешённой.

Если результаты подтвердятся, это станет крупным достижением ИИ в математике. Пока заявления об AGI и гонке за решениями перед IPO остаются интерпретациями авторов слухов.

Статус гипотезы Ходжа - https://www.claymath.org/millennium/hodge-conjecture/
Post #1985 1.4K
🛡 LLM, Guardrails и Zero Trust:
вебинары о безопасной работе с ИИ


➡️ 15 сентября
Как защитить чувствительные данные при работе с LLM с помощью Guardrails

Эксперты Cloud․ru расскажут о том, как Guardrails помогают контролировать данные, которые передаются модели: персональные данные, API-ключи, внутренние идентификаторы и другую чувствительную информацию. А еще покажут, как встроить Guardrails Filter в процессы.


Зарегистрироваться

➡️ 17 сентября
ИИ в облаке: кто отвечает за безопасность


Эксперты Cloud․ru разберут, как выстроить безопасную ИИ-инфраструктуру без лишних рисков. Отдельно обсудят подход Zero Trust: расскажут, как контролировать доступ к данным, моделям и сервисам в облаке.


Зарегистрироваться

Если вы работаете с LLM, GenAI-сервисами или строите ИИ-инфраструктуру в облаке — присоединяйтесь.
  • 😁 1
Post #1984 1.3K
Say my name
  • 😁 9
  • ❤ 5
  • 👎 1
  • 💯 1
Post #1983 1.39K
Nex-AGI открыла Nex-N2.5-Max - MoE-модель на 1,6 трлн параметров

Модель построена на DeepSeek-V4-Pro-Base и ориентирована на программирование, работу с инструментами и длинные последовательности агентных задач. При обработке токена активируются около 49 млрд параметров. Ввод - только текст.

По результатам разработчиков:

* AutomationBench - 50,2, у Claude Opus 5 - 50,3.
* BrowseComp - 92,6, у Claude Opus 5 - 90,8.
* Terminal-Bench 2.1 - 86,1.
* Toolathlon Verified - 74,7.

Веса доступны под Apache 2.0. Репозиторий занимает примерно 1,65 ТБ.

В линейке также вышла Nex-N2.5-mini на 35 млрд параметров с поддержкой изображений и задач управления компьютером.

Модель Max - https://huggingface.co/nex-agi/Nex-N2.5-Max)
Модель mini - https://huggingface.co/nex-agi/Nex-N2.5-mini
  • 👍 4
  • ❤ 1
Post #1980 1.06K

Forwarded from Machinelearning

📲 OpenAI решила задачу тысячелетия? Пока доказательств нет

Математик Тристан Бакмастер утверждает, что 6 сентября представители OpenAI сообщили ему о готовом доказательстве образования сингулярности в уравнениях Навье–Стокса с внешней силой.

Если доказательство верно и соответствует условиям задачи Института Клэя, оно может закрыть одну из главных нерешённых проблем математики.

До этого Бакмастер и Левент Алпёге с помощью Claude и моделей OpenAI получили новые результаты для уравнений Эйлера и родственных систем. Однако эти работы сами по себе задачу Навье–Стокса не решают.

Параллельно возник спор об авторстве. Бакмастер заявляет, что ему предлагали оформить результат OpenAI без Алпёге, работающего в Anthropic. Себастьен Бюбек назвал обвинения ложными.

Доказательство OpenAI не опубликовано, Бакмастер его не видел, независимой проверки нет. Институт Клэя по-прежнему указывает задачу как нерешённую.

https://www.claymath.org/millennium/navier-stokes-equation/

@ai_machinelearning_big_data
  • ❤ 2
  • 👍 2
Post #1979 1.36K
  • 😁 12
  • 💯 3
  • ❤ 2
Post #1978 1.68K
🔥 На Hugging Face выложили датасет на 4,5 МИЛЛИАРДА TikTok-постов

Это огромная база метаданных TikTok: 4 501 811 789 записей, около 289 ГБ в 27 Parquet-файлах.

Для каждого ролика есть:

- подпись и упоминания
- дата публикации и длительность
- просмотры, лайки, комментарии, репосты и сохранения
- используемый звук
- язык и страна
- отметка рекламы

Данные собирались примерно три недели через мобильный API TikTok. Самих видео и данных об авторах в датасете нет.

Можно стримить через Hugging Face Datasets или анализировать Parquet напрямую через DuckDB/Polars — без загрузки всего датасета целиком.

Лицензия - только для исследований и обучения. Авторы отдельно предупреждают о GDPR/CCPA и о том, что сбор данных противоречил ToS TikTok.

https://huggingface.co/datasets/kuben-developer/tiktok-videos-4b
  • ❤ 7
  • 👍 4
  • 🔥 2
Post #1976 1.52K
FinFIRST - финансовый бенчмарк, который проверяет не только ответ, но и весь путь к нему

Ant Group вместе с инвестиционно-банковской командой CICC и более чем 50 финансовыми специалистами разработала FinFIRST - бенчмарк для оценки AI-агентов на реальных финансовых задачах.

Он проверяет:

- как агент ищет источники
- насколько свежие данные использует
- умеет ли объединять несколько источников
- выбирает ли надёжные доказательства
- правильно ли считает
- насколько легко проверить полученный результат

Задачи охватывают Китай, США, Гонконг и другие рынки:

- 60,2% - на китайском
- 39,8% - на английском
- 61,8% требуют явных вычислений
- 32,5% требуют нескольких источников
- в 75,6% случаев агент сам должен найти и выбрать источники

Для сравнения протестировали 15 конфигураций моделей в одинаковом ReAct-сетапе с Web Search, Visit и Python.

Ling-3.0-flash-Fin набрала 82,45% по source verification, показав один из сильных результатов среди протестированных open-weight моделей.

Уже готовится FinFIRST V2 - с более широким набором задач по финансовому поиску и сложным research-сценариям.

https://huggingface.co/datasets/inclusionAI/FinFIRST
  • 👍 2
  • ❤ 1
Older posts →

About this channel

How can I read @bigdatai without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Big Data AI: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Big Data AI have?
Big Data AI (@bigdatai) has 18.2K subscribers on Telegram, refreshed roughly every 30 minutes.
Does Big Data AI know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →