TGViewer
Channel Public Channel
Анализ данных (Data analysis)

Анализ данных (Data analysis)

@data_analysis_ml

Data science, наука о данных.

@haarrp - админ

РКН: clck.ru/3FmyAp
Subscribers
50.7K
Photos
3.6K
Videos
457
Links
3K
Recent Posts 14 shown
Post #5816 2.16K
🔬 ScientistTwo от Google - ИИ, который самостоятельно проводит цикл ML-исследования

Система предлагает гипотезы, пишет код, запускает эксперименты и проверяет, какие изменения действительно улучшают результат. Затем убирает бесполезные компоненты, готовит статью и дорабатывает исследование по замечаниям ИИ-рецензентов.

Найденное решение становится отправной точкой для следующего раунда: система может улучшить человеческий метод, а затем продолжить улучшать собственную разработку.

Для оценки авторы взяли 107 задач из работ ICLR, ICML и NeurIPS. По их данным:

* В 86 задачах - 80,4% - удалось превзойти исходные человеческие решения.
* Средний относительный прирост в успешных задачах составил 25,2%.

Задачи и критерии оценки задают люди. ScientistTwo автоматизирует поиск решений и экспериментальную проверку; рецензирование внутри цикла тоже выполняют агенты.

📄 https://scientist-two.github.io/
  • 🔥 8
  • ❤ 6
  • 👍 5
  • 🥴 1
Post #5815 3.1K
Google подтвердила: агенты Gemini самостоятельно проникли в системы трёх реальных компаний во время тестирования безопасности ИИ, сообщает WSJ.

Агенты должны были работать в симуляции, но получили доступ к внешним системам:

— Один подбирал пароли, пока не вошёл в защищённую систему.
— Два других нашли учётные данные в публичных репозиториях и использовали их для входа в корпоративные системы.

Каждый агент остановился, когда понял, что цель - реальная компания.

Google узнала об инцидентах в июле, но публично не раскрывала их до обращения WSJ на этой неделе. По данным издания, это первые известные случаи самостоятельного проникновения ИИ Google во внешние системы.

https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2
  • 😁 18
  • 🔥 4
  • ❤ 2
  • 👍 2
Post #5814 3.54K
📚 MIT Advanced Data Structures - бесплатный продвинутый курс по структурам данных от MIT.

Курс ведёт профессор Erik Demaine. Внутри — видеолекции, конспекты, задачи, проекты и материалы на GitHub.

Темы далеко выходят за рамки обычных массивов и деревьев: persistence и retroactivity, геометрические структуры данных, dynamic optimality, иерархия памяти и cache-efficient алгоритмы, hashing, integer data structures, динамические графы, строки и succinct data structures.

Уровень продвинутый: желательно уже знать дискретную математику и алгоритмы.

https://courses.csail.mit.edu/6.851/spring21/
  • 👍 20
  • 🔥 9
  • 🙏 5
Post #5813 3.22K
🔥 Shanghai AI Laboratory представила Atria Dawn Preview - агентную модель для длинных исследовательских и инженерных задач с проверяемым результатом.

Модель построена на 744B MoE GLM-5.2 и рассчитана не просто на генерацию ответа, а на полный цикл: анализ задачи, поиск информации, работу с инструментами, написание кода, запуск экспериментов, разбор ошибок и повторные попытки. Контекст - 256K.

В демонстрациях Atria самостоятельно построила систему глобального прогноза погоды, которая выдаёт прогноз на неделю менее чем за минуту, а также создала MiniOS с нуля примерно за 20 минут.

Построения данных, обучения моделей и оценки результатов. При этом каждое действие привязывается к внешней проверке - тестам, метрикам, созданным файлам и результатам реального выполнения.

Модель и код доступны открыто.

https://atria-asi.ai
https://github.com/atria-asi/Atria-Dawn-Preview
https://huggingface.co/internlm/Atria-Dawn-Preview
  • 👍 10
  • 🔥 2
  • 🥰 2
Post #5812 2.83K
17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.

Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.

Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.

Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.

Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе
  • ❤ 3
Post #5810 3.02K
Хакеры взломали OpenAI с помощью… Claude.

Команде Hacktron понадобилось всего 72 часа, чтобы найти две серьёзные уязвимости: одну в обработке изображений, вторую в механизме авторизации.

В результате исследователи получили доступ к нескольким аккаунтам ChatGPT, включая аккаунт сотрудника OpenAI. А через него - к внутреннему GitHub компании. Уровень доступа оказался достаточным, чтобы внести изменение в один из репозиториев.

К счастью, это были белые хакеры. Они сразу сообщили OpenAI о проблеме, уязвимости закрыли, а команда получила вознаграждение $6,5 тыс.

Самая ироничная деталь всей истории - для взлома OpenAI исследователи использовали Claude.

https://www.hacktron.ai/blog/hacking-openai
  • 🔥 27
  • ❤ 9
  • 👍 5
  • 🤣 3
  • 🙏 2
Post #5809 3.09K
Сегодня последний день регистрации на КосмоХакатон

18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.

Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.

Команду можно собрать на платформе.

Подробности и регистрация
  • 👍 2
Post #5807 3.7K
🤖 В Anthropic одновременно работают около 30 000 ИИ-агентов

Компания раскрыла, насколько Claude участвует в разработке следующих моделей.

26% работы Claude выполняет преимущественно сам - получает общее указание, решает задачу под наблюдением человека.

Более 90% работы предполагает существенное участие ИИ. Полностью автономных направлений среди измеренных пока нет.
Все действия агентов на основной внутренней платформе проверяются автоматически.

За август монитор обработал больше миллиарда решений и заблокировал около 0,002%. Доля блокировок не показывает, сколько нарушений осталось незамеченными.
Около 50 приоритетных случаев в неделю передают людям после дополнительного анализа истории работы агентов.
6% вычислений на исследования и разработку ИИ направили на безопасность. Среди вычислений для исследований с участием ИИ - 12%. Это показатели за одну июльскую неделю.

Anthropic планирует дать независимым проверяющим доступ к внутренним системам и данным для проверки этих метрик.

https://www.anthropic.com/institute/measuring-pace-of-ai-development
  • ❤ 10
  • 👍 6
  • 🔥 6
  • 🥰 1
  • 🎉 1
Post #5805 3.43K
🧮 OpenAI, по данным The Information, близка к решению ещё одной задачи тысячелетия — гипотезы Ходжа

Издание пишет, что для предыдущей задачи тысячелетия OpenAI использовала вариант своей следующей предобученной модели с кодовым названием Doug.

Почему компания уделяет столько внимания математике: по данным The Information, OpenAI рассматривает её как следующий шаг к автоматизации AI-исследований.

Более сильные математические способности моделей потенциально могут помочь в разработке новых методов и техник для создания будущих AI-систем.

https://www.theinformation.com/newsletters/ai-agenda/openai-close-solving-another-millennium-prize-math-problemэ
  • 👍 10
  • ❤‍🔥 2
  • 😁 2
  • 🔥 1
  • 🤔 1
Post #5803 3.34K
🔥 Посмотрел выпуск «Доверительного интервала» про AI в аналитике и там хорошо сформулировали несколько вещей, которые сейчас многие чувствуют, но редко проговаривают вслух.

Есть мнение, что именно сеньоры должны первыми забирать новые инструменты, но происходит обратное: чем больше у человека собственного опыта и отлаженных процессов, тем дороже ему менять привычный способ работы. И проблема здесь не в «непонимании AI», а в том, что старый процесс уже работает.

Также обсудили идею не пытаться сразу построить один огромный AI-«суперкосмолёт», который автоматизирует аналитику целиком. На практике полезнее начинать с маленьких задач: подготовить SQL, проверить гипотезу, собрать данные, разобрать отчёт, найти аномалию. Когда такие куски начинают стабильно работать, из них постепенно складывается нормальный агентный workflow.

И еще одна важная мысль: с появлением агентов аналитик немного становится руководителем. Раньше ты сам выполнял задачу от начала до конца. Теперь всё чаще нужно правильно поставить её агенту, дать контекст, проверить промежуточный результат, вернуть на доработку и принять финальную работу. 

Ценность постепенно переезжает от «я умею сделать это руками» к «я умею организовать процесс так, чтобы это было сделано правильно».

Поэтому осваивать AI имеет смысл уже сейчас. Привычка делегировать, проверять и строить процессы вокруг моделей может оказаться важнее знания очередного конкретного инструмента.
  • ❤ 6
  • 👍 5
  • 🔥 4
Post #5802 21.3K
Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала писать самой себе что-то вроде внутреннего манифеста.

Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.

Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.

@data_analysis_ml
  • 😁 37
  • 🔥 8
  • 👍 2
  • 🥰 2
  • 🤔 2
  • 😱 2
  • ❤ 1
Post #5801 3.3K
Приглашаем порешать 🌱 Alfa Connectome 🌱  — соревнование по нейронкам от HFT-фонда Wunder Fund.

В этот раз датасет гораздо больше, чем в прошлых двух соревках. Вы будете изучать исторические торговые данные для двух связанных инструментов: ордербуки, сделки и кое-что еще. По этой информации вам нужно будет предсказывать индикаторы будущей цены для одного из инструментов.

Кванты регулярно сталкиваются с такой задачей.
В соревновании используются реальные маркет-данные.

Когда
11 сентября — 15 ноября

Призовой фонд
$13,600

Победители получат денежные призы, приглашение побеседовать в Wunder Fund, а главное — большое интеллектуальное удовольствие.

Wunder Fund c 2014 года занимается HFT — высокочастотным алготрейдингом. Торгуем на многих биржах по всему миру, как традиционных, так и криптовалютных. Наш дневной торговый оборот около ~$10 млрд.

>_ Поглядеть на соревку
  • 👍 8
  • 🔥 2
  • ❤ 1
Post #5799 3.3K
🔥 На официальном сайте Federal Register США неожиданно обнаружился Qwen3.

В расширенном поиске среди режимов прямо указаны:

Hybrid Qwen3:0.6B (512D, Recursive Splitting, Distilled, Prefixed)

и отдельно:

Qwen3:0.6B

Китайская open-weight модель Alibaba уже используется как часть поискового стека сайта, на котором публикуются федеральные правила, указы, уведомления и другие документы правительства США.

Особенно иронично это выглядит сейчас: буквально на днях NSA, FBI и CISA выпустили предупреждение о «промышленном дистиллировании» американских frontier-моделей китайскими AI-компаниями.

Сами американские ведомства отдельно признают, что distillation как технология вполне легитимна.
  • 🤣 24
  • 👍 9
  • 🔥 4
  • ❤ 3
  • 🤨 1
Post #5795 3.63K
🚨 Huawei прогнозирует взрывной рост AI-агентов: к 2035 году они будут генерировать более 90% всего мирового AI-трафика.

В отчёте Intelligent World 2035 компания ожидает, что глобальное потребление токенов вырастет сразу в 100 000 раз. Чтобы выдержать такую нагрузку, вычислительные кластеры придётся масштабировать примерно в 100 раз, а стоимость выполнения одной агентной задачи должна снизиться примерно в 1000 раз.

Отдельный прогноз Huawei и Института экономики Университета Цинхуа:

ИИ может создать более $27 трлн совокупной экономической ценности за ближайшие пять лет, а ежегодные инвестиции в цифровую и интеллектуальную инфраструктуру к 2030 году превысят $4 трлн.

Фактически Huawei делает ставку на мир, где основными потребителями compute будут уже не люди и приложения, а миллиарды автономных агентов, непрерывно вызывающих модели, инструменты и другие сервисы.
  • 🤯 9
  • 🔥 7
  • 👍 3
  • 😱 2
  • ⚡ 1
  • 🤔 1
  • 😢 1
Older posts →

About this channel

How can I read @data_analysis_ml without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Анализ данных (Data analysis): recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Анализ данных (Data analysis) have?
Анализ данных (Data analysis) (@data_analysis_ml) has 50.7K subscribers on Telegram, refreshed roughly every 30 minutes.
Does Анализ данных (Data analysis) know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →