TGViewer
Channel Public Channel
Научный опенсорс

Научный опенсорс

@scientific_opensource

Канал сообщества ITMO OpenSource, посвященного созданию и использованию наукоёмких open-source проектов, в том числе в области AI/ML.

Чат: https://t.me/itmo_opensource

По всем вопросам - @nicl_nno
Subscribers
982
Photos
126
Videos
1
Links
199

Showing posts older than #192 · Back to latest

Older Posts 20 shown
Post #191 2.03K
Наше сообщество ITMO OpenSource традиционно организует трек "Open Source" на конференции DataFest.

Этот год - не исключение. Уже открыта форма для подачи докладов на DataFest 2026 - так что начинаем собирать программу. Все заявки рассмотрим и дадим обратную связь.

Наш трек называется "Группа 3, DS/ML закулисье - Open Source"

В докладах особенно будут приветствоваться упор именно на опенсорсные аспекты - аналитику, лучшие практики, истории успехов или неудач.
Именно для презентации конкретных проектов лучше подходят смежные треки - но все решается индивидуально.

Дедлайн подачи доклада: 30 апреля
Даты самой конференции: 23 — 31 мая
Города: Москва, Санкт-Петербург, Новосибирск, Уфа (новая локация!), Алматы, Белград. Онлайн тоже можно.

Не затягивайте с подачами заявок - очные слоты могут закончиться!

Другие треки конференции можно посмотреть тут.
  • 🔥 4
Post #190 955
Попался сегодня пост про AI4Science, с многими мыслями из которого соглашусь:

Делимся тезисами Александра Кустова, которые уже разошлись по академической среде — и многим они явно не понравились.

* Классическая академическая статья — формат, который доживает последние дни.
* Коммерческая система научных журналов может этого не пережить.
* Учёные предъявляют к ИИ абсурдно двойные стандарты.
* Молодым исследователям достанется и главный удар, и главный шанс.
* В работе классического research assistant почти не осталось прежнего смысла.
...
* По-настоящему важные вопросы — это безопасность и проверка результатов.
* Качественные исследования и сбор уникальных данных только вырастут в цене.
* Споры об ИИ всё сильнее зависят не от фактов, а от личной веры в его полезность.
* Качество результата по-прежнему определяется не ИИ, а уровнем самого пользователя.
* Большинство научных статей уже читают не люди, а машины.
* Атрофия навыков — реальный риск, особенно для будущего поколения учёных.
* Детекторы ИИ-текста и нормы обязательного раскрытия почти не работают.
* Academic Bluesky — не то место, где сегодня возможен серьёзный разговор об ИИ.
* Исследование может быть «без души» — и всё равно приносить пользу обществу.

Особенно в части изживания классического формата научной статьи. Кажется, сейчас секции статей, посвященных экспериментам с применением ML (в разных областях, не только CS), уже сейчас де-факто просто пересказывают jupyter-ноутбуки с потерей деталей.

При этом, сейчас даже топовые конференции не энфорсят наличие кода - вот сейчас на ICML ревьюил, и 2 из 3 статей код не приложили вообще.
Про явное соотнесение экспериментов в статье с кодом/данными/моделям для их запуска даже не говорю.
  • 👍 4
  • 🤔 4
Post #189 689

Forwarded from Зоопарк из слоновой кости

#пост_по_регламенту

Итак, продолжаем выкладывать трудолюбиво собранные нашим Зоопарком папки, которые, как нам кажется, уже более или менее готовы. Если кто еще хочет в них добавиться - пишите в ЛС нашего Зоопарка или в комменты (но не затягивайте, максимум в течение пары часов, иначе для вас полностью теряется смысл).

Встречайте, смотрите, выбирайте на свой вкус и добавляйтесь!

Сегодня у нас их сразу четыре:

Физика (12 каналов)

Химия (25 каналов)

Инженеры-технари (11 каналов) и

"Научно-общеполезное" (19 каналов)

Как и раньше, собираем отдельно "мегапапку" - самые крупные, избранные каналы о науке и образовании (или просто особо понравившиеся нам). Она выйдет малость попозже.
Telegram phys feb 26 Смотритель Зоопарка invites you to add the folder “phys feb 26”, which includes 13 chats.
  • 🔥 3
  • ❤ 1
  • 👍 1
Post #188 1.02K
Очередной выпуск с тематическими подборками научных каналов от "Зоопарка" - можно полистать на предмет интересного.

На этот раз вошли в категорию "общеполезное".
  • 🔥 3
Post #187 1.6K
И снова про OSA - но теперь на английском! Написали длинный гайд по использованию и выкатили его на TDS:

https://towardsdatascience.com/an-end-to-end-guide-to-beautifying-your-open-source-repo-with-agentic-ai/

Приятно, что редакция признала проект общественно-полезным и опубликовали несмотря на то что это своего рода "само-реклама":
We don't often publish articles that are framed around the launch of the author's new tool/product or geared towards explaining how to use it, but given your project's open source status and its potential relevance for many of our readers, we can be more flexible, and would be happy to publish it.

Если у вас есть англо-говорящие коллеги, которым бы пригодился инструмент для проверки и улучшения научных репозиториев - будем рады, если поделитесь с ними ссылкой.
Towards Data Science An End-to-End Guide to Beautifying Your Open-Source Repo with Agentic AI | Towards Data Science The guide to automated improvement of scientific and industrial repositories using open-source AI agents
  • 🔥 14
  • ❤ 4
  • 👍 4
Post #185 942
Выложили материалы по итогам недавнего митапа:
Презентации - тут, запись выступлений - тут.

Решили и в этот раз провести голосование за "Лучший доклад" - чтобы был повод ещё раз посмотреть на слайды.
Для равенства шансов, keynote-доклады (от Владимира Павлова про школу-конкурс EDGE AI 2025 и Олега Чирухина - про путь к 100% генерации кода) идут вне зачета.

А само голосование - ниже:
Post #184 1.12K
Пока готовим к публикации материалы митапа, проанонсирую пару актуальных опенсорс-активностей на ближайшее время:

1) Приём заявок на гранты Yandex Open Source × SourceCraft - до 15 марта.

https://opensource.yandex/grants

В программе три трека
- Обработка и хранение данных
- Разработка
- Искусственный интеллект

2) Прием заявок на Всероссийский конкурс проектов с открытым кодом - до 1 марта

https://foss.kruzhok.org

Можно участвовать со своим проектом с открытой лицензией, или с мердж-реквестом в любом из существующих.

3) Мероприятие от коллег из ИТМО - открывают второй сезон митапов по системному программированию «Systems».

https://t.me/gpgpu_ru/338

Ближайший - 25.02.2026 в 19:00 в здании ИТМО на Кронверкском. Среди близких нам по теме докладов - «Ре(Э)волюция инструментов разработки в эпоху AI: в мире и Яндексе» от Дмитрия Иванова (руководителя SourceCraft).

—

Пишите в комментарии, если что-то ещё релеватное забыл.
  • 🔥 9
  • ❤ 4
Post #183 919
А тем временем, до начала нашего митапа - меньше часа.

Для тех, кто успел регистрироваться очно - ждём на площадке к 18!

Для остальных - трансляция (начнется в 18-25). Программа - тут.
  • ❤ 3
  • 👍 1
  • 🔥 1
Post #182 2.19K
А тем временем, начинаем публикацию программы нашего митапа, который пройдет 12.02 в 18-00. Вот перечень докладов с авторскими аннотациями:

- Школа-конкурс EDGE AI 2025: как мы первыми в России представили флагманский китайский стек для работы с ИИ-моделями на EDGE устройствах c OpenScaler OS // Владимир Павлов - Технический комитет сообщества OpenScaler

В докладе мы поделимся опытом сообщества OpenScaler по проведению соревнований в новом формате: студенческие ИИ-команды из ведущих вузов страны сначала проходили обучение у наших менторов, а затем соревновались на лучшую реализацию различных ИИ-моделей на краевых устройствах Orange Pi на базе чипов Ascend и ОС OpenScaler. Расскажем о самом конкурсе, командах и проектах студентов, которые были представлены в финале. Все учебные материалы были опубликованы в открытом доступе, а проекты финалистов размещены на платформе GitVerse.

- На пути к 100% генерации кода // Олег Чирухин - владелец продукта GigaIDE Cloud

Обсудим, насколько это вероятное будущее, и где мы сейчас находимся.

- OpenSource по-пекински, или почему фонд OpenAtom - это прекрасно, но не в наших реалиях // Аристов Константин - Скала^р (группа Рубитех), руководитель направления RnD системного ПО

Поговорим о том, какой дивный симбиоз между собором и базаром (openSource и Кговавым Ынтырпрайзом) получился в КНР, попробуем прикинуть тамошние реалии на наши, придем к парадоксальному выводу насчет пользы конкуренции.

- Студенческий open-source в ML - опыт внедрения поддержки ONNX // Зверев Андрей - студент 3 курса Новосибирского Государственного Университета, стажер-разработчик в Яндексе

Как превратить скучную учебную практику в реальный проект, которым не стыдно гордиться и который добавляет ценности в резюме? Расскажу на личном примере участия в лаборатории YADRO при НГУ.
Поясню, что такое формат лаборатории: как туда попасть, какие возможности она дает студентам. На практическом кейсе покажу, как выглядят рабочие процессы изнутри: постановка задач, планирование, работа через issues/PR, тестирование и выпуск; с какими трудностями столкнулся и как их решал при поддержке наставников из реальной компании-партнера.
В технической части объясню простыми словами: что такое ONNX и почему стандарт обмена моделями важен для переносимости и воспроизводимости, чем его поддержка усилила проект Adept и какие результаты получились на практике.


- Simple Deep Research - открытый фреймворк для мультиагентного поиска // Алан Газзаев - аспирант ИТМО, NLP researcher at MWS AI

Simple Deep Research - это простая система для поиска информации в интернете с помощью мультиагентного подхода. Система работает в двух режимах: lite и full. В первом режиме агент посещает несколько сайтов, сжимает информацию и выдает отчет. Во втором режиме агент определяет сложность запроса, разбивает его на подзапросы, а затем другие агенты ищут и суммируют информацию по каждому запросу. Одна из основных идей данного фреймворка заключается в том, что он не содержит таких зависимостей как langchain и smolagents и быстро запускается с локальными моделями через vLLM/llama.cpp. Также фреймворк модульный, можно заменить поисковой движок и агентов по необходимости.

- Опен-сорс от BE2R: почему мы делаем и как продвигаем проекты по воплощенному интеллекту // Колюбин Сергей, профессор и руководитель лаборатории BE2R ИТМО

На примере нескольких результатов, представленных на конференции IROS 2025 года, расскажу про нетривиальные истории опен-сорсных проектов нашей лаборатории, реализуемых в сотрудничестве с Центром робототехники Сбера.


Ссылка на регистрацию прежняя - https://openmeetup.ru/
Места на площадке конечны, так что не откладывайте! Остались только онлайн-регистрации.
  • 🔥 14
  • 👍 4
  • ❤ 2
Post #181 1.89K
Анонс: Первый Scientific Open Source Meetup этого года - в феврале!

С радостью приглашаем всех на наш очередной Scientific Open Source Meetup, который пройдет 12 февраля 2026 года с 18:00 до 22:30 в Санкт-Петербурге в уютном лофте на Газовой, 10ж. Это отличная возможность встретиться, обсудить актуальные темы и поделиться опытом в мире открытого программного обеспечения!

Что вас ждет на митапе?

• Доклады от экспертов по разработке и применению Open Source
• Представление новых Open Source проектов и обсуждение лучших практик;
• Живое общение с коллегами и единомышленниками;
• Возможность задать вопросы и обсудить последние тренды в Open Source

Мероприятие проходит при поддержке OpenScaler — сообщества разработчиков ОС с открытым исходным кодом.

Дата: 12 февраля 2026 года
Время: 18:00 - 22:30
Место: Лофт на Газовой, 10ж

Участие бесплатное, но количество очных мест ограничено!
Ссылка на регистрацию - https://openmeetup.ru/

Ждем вас на митапе!
  • 🔥 12
  • ❤ 2
Post #180 1.18K
Post #179 1.16K
На Data Ёлке 2026, которая пройдет 24 января, образовалась тематическая опенорс-секция в виде такой вот пары докладов:

15:50 Итоги года в Open Source (global) Алексей Смирнов Генеральный директор CodeScoring
16:25 Итоги года в Open Source (science) Николай Никитин Руководитель лаборатории, Институт ИИ, ИТМО


В связи с этим приглашаем всех заинтересованных прийти послушать эти и другие доклады (полное расписание - тут).

Адрес: г. Санкт-Петербург, наб. реки Мойки, 73 / офис VK, 7 этаж, вход со стороны набережной реки Мойки.
Начало программы: 15:00

Регистрация - по ссылке, до 22 января. Трансляция тоже будет.
  • 🔥 12
  • 👍 5
  • ⚡ 1
Post #178 1.19K
Выкатили сегодня лендинг для нашего опенсорс-сообщества на официальный сайт ИТМО:

https://opensource.itmo.ru/

Структурировали там подборки опенсорс-проектов лабораторий, наши аналитические исследования, митапы и ИИ-инструменты. Спасибо Управлению интернет-ресурсов ИТМО за помощь!

Также, конце декабря принято подводить итоги года, поэтому вспомним что нового появилось в 2025:

- Улучшатель открытых репозиториев OSA;

- Исследование "Искусственный интеллект в разработке: тренды и реальное применение", выполненное совместно с Yandex B2B Tech;

- Продолжение цикла митапов "Scientific Open Source" вместе с GitVerse и OpenScaler, участие в организации Open Source BootCamp 2025 вместе со Sber AI Lab и др;

- Премия "За верность науке";

- И многое другое - новые проекты, репозитории, топовые cтатьи, посты и выступления.

Перечень открытых проектов ИТМО пока наверняка неполон - мы планируем реализовать его автоматизированное обновление через PR-ы в репозиторий страницы. Пока можно запрос на добавление своих репо писать прямо сюда в комментарии.

В 2026 - продолжим наши активности в таком же и даже большем масштабе!
  • 🔥 14
Post #177 1.05K
Попалась подборка open-source проектов AIRI за 2025. Многое пересекается с направлениями, которыми мы занимаемся в ИТМО, поэтому посмотреть интересно.
Вот как авторы описывают проекты:

- Maestro — фреймворк для создания интеллектуальных ИИ-агентов, от авторизации и хранения контекста до оркестрации агентов и модерации контента.

- GigaEvo — платформа для автоматизации научных экспериментов по ИИ, которая автоматизирует подбор архитектур, оптимизацию гиперпараметров и тестирование моделей, интегрируется с AutoML и MLOps

- MAPF-GPT — первая фундаментальная модель для многоагентного обучения с подкреплением в задаче планирования путей, показан новый SOTA в этом классе.

- CADrille — модель для для 3D-реконструкции промышленных деталей. Принимает на вход облака точек, изображения и текстовые описания деталей, а на выходе генерирует код на языке Python для создания CAD-файла.

- Wikontic — пайплайн для извлечения графов знаний из текстов. Использует в 20 раз меньше выходных токенов для извлечения графов, чем GraphRAG от Microsoft.

- Vintix — SOTA action-модель для роботов и индустриальных процессов, умеющая имитировать ход обучения с подкреплением. Анализирует в 3 раза больше информации по сравнению с аналогами: JAT HugginFace и GATO Google DeepMind.

- VLA_Arena — платформа для оценки и сравнения моделей управления роботами. Позволяет запускать роботов в виртуальной среде с визуализацией, а также подключать реальные устройства. Также содержит чистые датасеты для LeRobot, размеченные и переведённые на русский язык.

- DiMA — универсальная компактная модель для генерации белковых молекул на латентной диффузии.

Можно отметить симпатичные карточки проектов.

Надеюсь, доберемся попробовать всё это, кто уже применял - делитесь опытом)
  • 🔥 8
  • 👍 3
Post #176 937
Небольшой дайджест научно-опенсорсных активностей и материалов на разный вкус, в которые можно погрузиться в предновогоднюю неделю:

1. Опенсорс-стрим от SourceCraft - 23.12 в 12-00

Обещают знакомство с ИИ для разработки (для тех, кто ещё не знаком), разбор сценариев и "прожарку" кейсов.

2. Доклад в Paper Reading Club-е от AI Talent Hub ИТМО - сегодня в 19-00

Представители нашей лаборатории (Анна Калюжная, Глеб Соловьев) и Центра ИИ в Химии ИТМО (Андрей Дмитренко) расскажут "Как ИИ помогает искать новые лекарственные молекулы".

Речь пойдет и про сам ресерч, и про A*-публикацию про него, и про открытый код и данные.

3. Из мира открытых данных:

>Инженер Yandex Cloud и исследователи Сколтеха представили самый большой в мире датасет для умных касс и систем учета в ритейле

Формат публикации такой: статья с описанием датасета опубликована в журнале Scientific Data; набор изображений размещён на платформе Zenodo; код и примеры моделей — на платформе Kaggle.
  • 👍 6
  • 🔥 5
Post #175 1.7K
Хотел уже написать пост "Халявные github actions - В C Ё", но вник подробнее и вроде нет, пока наоборот - дорожают self-hosted экшены, которые запускаются не на гитхабе.

Странное решение. Видимо хотят корпоративное использование косвенно монетизировать. Хотя связанные с LLM сценарии для тестов часто и в небольших открытых проектах часто self-hosted.

Подробности:
https://github.blog/changelog/2025-12-16-coming-soon-simpler-pricing-and-a-better-experience-for-github-actions/
Обсуждение в профильном сабреддите:
https://www.reddit.com/r/github/comments/1po8bns/github_selfhosted_action_runners_will_be_billed/
  • 🤔 7
Post #174 804
Научный опенсорс Около-опенсорсное чтение на вечер: Дмитрий Кабанов выпустил новое интервью с Александром Нозиком, директором Центра научного программирования МФТИ: https://habr.com/ru/articles/976238/ Обсуждается модель опенсорс-хаба, опыт сотрудничества с индустрией и…
И тут же следом новый материал от Дмитрия - про общеевропейский опенсорс-реестр и перспективы этой модели для других стран: https://habr.com/ru/articles/976216/

Я дал там небольшой комментарий со своим мнением по этому вопросу.

В целом у нас есть небольшой, но позитивный опыт работы с научной командой из Бразилии - они и OSA активно используют, и статьи совместные пишем. В одной из новых статей успешно применили наши open-source инструменты (FEDOT, FEDOT.LLM, EPDE) к их задаче - как раз топичный пример.
Хабр Как Европа развивает свою open source-экосистему — и какие новые возможности по кооперации появляются у стран БРИКС В этом году Европа запустила межнациональный листинг репозиториев с открытым исходным кодом — EU OSS Catalogue. Рассказываю, почему она пришла к этой идее, как развивается реестр и есть ли аналогичные...
  • 🔥 6
  • 👍 1
Post #173 795
Около-опенсорсное чтение на вечер:

Дмитрий Кабанов выпустил новое интервью с Александром Нозиком, директором Центра научного программирования МФТИ:

https://habr.com/ru/articles/976238/

Обсуждается модель опенсорс-хаба, опыт сотрудничества с индустрией и использования открытого кода в коммерческих проектах, идеи по развитию такого формата. Про сообщества ИТМО в ВШЭ тоже вспоминают.
Хабр Open source-стратегии: как работать с партнерами на базе открытых технологий — опыт Александра Нозика, директора SPC Обсудили с @darksnake ход развития open source-хаба — его инициативы, реализующей новую модель сотрудничества на базе научного и индустриального опенсорса. Получился объемный, но продуктивный разговор...
  • 👍 11
Post #172 850
В чате сообщества часто обсуждаются опенсорные реализации различных ML-моделей. Часто вспоминают и про такую фронтирную тему как Tabular Foundation Models.

И вот сегодня пройдет лекция по этой для студентов ИТМО - от Sber AI Lab (недавно писали про их ML-библиотеки). Решили провести в открытом формате - так что приглашаю послушать и заинтересованных в тематике участников нашего сообщества.

Тема: фундаментальные модели для табличных данных и их применение в AutoML
Спикер: Дмитрий Симаков, исполнительный директор по исследованию данных Sber AI Lab.
Когда: сегодня 10.12 в 20-30 мск

Лекция пройдет в рамках моего курса "Автоматическое машинное обучение" магистратуры Факультета технологий ИИ ИТМО, но подключиться и позадавать Дмитрию вопросы можно всем.
Запись потом выложим, но вживую интереснее)

Где: zoom (код для входа 143395)

До встречи!
  • 🔥 7
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →