TGViewer
DevOps DevOps @devopsitsec · 23.7K subscribers
Post #2327 2.79K
🐳 Docker показал подход к воспроизводимым AI-evaluation через Docker Sandboxes.

Проблема простая: даже если зафиксировать модель, промпт и метрику, результат всё равно может отличаться из-за окружения — версий Python, зависимостей, локальных инструментов и конфигурации машины.

Для этого Docker предлагает SBX AI Evaluation Kit: evaluation описывается в YAML, запускается локально или внутри Sandbox, а на выходе сохраняется структурированный артефакт с тем, что реально произошло:

* executor;
* команда;
* stdout/stderr;
* exit code;
* время выполнения;
* digest конфигурации.

Можно переключать выполнение между локальной машиной и Docker Sandbox без переписывания самого evaluation workflow.

Подход полезен для:

* сравнения промптов;
* regression testing;
* agent evals;
* security checks;
* code-generation экспериментов.

https://www.docker.com/blog/building-reproducible-ai-evaluation-workflows-with-docker-sandboxes/
  • ❤ 4
  • 👍 3
  • 🔥 1
More from @devopsitsec
  1. Sep 20, 2026🐳 Docker-образ с 3,17 ГБ до 354 МБ - почти в 9 раз меньше Такая оптимизация обычно достиг…
  2. Sep 17, 2026⚡️ Поды здоровы, а запросы в Kubernetes случайно отваливаются? Проверьте conntrack. Linux…
  3. Sep 16, 2026✔️ OpenAI на 60% снизила цены на голосовое управление агентами Work и Codex Теперь в дескт…
  4. Sep 16, 2026Что реально стоит за требованиями в вакансиях DevOps-инженера Открываешь вакансию - а там…
  5. Sep 16, 2026🌦 Linecast - погода, карты, радар, приливы, Солнце и Луна прямо в терминале Open-source C…
  6. Sep 16, 2026Гибридная инфраструктура — новая реальность или красивое словосочетание из презентаций? 1…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →