TGViewer
̶с̶а̶м̶̶о̶изолента мёбиуса ̶с̶а̶м̶̶о̶изолента мёбиуса @izolenta_mebiusa · 2.77K subscribers
Post #355 1.25K
Мои знакомые сейчас собирают "Last Translation Benchmark" — заведомо сложный бенчмарк задач перевода. Сложность проверяется следующим образом: каждый пример прогоняется через десяток моделей, и нужно, чтобы не более пары из них дали правильный перевод. Языки могут быть какие угодно.

Если у вас есть примеры таких сложных текстов для языков, с которыми вы работаете, предлагаю туда их загнать) Если добавить 10+ примеров в ближайшие пару недель, можно стать соавтором статьи про этот бенчмарк — ну и заодно привлечь к языку немножко внимания.

https://last-translation-benchmark.vilda.net/
  • 🔥 17
  • 👍 7
  • ❤ 3
More from @izolenta_mebiusa
  1. Jul 28, 2026У меня наконец-то дошли руки научиться, как обновлять веб-приложение https://bouquet.metad…
  2. Jul 26, 2026С тех пор, как я ещё в 2023 выкладывал тьюториал по дообучению моделей NLLB, я был уверен,…
  3. Jul 4, 2026Очень лениво заниматься абсолютно всем. То ли я выгорел, то ли вконец офранцузился, то ли…
  4. Jun 14, 2026Пост про путешествия, а не про NLP: моя супруга Дарина (inst @cloudberrin) в этом году сно…
  5. May 28, 2026Три маленьких апдейта по датасету BOUQuET (напомню, что это наш бенчмарк для мультиязычног…
  6. Apr 26, 2026Как вы знаете, я участвую в Open Language Data Initiative: мы занимается поддержкой датасе…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →