Теперь немножко насчёт AI, LLM, доступа в Гугл и размера доступных баз данных.
Ну вот уже есть данные о том, что старая модель Claude 5.0 уверенно разделывается с людишками из топ-100. В моей картине мира абсолютно неважно, какой объем данных был ей доступен: 100 петабайт, 1 петабайт или 10 терабайт. Это не имеет значения с качественной точки зрения. Никто не ставит задачу оптимизации этого параметра для обыгрыша человека в ЧГК. Это просто малоинтересная техническая задача. Да, наверняка можно с помощью хитрого частотного анализа распарить базу и понять какой тип реалий лучше закэшировать, а какой встретится с меньшей вероятностью. Но это не имеет качественного значения.
Да, вероятно сейчас ещё существует тип вопросов, на которых команды из топ-100 все ещё сильнее чем Claude 5.0 или даже Claude 5.1 (это, кстати, неплохо было бы проверить). Но в общем и целом ощущения такие, что даже general purpose модели очень скоро закроют эту лавочку.
В мире бенчмарков ЧГК — это тот самый неуловимый Джо из анекдота. Мы даже сами в комьюнити не готовы протестировать современные пакеты на Claude 5.1 или GPT 6.0.
Post #5608
1.24K
- 🤷♂ 7
- 🤡 5
- 👍 4
- 💅 1
- 🗿 1
- 🦄 1
- 💊 1