#ai #llm #llmcouncil
Есть у меня MCP, который реализует идею Карпатого - llm-council. Работает так: несколько моделей независимо отвечают на один и тот же вопрос, потом вслепую оценивают ответы друг друга, а модель-председатель в конце синтезирует из этого финальный ответ.
Раз в пару месяцев я перетряхиваю список - решаю, кого оставить в совете, а кого пора менять. Вчера сел переснимать. 60 баксов потратил!
Результаты чуток удивили.
- Gemini 3.1 Pro отвечает примерно на уровне DeepSeek V4 Pro - только дороже.
- Grok 4 вообще в самом низу топа. От модели самого Илона Маска я ожидал большего.
Кого в итоге посадил за стол:
Председатель: anthropic/claude-opus-4.8
Совет: minimax/minimax-m3, openai/gpt-5.5, qwen/qwen3.7-max, deepseek/deepseek-v4-pro
Вот сами вопросы, если что.
Post #70
1.34K