Post #76
558
False Positive В последнее время все более отчетливо проявляется тренд на эффективность инференса LLM. Сначала мы жили в парадигме: "хочешь более умную модель - просто добавь параметров, данных и GPU-часов". Даже для вопроса вроде "Какая столица России?" задействовались…
📹Запись RG от Дани Семенова про то как DeepSeek придумал вставить память в LLM
- 👍 3
- ✍ 2