Проект был на паузе - завал задач, да и казалось, что всё почти готово. Но внутри не отпускало. Сейчас снова в деле и иду на финишной прямой.
🧠 За это время перепробовал кучу LLM-моделей для локального запуска — искал ту, что даст максимум качества на русском.
Что выяснилось:
- Qwen3 8B — даёт стабильные, “вдумчивые” ответы
- Llama 3.2 3B — уходит на английский
- DeepSeek, Gemini — шикарные, но очень тяжёлые
Всё сравнивал через unit-тесты на коротких промптах
📦 Модели загружаются с HuggingFace — всё кастомизируется на лету.
🤖 Пока фокус на простых реакциях, как у питомца. Но возможно - позже добавлю агентский режим (накидывайте что добавить).
📒 А вот что котик уже умеет говорить — реальные фразы из логов:
- Мяу, я котик, я пиксельный, я в Telegram!
- Мрр, мне бы шаурмы, а не чат с тобой.
- Мрр, я уже смеялся, как узник в бочке.
😿 Честно? Мотивации добивать проект - почти нет. Поэтому, возможно, скоро выложу как есть. Просто чтобы он был живым и я его окончательно не забросил. А ваши отзывы дадут мне мотивации)