А теперь про работу с английскими или русскими промптами.
Год назад была большая разница в том, на какой языке мы должны были писать инструкции - на английском ответы были в разы лучше, на всех остальных - заметно хуже. Разница была и в полноте, и в согласованности самих слов. Сейчас ситуация поменялась и разница для основных языков (и великий и могучий среди них тоже есть) практически отсутствует.
При этом, не важно в каком языке задается вопрос, существует некоторая рандомность ответов, и задав вопрос "какой формы земля" мы с 99,(9)% получим ответы из серии "круглая", "шарообразная" или даже "геоид", но всегда есть еще 0.000...1%, что нейросеть решит нам написать, что земля плоская и лежит на слонах, которые стоят на черепахе.
Так почему же нейросеть по запросам про русских классиков выдает чушь? (Пруфы добавлю в комментарии, на примере Тургеньева)
- Не из-за английского или русского языка в промпте, а из-за своей природы
- Все данные, на которых учится нейросеть, проходят процесс трансформации и он необратим. Некоторые данные нейросеть может воспроизвести дословно, но это случайность
- Сама логика нейросетей, как "трансформеров" текста, заставляет ее писать ответ, опираясь на "воспоминания" - наиболее близкое у людей состояние называется "слышал звон, да не знает где он"
Так что там с английским? Чем лучше наши слова будут "возбуждать" нужные нам "нейроны", тем качественней ответ. Иногда это должны быть английские слова, иногда транслит, иногда англицизмы. Не уверен, но думаю, что есть кейсы когда японские или китайские иероглифы будут давать максимальную пользу. Но с точки зрения самой природы нейросети никакой предвзятости к языкам у нее уже нет.
Post #148
1.17K
- 👍 9
- 🔥 3