В интернетике много трюков о том, как вгрузить в chatGPT (и не только) побольше текста (контекта). Оказалось, что LLM как и люди, лучше слышат и помнят то, что им говорят вначале или в конце разговора. Ну а вывод о том, что чем больше контект, тем хуже с ним справляются мозги в принципе банальный.
Несмотря на то, что современные языковые модели способны принимать на вход длинные контексты, относительно мало известно о том, насколько хорошо языковые модели используют длинные контексты. Мы проанализировали работу языковых моделей в двух задачах, требующих выявления релевантной информации во входном контексте: при ответе на многодокументные вопросы и при поиске ключевых значений. Мы обнаружили, что производительность часто оказывается наиболее высокой, когда релевантная информация находится в начале или в конце входного контекста, и значительно снижается, когда модели должны получить доступ к релевантной информации в середине длинных контекстов. Более того, производительность существенно снижается по мере увеличения длины входного контекста даже для моделей с явно выраженным длинным контекстом.
https://arxiv.org/abs/2307.03172
Просто помните об этом, когда взламываете мозг chatGPT
Post #6126
6.99K

- 👍 32