Рабяты паспрабавалі разабрацца, чаму мадэлі GPT не ўмеюць у арыфметыку. Аргумент добра вядомы: гэта хутчэй запамінанне, чым шматкрокавае кампазіцыйнае разважанне.
Эмпірычныя аргументы такія:
• Калі перамнажаць двузначныя лікі, 99% адказаў правільныя. 0% адказаў правільныя, калі перамнажаць пяцізначныя лікі (гл. скрыншот). Што ў некаторай ступені карэлюе з чаканай колькасцю прыкладаў у Інтэрнэце.
• Калі папрасіць патлумачыць, як нейронка прыйшла да адказу, атрымліваецца наступнае: 82.3 % правільных адказаў мелі прынамсі адну памылку ў пакрокавых развагах, што не перашкодзіла даць правільны адказ. Таму што прыкладаў канчатковых адказаў значна больш, чым прыкладаў пакрокавых падлікаў.
Post #144
1.75K

- 👍 26
- 😁 9
- 🤔 2