😄 Financial advice, apparently
Saturn tested 18 popular AI models on personal finance questions. On average, ChatGPT, Claude, Gemini, Copilot and Grok gave incorrect answers 57% of the time. On more complex tasks, the error rate jumped to 88%.
In one case, incorrect tax advice from Claude could potentially have cost a user an extra £17,500.
Which models performed best — and worst:
↖️ https://durovscode.com/chatgpt-claude-gemini-personal-finance-errors
Post #4654
204

- 👍 1
- 👎 1