TGViewer
黑科技资源分享 黑科技资源分享 @deeptech123 · 3.54K subscribers
Post #5265 68
ABC做了一组对照实验,实测三款顶尖大模型的预测上限。 实验直接锁死时间在今年2月底美以冲突爆发前,关掉Claude Opus 4.8、Grok 4.5、ChatGPT 5.6的联网,只给当时已公开信息。 在伊朗局势的14个问题里,AI猜对12个,准确率很高。
但换到体育赛事、黄金、比特币、石油、标普500这类场景,预测命中率连50%都达不到,不少判断完全相反。 结论很清晰:AI擅长依托已有信息做逻辑推演,却很难应对随机事件和人的突发决策。它适合推演决策带来的后果,而不是预判人的选择。
More from @deeptech123
  1. Oct 10, 2026Eleven Labs升级到了99美金的版本...感觉用量还会持续增加,准备下周看看 ListenHub 的API
  2. Oct 10, 2026一个有意思的观察:钱并没有消失,只是换了流动方向。过去地产、传统金融时代,财富靠关系驱动,老板靠排场建立信用,资金在饭局、公关之间流转,大量中间人跟着分一杯羹,人情社交就是财富晴雨…
  3. Oct 10, 2026这是啥,CLIProxyAPI 补上它自己不提供的用量与成本记录,外加一个可视化管理控制台。 https://github.com/WizisCool/oh-my-cpa
  4. Oct 10, 2026📄 grok4.7编程提示词.txt - 5.2 KB 在本期视频中,我们将深入演示如何通过 API 接口与 Agent 自动化工具,彻底释放 Grok 4.7 模型的底层编程与…
  5. Oct 10, 2026有没有用了vidu q4 preview的,讲讲到底咋样?目前搜到是0.014刀/s。我觉得要是0.1元/s以内,比h3效果好,且音色也好,可替代sd2.0或fast,那是可用的
  6. Oct 9, 2026DeepSeek和豆包的路线差异,本质是AI底层底座和用户入口两条路。 DeepSeek主打开源技术底座,R1对标OpenAI o1,技术对外公开,靠API调用创收,年化营收10亿…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →