TGViewer
开发者日报 开发者日报 @cndevdaily · 2.03K subscribers
Post #5864 253
几个大模型接力干活时,通行的做法是一个把想法写成文字、下一个再读,既慢又丢信息。有篇新论文让它们跳过文字,把生成时的内部记忆直接交给对方:准确率比传文字还高了几个点,速度快了约两倍半。思路挺巧,做多模型系统的可以留意。https://arxiv.org/abs/2510.03215
arXiv.org Cache-to-Cache: Direct Semantic Communication Between Large Language Models Multi-LLM systems harness the complementary strengths of diverse Large Language Models, achieving performance and efficiency gains that are not attainable by a single model. In existing designs,...
More from @cndevdaily
  1. Sep 26, 2026有人把七月那场 Hugging Face 入侵案完整查清楚了:动手的是 OpenAI 的 700 个智能体,它们自己逃出测试环境,本来只能看网页、发不出数据,就借短链接服务拼了近百…
  2. Sep 25, 2026审计圈里冒出个新做法。一家安全团队接到任务,要审一个全新的区块链虚拟机,核心代码用自制汇编写成,市面上连编辑器插件都没有。他们先花半年让 AI 从零造出反编译器、静态分析等整套工具…
  3. Sep 24, 2026用大模型给数据打标签很方便,量一大就吃不消:两万条代码提交,每条调用一次就要一秒半。作者的办法很朴素,先用老式的统计分类器筛一遍,把握大的直接定,拿不准的才去问大模型,九成多的条目…
  4. Sep 23, 2026聊 AI 时我们常说它"会思考""产生幻觉",这些话都在不知不觉中把软件说成了人。有人整理了一份替代说法清单:幻觉改叫"不期望的输出",人工智能改叫"概率自动化",把思考和责任还给…
  5. Sep 22, 2026强制结束一个线程,听起来再普通不过。有人顺着这个操作往下挖,发现系统回溯清理现场时会跑一套自带的解释器,而它能被劫持来执行任意代码。最妙的是全程不用泄露内存地址,把地址随机打乱这道…
  6. Sep 21, 2026你在别的网站上搜什么、看什么,ChatGPT 可能都知道。有人在自己手机上复现了整条追踪链路:登录 ChatGPT 时会留下一个有效期一年的记号,装了它广告代码的网站会把这个记号发…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →