TGViewer
Channel Public Channel
GitHub开源观察|开源项目·热门仓库·开发者

GitHub开源观察|开源项目·热门仓库·开发者

@githubtrendinghub

每日追踪 GitHub 热门与新锐开源项目,第一时间发现值得 star 的好轮子。投稿 @BDHT1
#GitHub #开源 #编程 #开发者
Subscribers
666
Photos
809
Videos
0
Links
417

Showing posts older than #637 · Back to latest

Older Posts 18 shown
Post #636 7
Simon Willison 重新拥抱 MCP

Simon Willison 对 MCP 的态度转变,是 AI 开发者圈子里值得关注的信号。2025 年底,他在年度回顾中曾断言 MCP 火不过一年,会被 Anthropic 推出的 Skills 取代——一个能访问终端、能跑 curl 的 agent 比任何 MCP 工具都灵活。

如今他重新拥抱 MCP,关键在于其无状态协议设计。相比有状态的集成方案,无状态协议让工具调用更轻量、更易组合,降低了接入和调试成本。对正在选型 AI 工具链的开发者来说,这意味着 MCP 的生态兼容性和长期维护价值重新得到验证。

#GitHub #开源 #MCP #AI #Anthropic #SimonWillison
@GitHubTrendingHub
Post #635 13
Hugging Face 今日十大 AI 论文:Agent、视频与 3D 成焦点

Hugging Face 每日论文榜单反映了社区关注方向。今日榜单横跨 agent 基准测试、实时视频编辑、多模态 3D 模型、潜在语言建模、世界模型与流式推荐等领域,以下按「问题、思路、创新点、应用」四个角度梳理十篇重点论文。

1. MerchantBench:电商运营长期一致性 Agent 基准

现有 agent 基准多只测短任务完成能力,而电商场景要求 agent 处理跨多步、多天的长流程:商品管理、库存、促销、客户反馈,并保持长期一致性。MerchantBench 将 agent 视为「数字运营员工」,要求其记住先前状态、按业务目标决策,而非单轮聊天式作答。适用于电商卖家助手、店铺自动化运营及企业 agent 上线前评估。
GitHub

2. JoyAI-Video-Edit:自回归扩散实现实时视频编辑
AI 视频编辑常陷两难:高质量但慢,或快但帧间不一致。该论文结合自回归建模与扩散模型,兼顾灵活性与实时速度,目标是保持时间一致性同时不牺牲细节生成。适用于自然语言驱动的视频编辑工具、直播及短视频实时剪辑、广告后期。
GitHub

3. Hunyuan3D-Buffalo 1.0:统一多模态 3D 生成与编辑
当前 3D AI 生态割裂:生成、理解、编辑模型彼此独立,难以构建游戏、AR/VR、机器人等大型 pipeline。该模型尝试用一个统一多模态模型同时完成 3D 对象生成、内容理解与资产编辑,类似 LLM 统一 NLP 任务的路径。适用于游戏/影视 3D 资产制作、电商 3D 展示、机器人环境理解。

4. AURORA-LM:连续潜在空间扩散语言建模
自回归 Transformer 是语言建模黄金标准,但逐 token 生成较慢;扩散模型可并行化但质量常不敌。AURORA-LM 通过自编码将语言映射到连续潜在空间,再在该空间做扩散建模,而非直接生成离散 token。若成立,可能挑战「语言建模必须逐 token 自回归」的假设。适用于并行文本生成、可控生成、统一多模态潜在建模。
GitHub

5. InfiniSplat:大基线单目视图合成的隐式高斯解码
从单张或少量图像合成新视角,在大基线(视角变化大)时极易几何破裂、细节丢失。该论文用隐式表示结合高斯解码,直接应对新视角合成中最难的远距离外推问题。适用于单图建 3D 场景、虚拟看房/旅游、机器人仿真数据生成。
GitHub

6. Video-DeepResearch:下一代多模态深度研究 Agent
现有 deep research agent 主要处理网页、文本与 PDF,但真实知识大量存在于视频:课程、产品演示、会议、直播、访谈。该论文将深度研究从纯文本扩展到多模态,让 agent 能基于视频内容检索、分析、综合与推理。适用于讲座/教程分析助手、企业视频知识库挖掘、媒体情报与竞品分析。

7. KGD4REC:知识-几何解耦的流式推荐迁移
流式推荐场景中,新 item 不断出现、用户兴趣漂移,预训练模型难以低成本刷新。该论文将表示中的「知识」与「几何结构」解耦:保留稳定知识,灵活更新几何结构,避免全量重训。适用于信息流/短视频推荐、实时电商推荐、概念漂移明显的个性化系统。
GitHub

8. PCSD:Agentic 强化学习自蒸馏的持久一致性
Agentic RL 常因策略快速变化导致自训练质量波动,自蒸馏易放大错误。PCSD 引入持久一致性机制,让 agent 在自我学习过程中避免过度漂移,强调多轮蒸馏的稳定性而非短期效率。适用于工具调用 agent 训练、多步任务 RL、自改进 agent 稳定性提升。

9. Quo Vadis, World Modeling?:世界模型领域综述
「世界模型」概念火热但定义模糊,可指环境预测、模拟器、结构化记忆或 agent 规划基础。该论文属综述/方向性研究,梳理领域现状、分类体系、基准与开放挑战,有助于社区统一话语、设计基准、确定研究优先级。适用于长期规划 agent 方向、模拟器与基准设计、具身 AI 与游戏 agent 研究。
GitHub

10. PAST-Bench:个人 Agent 递归自我改进基准
个人 agent 应随观察用户与交互历史不断自我改进,但如何严肃评测「递归自我改进」的基础能力?PAST-Bench 衡量 agent 从反馈中学习、更新策略、维持个性化目标并随时间提升表现的能力,焦点从「单次会话能做什么」转向「能否反复自我改进」。适用于长期个性化 AI 助手、学习用户习惯的生产力工具、自主助手安全评估。
GitHub


综合今日榜单,可提炼四条主线:一是 agent 研究从短期 demo 转向长期一致性、自我改进与多模态研究能力;二是视频与 3D 从「理解」走向「操作」,模型被期待直接编辑、创作与研究多模态内容;三是 AURORA-LM 代表的后 Transformer 架构探索正经受严肃检验;四是流式推荐与自蒸馏 RL 表明「一次训练永久部署」模式正在终结,模型需持续刷新与适应。

若从中挑选最值得跟踪的方向:MerchantBench 与 PAST-Bench 这类基准常塑造后续研究浪潮;JoyAI-Video-Edit 的实时视频编辑应用潜力巨大;AURORA-LM 触及语言建模底层范式;Hunyuan3D-Buffalo 的统一 3D 模型或成 3D AI 的「LLM 时刻」。

#GitHub #开源 #HuggingFace #AI论文 #Agent #多模态 #3D模型 #视频编辑 #语言建模 #推荐系统
@GitHubTrendingHub
Post #634 14
NVIDIA 成为 LVFS/Fwupd 首席赞助商

红帽公司 LVFS/Fwupd 首席开发者 Richard Hughes 发文确认,英伟达(NVIDIA)已成为 Linux 厂商固件服务(LVFS)的最新首席赞助商。至此,赞助 LVFS 的 OEM 增至 4 家,项目方表示已达成去年设定的筹资目标。

此前,戴尔和联想已是顶级赞助商,每年向 LVFS/Fwupd 项目捐赠 10 万美元,惠普则于今年 5 月加入。LVFS 是 Linux 生态中用于分发和更新设备固件的关键基础设施,fwupd 是其配套的固件更新工具,广泛服务于各大 Linux 发行版。

对普通 Linux 用户而言,这意味着固件更新通道获得更稳定的资金支持,设备厂商参与度提升,未来更多硬件固件有望通过系统自带工具直接更新,无需手动下载安装。


GitHub

#GitHub #开源 #NVIDIA #LVFS #Fwupd #固件更新 #Linux #红帽 #戴尔 #联想 #惠普
@GitHubTrendingHub
Post #633 13
SolonCode v2026.8.4 发布:界面字体可调、支持 22 种语言

SolonCode 是杭州无耳科技研发的企业级终端编码智能体,主打全中文驱动,能自主理解需求、规划步骤并编写代码。它不挑模型、不挑平台,curl 一行命令即可安装使用。

本次 v2026.8.4 更新带来三项改进:界面字体大小可调,方便长时间编码时调整观感;新增对 22 种语言的支持,覆盖更多非中文场景;记忆搜索功能增强,让智能体在后续对话中更准确地调用历史上下文。

对在终端里用 AI 写代码的开发者来说,这次更新主要解决「界面可读性」和「多语言协作」两个实际痛点,尤其适合团队中有非中文使用者的场景。

GitHub

#GitHub #开源 #SolonCode #编码智能体 #AI编程 #无耳科技
@GitHubTrendingHub
Post #632 12
Linux内核维护者限制AI补丁进入staging树

Greg Kroah-Hartman(GKH)近日在linux-staging邮件列表中宣布,将主动拒绝LLM生成的补丁进入drivers/staging子系统。staging树本是内核为新手准备的训练场,包含大量相对简单的清理和API改动,如今却涌入大量AI生成的补丁,GKH称之为"攻势"。

GKH并非反对AI工具本身。他此前创建的"clanker"分支就是AI辅助模糊测试的试验田,在ksmbd和SMB代码中发现了真实bug,其他贡献者也开始用同样标签提交补丁。这次新政策只针对staging这一特定区域,他明确表示不希望AI接近这部分代码。

对内核贡献者而言,这意味着向staging提交补丁时需注意来源标注,AI生成的补丁可能被直接打回。对关注内核开发流程的读者,这是开源社区对AI辅助编程态度的一个具体案例——工具可用,但训练场仍保留给人类新手。

#GitHub #开源 #Linux内核 #GregKroahHartman #AI编程 #内核开发
@GitHubTrendingHub
Post #631 12
Pale Moon 34.3.2 发布,苍月浏览器安全更新

Pale Moon 34.3.2 现已发布,这是一个安全更新版本,同时包含少量网页兼容性修复。苍月浏览器是一款基于 Goanna 引擎的独立开源浏览器,主打经典界面与自定义能力,适合偏好 Firefox 旧版操作习惯、注重隐私与自主可控的用户。

本次更新主要加强了浏览器内部函数的边界检查,以防范潜在的越界访问、下溢和溢出问题;同时修复了加载和解析网页字体时出现的几个问题,并针对音频加载、处理和播放过程中可能出现的错误进行了修补。此外,新版本实现了 URL.Parse() 便捷功能,方便开发者处理 URL 相关操作。

本次为维护性安全版本,主要面向现有用户修复稳定性与安全问题,不影响扩展兼容性。建议 Pale Moon 用户尽快升级。


#GitHub #开源 #PaleMoon #苍月浏览器 #浏览器 #安全更新
@GitHubTrendingHub
Post #630 11
deepin 25.2.1 正式版发布

deepin 25.2.1 更新已正式推送。本次版本聚焦文件管理与搜索、DDE 桌面环境、系统升级可靠性、常用应用兼容性及系统安全性的优化与修复。

智能搜索能力有所增强,文件管理体验进一步改善;DDE 桌面环境与系统升级流程的稳定性得到提升,常用应用的兼容性问题也有针对性修复。官方建议社区用户及开源爱好者及时更新系统并反馈问题。

本次版本重点更新
• 智能搜索功能优化,文件查找更高效
• 文件管理器体验改进
• DDE 桌面环境相关修复与优化
• 系统升级可靠性提升
• 常用应用兼容性增强
• 系统安全性加固

以上为本次更新的主要改进方向,具体细节可查阅官方发布说明。


GitHub

#GitHub #开源 #deepin #Linux #桌面环境 #操作系统
@GitHubTrendingHub
Post #629 11
慕尼黑市政府资助开源维护者全职工作

libexpat 维护者 Sebastian Pipping 宣布,从 2026 年 8 月 1 日起,他将获得慕尼黑市政府资助,全职维护该项目最长 6 个月。过去约 10 年里,他一直在本职工作、家务和社交生活之间挤时间维护 libexpat。

libexpat 是一个广泛使用的 XML 解析库,被大量编程语言和软件项目依赖。此次资助意味着这位长期兼职维护者可以暂时放下其他工作,集中精力处理项目积压的 issue 和版本发布。

对依赖 libexpat 的开发者来说,核心维护者获得稳定支持,通常意味着 bug 修复和版本迭代节奏会加快。这也是地方政府直接资助开源基础设施的又一案例。

#GitHub #开源 #慕尼黑 #libexpat #XML解析 #开源资助
@GitHubTrendingHub
Post #628 11
PostgreSQL 18/19 新特性深度解读

一场技术分享介绍了如何用 AI 工具(如 Copilot)分析 PostgreSQL 的 commit 日志。面对 PG 18 已发布的 Release Notes,演讲者让模型从数千条提交中总结出三十余条潜在特性,再逐条生成详细解释并校验代码,最终筛选出对用户体感最强的若干项。

对于尚未正式发版的 PG 19,则通过拉取过去一年内(从 PG 18 Beta1 时间点至今)的提交记录进行前瞻分析。这种方法能帮助开发者在海量更新中快速定位真正影响日常使用的变化,避免被琐碎修补淹没。

对 PostgreSQL 用户和 DBA 来说,这套流程提供了一种高效跟踪版本演进的思路,也展示了 AI 在开源项目维护中的实际应用价值。

#GitHub #开源 #PostgreSQL #数据库 #AI #Copilot
@GitHubTrendingHub
Post #627 11
HeidiSQL 12.21 发布

HeidiSQL 是一款面向开发者和数据库管理员的免费开源数据库管理工具,支持 MySQL、MariaDB、PostgreSQL 等主流数据库。本次 12.21 版本属于维护性更新,主要带来两项界面改进和若干问题修复。

新版本中,表格编辑器会在单独列中显示索引大小,方便直观对比;数据库树结构新增将列显示为表的子表,浏览表结构时层级更清晰。修复方面,解决了 MySQL 4.0.2 以下版本不支持 CAST(x AS CHAR) 的兼容问题,以及导入设置文件后会话列表不刷新、断开连接会话时的异常等。

对于日常使用 HeidiSQL 管理数据库的开发者,本次更新提升了表结构浏览和索引管理的便利性,建议按需升级。


GitHub

#GitHub #开源 #HeidiSQL #数据库 #MySQL #MariaDB #PostgreSQL #数据库管理工具
@GitHubTrendingHub
Post #626 11
把代码库变成 AI 代理的长期记忆

AI 模型在会话之间完全无状态,每次新对话或切换模型都会让代理从零开始。作者不再反复向代理粘贴项目背景,而是把仓库本身改造成一个自文档化的活知识库:代理开工前先读 AGENTS.md 了解现状,完成任务前必须更新对应文档。

这套方案的核心是仓库根目录的 AGENTS.md 入口文件,外加一个 agent-sitemap/ 目录存放模块化的细分文档。AGENTS.md 包含项目概述、核心规则、文档地图和 30 秒快速上手说明;agent-sitemap/ 下按主题拆成架构、数据管理、代码规范、工作流、代理手册等独立 Markdown 文件,代理按需只加载当前任务相关的部分,避免上下文膨胀。

关键机制是强制性的「文档同步循环」协议,代理在每次响应时都要执行四步:
DETECT:判断本次任务是否引入新知识,如设计决策、规则变更、踩坑记录
ACT:正常执行代码修改或数据更新
RECORD:在同一轮里把知识写入对应文档,规则进 04-conventions.md,架构决策进 02-architecture.md,并记录决策背后的 WHY
CONFIRM:在最终回复里列出更新了哪些文档
配套护栏包括:只记录持久的项目级知识、规则变更时编辑旧行而非追加、禁止写入密钥和敏感信息。


作者举例:让代理把仪表盘列表改成卡片布局后,代理在同一次回复里就把这条设计决策连同理由写进了架构文档。三个会话后换了个全新模型,新模型读到这条记录,自动保持了卡片布局。这套方法解决了会话切换时的上下文丢失、代理重复犯错、文档腐化等问题,也让提示词从三段式背景说明简化为一句需求。作者也提醒,它不能消除幻觉,代码审查仍然必要。

#GitHub #开源 #AGENTSMD #AI代理 #提示工程 #文档管理
@GitHubTrendingHub
Post #625 15
SDKProof 实测:Claude 拒绝四成 Stripe 任务

开发者 Kalpit Rathore 发布了一款名为 SDKProof 的开源工具,用于检验 AI 编程代理写出的代码是否匹配库的当前 API,而非模型记忆中的旧版本。原理是把模型生成的答案放进装有真实依赖的项目里跑 tsc --noEmit,编译通过即算过关,由编译器而非另一个 LLM 来裁决。

作者在给 Stripe SDK 加入测试时发现异常:首轮 15 个任务全部通过,但其中 4 个答案文件是零字节空文件,空文件编译自然零报错,等于把「模型没产出」误判成「答对了」。修复后重测,Claude 对 150 个 Stripe 任务拒绝了 62 个(41.3%),而对照组 Zod 的 100 个任务零拒绝。拒绝呈明显梯度:创建 PaymentIntent、批量读取客户、使用非默认 API key 等操作几乎全拒,退款、创建客户、验证 webhook 则基本正常。作者尝试在提示词中补充账户归属上下文,A/B 对比显示拒绝率毫无变化,触发点在于操作本身的形态而非语境缺失。

作者还自曝了测量脚本的同类 bug:未加载 .env 导致全部请求认证失败,而错误请求被计为「未拒绝」,30 次失败被渲染成漂亮的零。修复后脚本将错误请求排除出分母,且失败过半时拒绝输出百分比。Stripe 现已以 100/100 分数上线榜单,页面在分数旁注明仅覆盖 15 个任务中的 10 个,并公开了拒绝率明细。三个专门用于捕捉版本漂移的任务全部通过,确认模型写的是当前 SDK 期望的 API 形态。


工具与完整数据已开源,作者欢迎复现不同结果的人反馈。

GitHub

#GitHub #开源 #SDKProof #TypeScript #AI编程 #Stripe #Claude #LLM测试
@GitHubTrendingHub
Post #624 17
腾讯混元发布新一代语音识别模型 Hy ASR3.0preview

腾讯混元推出语音识别模型 Hy ASR3.0preview,基于最新大语言模型 Hy3 的语言理解能力,融合高精度语音识别与深度语义理解,实现识别能力全面升级。

官方介绍称,该模型的目标是让语音识别不再只是听清,而是真正听懂——先理解语境和意图,再输出准确的文字。对语音转写、会议记录、字幕生成等场景的开发者来说,这意味着更接近人类听写习惯的识别结果。

#GitHub #开源 #腾讯混元 #HyASR #语音识别 #大模型
@GitHubTrendingHub
Post #622 14
GitHub开源观察|开源项目·热门仓库·开发者 Cypress:面向浏览器的前端自动化测试框架 Cypress 是一个快速、易用且可靠的前端测试工具,专为浏览器中运行的一切而设计。它支持 Mac、Linux 和 Windows 平台,可通过 npm、yarn 或 pnpm 安装,采用 MIT 许可证开源。 Cypress 解决了传统端到端测试工具配置复杂、运行缓慢的痛点,为开发者提供了开箱即用的测试体验。项目支持在 Cypress Cloud 中配置徽章以展示测试状态或测试数量,方便团队直观掌握项目健康度。 无论是单元测试、集成测试还是端到端测试,Cypress…

This post (sticker, poll or similar) has no web preview. Open in Telegram

Post #621 16
Cypress:面向浏览器的前端自动化测试框架

Cypress 是一个快速、易用且可靠的前端测试工具,专为浏览器中运行的一切而设计。它支持 Mac、Linux 和 Windows 平台,可通过 npm、yarn 或 pnpm 安装,采用 MIT 许可证开源。

Cypress 解决了传统端到端测试工具配置复杂、运行缓慢的痛点,为开发者提供了开箱即用的测试体验。项目支持在 Cypress Cloud 中配置徽章以展示测试状态或测试数量,方便团队直观掌握项目健康度。

无论是单元测试、集成测试还是端到端测试,Cypress 都能胜任。其简洁的 API 和实时重载功能,让前端开发者能快速编写并调试测试用例,是现代化 Web 开发流程中的重要一环。


GitHub

#GitHub #开源 #Cypress #前端测试 #自动化测试 #JavaScript #端到端测试
@GitHubTrendingHub
Post #620 15
Uber 开源企业 AI 智能体安全系统 ADR

ADR(Agentic AI Detection and Response)是 Uber 开源的面向 AI 智能体的企业级安全系统,已在 Uber 生产环境部署,相关论文被 MLSys 2026 接收。它用于保护员工使用的 Cursor、Claude Code、Codex 等编码智能体,以及面向客户的 AI 客服智能体。

ADR 通过四项互补能力保障智能体安全:可观测性(捕获 7 种以上 AI 编码工具在 macOS、Linux、Windows 上的意图、工具调用与执行轨迹)、安全基准测试(ADR-Bench 含 300 多个任务、133 个 MCP 服务器,覆盖全部 17 种智能体攻击技术)、威胁检测(双层架构结合高召回分类与深度推理)、以及预防机制(该组件暂未包含在开源版本中)。

本次开源内容包括 ADR Sensor(遥测采集与统一 schema)、ADR-Bench 基准测试与 ADR Detector 双智能体检测器。离线 ADR Explorer 引擎(用于部署前红队测试)未包含在内。项目采用 Apache License 2.0,检测基准中包含的合成数据(伪造凭证、模拟环境、提示注入场景)仅限防御性安全研究使用。


GitHub

#GitHub #开源 #Uber #ADR #AI安全 #智能体安全 #MLSys #MCP
@GitHubTrendingHub
Post #619 12
Ubuntu 上让 Docker Engine 继续当 Kubernetes 运行时

Kubernetes 1.24 移除 dockershim 后,想继续用 Docker Engine 作为节点运行时,需要借助 Mirantis 维护的开源 CRI 适配器 cri-dockerd。这篇教程针对 Ubuntu 给出完整配置步骤,并提醒哪些场景才值得这么做。

对多数人来说,默认用 containerd 更省事。只有当你确实依赖 Docker 套接字上的现有自动化、希望 docker build 与 kubelet 共享同一镜像存储,或受制于仍假设 Docker Engine 为运行时的供应商产品时,才考虑 cri-dockerd。

安装分三步:先通过 Docker 官方仓库装好 Docker Engine,并把 cgroup 驱动设为 systemd(Ubuntu cgroup v2 下必须与 kubelet 一致,否则节点无法保持 Ready);再下载 cri-dockerd 0.3.15 的 deb 包并启用 cri-docker.socket;最后在 kubeadm init 和 join 时通过 --cri-socket 指向 unix:///var/run/cri-dockerd.sock,其余节点配置与 containerd 方案相同。

有个容易踩的坑:kubelet 拉取的镜像和你手动 docker pull 的镜像存在同一存储里,docker ps 会看到大量 Kubernetes 管理的容器。集群容器请用 crictl 查看,手动管理的镜像才用 docker,避免误删 kubelet 拥有的容器。节点 NotReady 或拉取失败,多半是 cgroup 驱动不匹配或套接字路径问题。


GitHub

#GitHub #开源 #Kubernetes #Docker #cridockerd #Ubuntu #CRI #Mirantis
@GitHubTrendingHub
Post #616 12
GitHub 法务团队用 Copilot CLI 简化工作流

GitHub 官方博客分享了一篇案例,介绍其法务团队如何借助 Copilot CLI 来简化日常工作流程。文章展示了如何在不编写一行代码的情况下,构建工具来提升工作效率。

这篇内容来自 GitHub 博客,作者是数字化转型项目经理 Bria Ford。文中还推荐了其他相关文章,包括使用 GitHub Copilot 应用中的堆叠会话和拉取请求来现代化旧代码库,以及一个实用的 Copilot 工作流,用于原型设计、规划、实现和审查软件。

#GitHub #开源 #Copilot #CLI #效率工具
@GitHubTrendingHub
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →