GitHub AI 热榜 TOP10 2026年第36周
本周 GitHub AI 热榜 TOP10 深度解析(2026 年第 36 周):AI 教育爆发,开源平替成军
这是每周一次的 GitHub AI 热榜深度解析。本期覆盖 2026 年 8 月 31 日至 9 月 6 日,数据直接抓取自 GitHub Trending 周榜,并经 whatstrending.ai、多份中文趋势日报交叉验证。本周两大叙事浮出水面:"学 AI"本身成了爆款品类(多智能体课堂、从零训练 LLM 双双上榜),以及"开源平替 + 本地优先 + Agent 集成"三板斧成军(ElevenLabs 平替、Semrush 平替同周登榜)。archify 则完成两连冠且增速不减反增。
先看榜单全貌(按本周新增星标排序):
- tt-a1i/archify —— 可验证架构图技能,两连冠(+19,480 星)
- THU-MAIC/OpenMAIC —— 清华系多智能体互动课堂(+10,109 星)
- debpalash/VoiceStudio —— 完全本地的 ElevenLabs 开源平替(+6,761 星)
- bilawalsidhu/gods-eye-view —— 浏览器里的间谍卫星模拟器(+5,926 星)
- K-Dense-AI/scientific-agent-skills —— 科研 Agent 技能库,二连榜(+5,491 星)
- affaan-m/ECC —— Agent harness 性能优化全家桶(+5,445 星)
- jingyaogong/minimind —— 3 元 2 小时从零训练 64M LLM(+3,649 星)
- google-research/timesfm —— Google 时序预测基础模型 3.0(+2,968 星)
- every-app/open-seo —— Semrush/Ahrefs 的开源平替(+2,755 星)
- abi/screenshot-to-code —— 截图转代码老将回榜(+2,034 星)
01 archify:两连冠,增速不降反升
一句话定位:让 Cursor、Claude Code、Codex CLI 在聊天中直接产出精美、可验证、可交互架构图的 Agent Skill——单文件 HTML 输出,总星近 5 万。
为什么继续霸榜(+19,480 星,上周 +14,875)
一个技能型项目连续两周霸榜且增速还在放大,这在热榜上极罕见。本周的关键增量:8 月 30 日合入约束驱动编译器(constraint-driven compiler,workflow 图的生成正确性再上一个台阶),9 月 1 日正式把 DeepSeek Harness 集成写进安装表,社区贡献 PR 开始成规模涌入(本周 300+ 号 PR)。"可验证架构图"这个品类现在几乎是 archify 的代名词——先发优势 + 确定性编译的护城河正在复利。
本周看点
- 约束驱动编译:workflow 图不再只靠 Agent "自觉",编译期就能校验约束(如审批门必须连接到有权限的节点),并附带机器可读的证明凭据。
- 五类图 + Before/Delta/After 对比仍是核心场景,导出 PNG/SVG/WebM/分享卡片齐全。
- 安装依旧一条命令:
npx skills add tt-a1i/archify -g,MIT 协议。
适合谁
接手陌生代码库的工程师、写技术方案和做架构评审的团队。它不是通用绘图工具(不做 Mermaid 解析、不做 WYSIWYG),这个"不做什么"的克制正是它能做精的原因。
02 OpenMAIC:清华系多智能体互动课堂,一键沉浸式学习
一句话定位:Open Multi-Agent Interactive Classroom——上传一份 PDF/PPT,AI 代理团队自动生成带语音、白板、动画的沉浸式课堂,还能导出成教学视频。
为什么本周爆火(+10,109 星)
这是本周最有想象力的新面孔。核心管线:文档导入(PPTX/PDF/图片/视频)→ 代理通过 generate_scene、generate_tts、web_search 等工具生成课程场景(自研 DSL 定义)→ 播放引擎回放课堂(聚光灯、激光笔、白板书写效果 + TTS 语音)→ 甚至可以用 Chromium 无头渲染服务导出 MP4 教学视频。内置费曼学习法和螺旋式课程教学法技能,支持 KaTeX 数学公式,12 种语言本地化。核心贡献者邮箱为清华学生邮箱域名,项目由清华大学相关团队打造——国内高校在 AI 教育基础设施上的开源输出。
核心亮点
- 代理工作台模式:代理用工具生成并编辑课程场景,"单一事实来源"的编排规范保证应用运行时与视频导出器时间语义一致。
- TTS 阵容豪华:OpenAI、Azure、GLM、Qwen、MiniMax、豆包、ElevenLabs,还有自托管 VoxCPM2(带语音克隆)。
- 工程严谨度罕见:7,137 个测试通过、SSRF 防护、跨域凭证剥离、Claude + Codex 交叉代码审查。
- npm SDK 家族:@openmaic/dsl、renderer、importer、generation、storage 可独立复用。
技术栈与上手
TypeScript monorepo(React + PostgreSQL + Motion/GSAP),Node.js 22.19+,中英双语 README。仓库 v1.0.1,需要确认许可证后商用。适合教育工作者、内容创作者、想做 AI 教学产品的团队。
03 VoiceStudio:完全本地的 ElevenLabs 平替,646 种语言
一句话定位:开源、完全本地化的语音 AI 工作站:语音克隆、语音设计、视频配音、听写、转录、有声书制作,16 个 TTS 引擎 + 11 个 ASR 引擎,无需账号、API key 和订阅。
为什么本周爆火(+6,761 星)
价值主张三连击:ElevenLabs 太贵、音频上云不放心、批量生成成本失控——VoiceStudio 全部回应。语音克隆 3 秒参考音频即可(zero-shot),视频配音走 WhisperX 词级时间戳 + 翻译 + 保留说话人的完整管线,有声书支持 EPUB/PDF 导入、多角色剧本、.m4b 分章导出。约 13.7 万次下载、1,908 次提交,Tauri v2 桌面壳 + FastAPI 后端,macOS/Windows/Linux/Docker 全平台。
核心亮点
- 引擎矩阵按硬件适配:Apple Silicon 用 MLX-Audio/Parakeet MLX(统一内存延迟最低),NVIDIA 8GB+ 用 OmniVoice/CosyVoice 3 高保真克隆,纯 CPU 用 PocketTTS/sherpa-onnx 也能跑。
- 开发者生态:OpenAI 兼容音频 API(一行换 base_url)、MCP Server、Agent Skill(npx 一条命令装进 Claude Code)。
- 隐私是硬约束:桌面应用只与 loopback 后端通信,文件路径永不出应用,分析默认关闭。
- AudioSeal AI 水印内置,声音市场带同意/禁止冒充护栏。
适合谁
配音创作者、播客/有声书团队、需要离线或大批量语音生成的企业。许可注意:应用层 AGPL-3.0,闭源商用需商业授权;默认引擎权重为 CC-BY-NC 非商业许可——商用前务必核对模型条款。目前处于活跃 Beta,生产使用请锁定最新 release。
04 gods-eye-view:浏览器里的间谍卫星,数据全是真的
一句话定位:照片级 3D 地球上的实时开源空间情报:11,000+ 实时航班、全球船舶、卫星、地震、公共摄像头,外加 28 个工具的 AI 语音指挥系统。
为什么本周爆火(+5,926 星)
这个项目自带流量基因:源自 YouTube 500 万+ 播放的爆款视频系列,8 月开源后登顶过 GitHub 日榜和周榜第一,JavaScript 之父 Brendan Eich 亲自评价"pretty cool"。视觉上是机密作战室的机密美学,内核却全部是合法公开数据——OpenSky 航班、AISStream 船舶、CelesTrak 卫星轨道(838 个天体目录,含整个 Starlink 星座)、USGS 地震、NASA FIRMS 火情。13 个图层中 11 个免密钥可用。
核心亮点
- AI 语音代理(需 OpenAI key,可选):"带我去东京"、"德州上空现在有多少航班"、语音白板标注真实边界多边形——28 个工具四大类,含场景感知和视觉定位(读取街景截图里的招牌)。
- 驾驶舱视角:骑乘真实航班全程下降,中途切换夜视/FLIR 热成像传感器(GLSL 自定义着色器)。
- 工程扎实:无框架原生 JS + CesiumJS + Google 照片级 3D Tiles,2,672 个单元测试,服务端凭据代理防 SSRF。
- 道德边界写进贡献指南:明确拒绝人脸识别、个人追踪类 PR。
技术栈与上手
JavaScript + CesiumJS,MIT 协议。无账号无密钥即可启动(AI 功能是"升级项而非前提"),冷启动中位数 1.86 秒:
git clone https://github.com/bilawalsidhu/gods-eye-view.git
cd gods-eye-view && npm ci && npm run dev
适合谁
GEOINT/OSINT 爱好者、教育演示、数据可视化开发者。注意官方明确警告:不可用于导航、应急响应等安全关键场景。
05 scientific-agent-skills:二连榜,165 个技能让 Agent 成为科学家
一句话定位:全球 19 万科学家在用的科研 Agent 技能库,165 个经验证技能 + 100 多个科学数据库接口,上周刚解析过,本周增速从 +3,642 提升到 +5,491。
为什么继续爆火(+5,491 星,加速中)
二连榜且增速提升 51%,验证了技能生态的复利效应:技能越多 → 演示效果越好 → 贡献越多。本周技能数从 163 增至 165,README 语境进一步向开放 Agent Skills 标准靠拢。核心场景不变:一条提示词完成"查 ChEMBL → RDKit 构效分析 → DiffDock 分子对接 → PubMed 检索 → 可视化报告"的药物发现全流程,database-lookup 一个技能确定性访问 78 个公共数据库。
快速上手
npx skills add K-Dense-AI/scientific-agent-skills
仓库 MIT,但各技能有独立许可(docx/pdf/pptx/xlsx 四个文档技能来自 Anthropic),临床类技能标注"仅供研究"。适合科研人员、制药团队、临床数据科学团队。
06 ECC:给 AI 编程工具装上整套工程体系的全家桶
一句话定位:Agent harness 性能优化系统:68 个子代理、286 个技能、94 个斜杠命令、122 条规则,一次性装进 Claude Code/Codex/OpenCode/Cursor 等 20+ 种工具。
为什么本周爆火(+5,445 星,总星高达 25 万量级)
如果说 archify 和 scientific-agent-skills 是"单技能精品",ECC 走的是另一个极端:整套工程体系打包。技能覆盖 React 模式/测试/性能(70 条性能规则)、TDD 工作流、可访问性、GitHub 协作等;agents 是专职审查/执行角色(react-reviewer、typescript-reviewer、harness-optimizer);还有"研究优先"的规划-测试-实现-审查-验证流水线。安全上,所有代理内置提示词防御基线,审查流程明确把 diff 视为不可信输入(防提示注入)。MIT 协议,中英双语 README。
核心亮点
- 20+ 种 harness 适配器:.claude、.codex、.opencode、.cursor、.gemini、.kimi、.kiro、.qwen、.zed、.codebuddy 等全覆盖,记忆数据按工具隔离存储互不冲突。
- 克制的设计:默认 MCP 只留 1 个连接器,hooks 需显式授权,规则注入有字节上限——都在控制 token 开销。
- 可回滚:单目标安装涉及 458 个文件操作,uninstall 可完整回滚。
适合谁
重度多工具 AI 编程用户和团队。注意:体量巨大,官方自己也承认"对小项目可能过度"——建议先用 --profile minimal 试用。总星数 25 万+ 属于全站最高梯队,以 GitHub 实时数据为准。
07 minimind:3 块钱 2 小时,从零训练你的 64M 大模型
一句话定位:仅用约 3 元人民币 GPU 成本 + 2 小时,在单张 3090 上从零训练一个 64M 参数对话 LLM——全套 PyTorch 原生实现,不用任何高层封装。
为什么持续爆火(+3,649 星,总星近 6 万)
LLM 教育赛道的常青树,本周回潮靠 minimind-3 的长尾发酵:模型结构全面对齐 Qwen3 生态(RMSNorm + SwiGLU + RoPE + GQA),新增原生 Agentic RL(多轮工具调用的 GRPO/CISPO 训练)、Tool Call 混入主线 SFT、自适应思考开关。最难得的是透明:Agent-CISPO 权重数学工具调用成功率 85%(vs 纯 SFT 的 60%),但 README 坦诚 RL 后训练伴随"对齐税"——事实性下降、幻觉增多。这种诚实的工程记录正是社区买账的原因。
核心亮点
- 全阶段覆盖:预训练 → SFT → 蒸馏(黑盒+白盒)→ 手写 LoRA → DPO → PPO/GRPO/CISPO → Agentic RL,每一步的底层代码都可读。
- 成本透明:64M 版本预训练 + SFT 合计约 2.31h / 3 元;MoE 版(198M-A64M)约 4.2 元。
- 生态兼容:transformers、llama.cpp、vllm、ollama、Llama-Factory 全通吃,兼容 OpenAI API 协议的服务端 + Streamlit WebUI。
技术栈与上手
Python + PyTorch 原生,Apache 2.0 协议。中文作者出品,中文文档完善:
git clone --depth 1 https://github.com/jingyaogong/minimind
cd minimind && pip install -r requirements.txt
cd trainer && python train_pretrain.py # 预训练
python train_full_sft.py # SFT
适合谁
想真正理解 LLM 内部机制的开发者、入门学习者、有个人 GPU 的独立开发者。它和上面 07 号……它和第 2 名 OpenMAIC、上周的 ai-engineering-from-scratch 共同构成一个信号:AI 教育内容正在从"课程"进化为"可运行的开源基础设施"。
08 timesfm:Google 时序预测基础模型 3.0,三榜第一
一句话定位:Google Research 的时序预测基础模型,3.0 版本拿下 fev-bench、TIME Benchmark、GIFT-Eval 三大基准第一,新增原生多变量预测。
为什么本周爆火(+2,968 星)
时序预测是个"不起眼但真金白银"的赛道——销量预测、容量规划、金融分析、运维监控都要用。TimesFM 3.0 的更新很实在:原生多变量 + 协变量预测(支持过去协变量和过去+未来协变量,免逐任务调参)、零样本泛化能力登顶三大基准。加上已集成进 BigQuery ML、Google Sheets、Vertex Model Garden,企业路径清晰。本周仓库还合入了 timesfm3 基准套件和 Apache 2.0 许可头(8 月 28 日)。
核心亮点
- decoder-only 时序基础模型:预训练后零样本预测任意长度序列,支持 9 分位概率预测。
- 2.5 版本线索:200M 参数(从 500M 降下来)、16k 上下文、可选 30M 分位头——轻量化路线明确。
- Agent Skill 官方支持:timesfm-forecasting 技能遵循 agentskills.io 标准,可装进 Claude Code/Cursor 让编码代理直接做预测。
技术栈与上手
Python(PyTorch/Flax),安装:
pip install timesfm[torch]
重要许可提示:源代码 Apache-2.0,2.5 及以前权重也是 Apache-2.0,但 TimesFM 3.0 预训练权重采用非商业许可,禁止商用和生产使用——生产环境请用 2.5 或自行评估。
09 open-seo:Semrush 平替,为 AI 代理而生的 SEO 工具
一句话定位:Semrush/Ahrefs 的开源按量付费替代品:关键词研究、排名跟踪、竞品洞察、外链分析、站点审计、AI 搜索可见性六大工作流,内置 MCP 服务器。
为什么本周爆火(+2,755 星)
"What Broke the $99 Ceiling"(是什么击穿了 99 美元的天花板)——最新博客直接把矛头对准 Semrush 的订阅定价。OpenSEO 的差异化不是"功能一样但便宜",而是AI 原生:内置 MCP 服务器让 Claude Code、OpenClaw 等代理直接调用 SEO 数据,官方插件覆盖 Claude Code、Codex CLI、Cursor,甚至已提交 ChatGPT 应用。你的 AI 代理可以自己跑站点审计、分析关键词、写优化建议——SEO 首次成为 Agent 可编排的工作流。
核心亮点
- 站点审计深度:24-27 种问题类型(含严重级别 + 修复方法)、跨页面重复内容检查、重定向链检测、Lighthouse 集成,专属测试站点 badseo.dev 故意埋了 27 种错误做端到端验证。
- AI 可见性检查:检测品牌在 AI 搜索(Claude、GPT 等)中的表现——2026 年的新刚需。
- 透明商业模式:MIT 协议 + Docker/Cloudflare 免费套餐自托管,按量向 DataForSEO 付费,无订阅。
技术栈与上手
TypeScript 全家桶(Cloudflare Workers + Drizzle ORM + D1/Postgres 双后端),需要 DataForSEO API key。适合预算敏感的站长、独立开发者、想把 SEO 交给 AI 代理打理的团队。
10 screenshot-to-code:7.8 万星老将的回榜密码
一句话定位:把截图、设计稿、Figma 甚至屏幕录像转成干净代码(HTML/Tailwind/React/Vue/Bootstrap/Ionic)的祖师级项目,总星 7.8 万,本周再度回榜。
为什么老树发新芽(+2,034 星)
2023 年就爆火的项目能回榜,靠的是持续换代:默认模型已切换为 Gemini 3 Flash/3.1 Pro(官方标注"最好的模型",且 Gemini 独享"从截图里提取真实 Logo/图片素材"的能力),支持 GPT-5.5、Claude Opus 4.8 等一排旗舰,Replicate 驱动图片生成、背景去除和图像编辑。最亮眼的是视频模式:录一段网站操作视频,直接转成可交互原型。截图预览功能让 Agent 在无头浏览器里渲染自己生成的页面并自我检查。
技术栈与上手
React/Vite 前端 + FastAPI 后端(Python),本地跑需要至少一个模型 key(Gemini 强烈推荐),Docker 一键部署:
echo "OPENAI_API_KEY=sk-your-key" > .env
docker-compose up -d --build
# 访问 http://localhost:5173
适合谁
前端开发者还原设计稿、产品经理做高保真原型、外包团队快速复刻竞品界面。想零配置直接体验可用官方托管版 screenshottocode.com。
本周五条趋势总结
一、"学 AI"成为爆款品类,且形态在升级
OpenMAIC(+10,109)和 minimind(+3,649)同榜,加上榜外的 ai-engineering-from-scratch,AI 教育项目占了本周热度的两成以上。值得注意的形态进化:不再是静态课程文档,而是可运行的开源基础设施——课堂本身由多智能体实时生成,模型训练本身就是一个下午能跑完的脚本。教育内容变成了软件。
二、"开源平替三板斧"成军:平替 + 本地优先 + Agent 集成
VoiceStudio 平替 ElevenLabs,open-seo 平替 Semrush/Ahrefs,共同的配方是:开源许可证 + 完全本地/自托管的数据主权 + 内置 MCP Server 和 Agent Skill。第三点是关键差异——2026 年的平替项目不再只和原版比功能价格,而是比"谁能让 AI 代理替你干活"。这三板斧大概率会成为下一年开源工具类项目的标准架构。
三、技能生态进入复利期
archify 两连冠且增速从 +14,875 涨到 +19,480,scientific-agent-skills 增速从 +3,642 涨到 +5,491,连 Google 官方都给 timesfm 配了 agentskills.io 标准的官方技能。连榜项目不靠营销靠复利:技能可组合 → 效果可演示 → 贡献可持续。Agent Skills 标准已经完成了从"特性"到"公共基础设施"的跨越。
四、Harness 优化从单点走向全家桶
ECC(68 代理 / 286 技能 / 94 命令 / 122 规则,20+ 工具适配)代表了另一个极端:不装一个技能,装一整套工程体系。有意思的是它同时示范了克制——默认 MCP 只留一个连接器、hooks 显式授权、规则注入设字节上限。技能"精"派(archify)和技能"全"派(ECC)同榜共存,说明这个生态还没收敛,两条路线都还有增长空间。
五、许可条款成为新的竞争维度
本周榜单上许可信息密集炸雷:TimesFM 3.0 权重非商业(2.5 及以前 Apache-2.0)、VoiceStudio 应用层 AGPL-3.0 + 默认模型 CC-BY-NC、OpenMAIC 许可待确认。开源不等于随便商用——权重与应用分层许可正在成为基础模型项目的默认操作,选型时要把许可尽调当成第一道工序。
写在最后
前三周的叙事是"修路"(记忆与治理)、"装技能"(Skills 标准化)、"发粮票"(免费额度聚合),本周是"开学"与"平替"——AI 教育基础设施集中爆发,开源平替军团带着 MCP 标配进场。archify 的两连冠则提醒我们:在一个追逐新概念的赛道里,把一件事做到可验证、可复利,本身就是最强的增长策略。
下周同一时间,继续追踪。
文章固定链接:https://www.codef.cc/github-trending-weekly-2636.html
本站资源仅供个人学习交流,请于下载后 24 小时内删除,不允许用于商业用途,否则法律问题自行承担。
本站软件默认解压密码均为:CodeF.cc
