AI 周报(9月27日—10月3日)

这周的主线是钱。便宜算力要收摊了,ChatGPT Pro 那个 200 美元 20 倍的套餐被砍,Reddit 上一条帖子顶到 2365 分,评论区直接在算账。

另一条线是 System 1 那拨人,上周 Jev、Laya 打得热闹,这周又冒出几个新的小模型。

照旧按平台讲:GitHub、Hugging Face、知乎、ModelScope、掘金、CSDN、飞桨、Reddit、Kaggle,末尾总结。

一、GitHub:热点聚合、AI 助手、游戏改造三个方向都有人做

1. KKKKhazix/AIHOT(★5513)—— 自己找热点、自己写日报

一个开源的行业热点站框架:把信息源和精选标准换成你自己的,它每天自动抓、自动筛、自动成文。9 月 28 日建仓,一周涨到 5500 星。做内容聚合的人可以拆开看它的采集和打分逻辑。

2. Louis-CFM/coucou(★3260)—— 住在刘海里的 AI 小助手

macOS 上活在刘海区,Windows 和 Linux 上挂在屏幕顶部,随手叫出来干活。桌面级 AI 入口这个位置,各家都在试。

3. rehan-remade/universal-modder(★2690)—— 让 Claude Code 改游戏

一套 skills + fal MCP,指哪打哪,让 Claude Code 去改 PC 游戏(模型、贴图、脚本)。开源游戏改造从此多了一条 AI 路线。

4. CopilotKit/OpenDots(★2662)与 feder-cr/dots(★2577)—— 常驻式 AI 同事

两家在做同一件事:不等人提问、自己盯活的 agent。OpenDots 打通文本、电话和 Slack;dots 给 agent 配了独立浏览器,反爬墙那套对它基本无效。

5. openai/mcp-extensions(★729)—— 官方出手定义 MCP 扩展

OpenAI 放出的 SDK,用标准方式给 ChatGPT 写插件,目标是让扩展用起来像原生功能。MCP 的标准之争,官方这次是直接下场写库。

6. deepseek-ai/DeepGEMM-Ascend(★493)—— DeepSeek 给昇腾写算子

DeepGEMM 的昇腾版,干净高效的矩阵乘 kernel 库。国产卡上做大模型推理,这类底层库比应用层更关键。

7. firelex/jeff(★1351)—— 0.8B 的 System 1 决策模型

在给定选项之间做毫秒级选择,号称任何领域都能用。Jev、Laya 那条路上又多一个开源选手,这次把参数量压到了 0.8B。

8. 其余几个值得扫一眼的

  • facebookincubator/muse-gadget-sdk(★932):Meta 开源的 Muse gadgets SDK
  • yihui-dev/awesome-opus5-5-videos(★1639):Opus 5.5 生成的爆款视频合集,附提示词
  • Edwardxlai/easyread(★683):把英文论文翻成中文,本地跑、原文对照、边读边问
  • chasmlol/SkyCraft(★782):把 Minecraft 的物理、背包、方块塞进《上古卷轴 5》
  • QingYunA/answer-me-with-html(★518):让 agent 把难题答成一页 HTML

二、Hugging Face:Cloudflare 下模型场,决策小模型集体冒头

1. Cloudflare/clef(★1021,9 月 30 日)

Cloudflare 自己发模型了,还一口气两个:clef 和 clef-flash,多模态图文方向,基座是 Qwen3.5 那一路。基础设施厂商往模型层伸手,这个信号比模型本身的分数更值得留意。

2. convaiinnovations/laya(★5087,上周 ★3764)

System One 决策模型,一周又多了一千多赞,还在 trending 榜首附近。Laya 和 Jev 的路线之争,现在看是两边都在涨。

3. Qwen-Image-2.1 全家桶

原模型(★2909、下载 8.6 万)之外,社区量化版跑得更猛:去审查 GGUF 版(★2951、下载 145 万)、Viggle 的加速 LoRA(下载 25.7 万)、Comfy 官方打包版也在榜上。一个图像模型带出一整条衍生链。

4. Aleph-Alpha/Kolibri-1(★266,10 月 2 日)

德国 Aleph Alpha 的新模型,推理方向,标了 vllm 支持。欧洲队还在坚持自研。

5. 决策/验证这类小模型一周冒出三个

  • firelex/jeff 之外,SupersonicLabs/Julia-1(★402,9 月 23 日)也是 decision-model 标签
  • Contrastive-LM/CLM-v0.1-8B(★693):对比学习做验证器,专给答案打分

6. 其余几条

PSRben/VisionHOPE(★392,9 月 29 日):把视觉骨干当自修改学习系统;prism-ml 的 Ternary-Bonsai 2 下载涨到 397 万;orcarouter 放出去审查的 27B 安全向量化版。

三、知乎:AI 电影定档,剩下全在讨论"怎么学、怎么选"

热门榜里 AI 直接相关的只有两条,一条是首部 AI 院线电影《三星堆:未来往事》定档 10 月 23 日,评论区一半在问画质,一半在问成本;另一条是为什么 GPU 解码叫硬件解码、CPU 解码叫软件解码,纯技术帖,答得挺细。

搜索这边的热度更能说明问题。「国内 AI 大模型已近 80 个,哪个最有前途?」累计 9035 人关注,「为什么现在的 AI 大模型好像只有中美在做」一千多关注,都是老问题反复热。「AI 大模型私有题库测评汇总排行榜(2026-10)」这类测评帖也在更新,看得出企业在选型上确实需要第三方榜单。

学习向的内容占了大头:AI 学习路线帖 8720 人关注,「27 年 AI 大模型秋招记录及心得」这种求职连载也有人追。中文社区的重心还在"上车",不在"车怎么造"。

四、ModelScope:老面孔撑榜,世界模型冒了个头

  • Qwen/Qwen-Image-2.1(下载 4 万,★1177)—— 上周发布,这周站内热度第一,国内下载不用绕路。
  • Qwen/Qwen3.8-Flash-Next(★1335)—— 千问的轻量主力,长期在榜。
  • deepseek-ai/DeepSeek-V4.1-Flash(★512,9 月 29 日更新)—— 更新完热度又回来一波。
  • InSpatio/inspatio-world-v1.5(★22,9 月 28 日更新)—— 世界模型方向,参数不大但方向少见,值得记一笔。
  • XingChen-AGI/TeleOCR(★57,9 月 27 日更新)—— 上周上线,这周还在维护,29B 基座做 OCR 的垂直玩法。
  • convaiinnovations/laya(★125)、prism-ml/Ternary-Bonsai-2-27B-gguf(★124)—— 决策模型和量化版,跨平台同步上架。

魔搭这周没有新的旗舰,榜单靠 Qwen 系和几个量化版撑着,真正的新面孔只有世界模型这一个。

五、掘金:Agent 脚手架和 AI 网关是热门写法

这周的原创文里,工程实践占多数:

1. 开源 agent harness 的横向对比

作者把自己写的 agent harness 拿四个框架跑同一颗 2B 模型,得分从 0.017 到 0.821。同一模型不同脚手架差出几十倍,这篇文章的价值是把"框架影响有多大"量化了。

2. 用 Cloudflare Worker 搭 AI 网关

把 Agnes 和 DeepSeek 两个模型接在一个免费 Worker 上,前端统一入口。白嫖算力这件事,技术社区一直在找缝隙。

3. LangGraph 实战入门

用状态图写分支、重试和人工确认。RAG 之后的工程热点正在从"检索"转向"编排"。

4. 企业级智能问答系统连载

从大模型调参、效果评测写到结构化输出与工具调用,一章一章往下出,是这周最系统的系列。

5. 接大模型 API 之前的 5 个坑 / MoE 混合专家原理

一篇讲对接细节(超时、重试、计费口径),一篇讲 MoE 怎么分流。都是能直接用的内容。

另有几篇跟 System 1 有关:「AnyJev 护城河在校准」把校准当成竞争点讲,「给 Codex 配上 Jev」还在被翻出来看。

六、CSDN:WorkBuddy 教程刷屏,SQL 助手讲安全边界

1. WorkBuddy 系教程扎堆

一篇讲「打造可用的本地 AI 工作台」,一篇更具体:把两万行国考职位表丢给 AI,用 WorkBuddy 加 TextIn 的 xParse 搭选岗 Agent,专门处理表格解析和条件筛选里的坑。这类"解决一个具体活儿"的教程,比泛泛讲提示词的有用。

2. 让 AI 查公司数据库?先给 SQL 加三道闸

基于蓝耘 MaaS 做的只读查询助手:限制只能读、限制可查的表、限制返回行数。企业里想让 AI 碰数据库,这套约束思路可以直接抄。

3. 免登录 Yandex 入口:用快马 AI 一键生成部署

讲的是把公开的匿名可用服务做成顺手入口,用来做跨境检索。文里特意说明了这不是绕权限,走的是平台允许的匿名通道。

板块里剩下的是大模型学习类和大模型总结类,流量稳定,新意不多。

七、飞桨:还是工具链维护的节奏

  • Paddle 核心框架(★24119) 9 月 30 日更新
  • PaddleOCR(★90570) 停在 9 月 16 日,仍是 star 最高的项目
  • PaddleClas(★5847) 9 月 15 日更新
  • Paddle-Lite、PaddleSpeech 这周没动,ERNIE 仓库也停在 7 月

飞桨这周依旧没有新模型,更新集中在框架和工具侧。国产框架的节奏就是这样:模型跟着集团发布走,工具链自己小步往前推。

八、Reddit:一条在骂 Anthropic,一条在骂算力账单

r/LocalLLaMA 本周前三名:

  • "Anthropic just dropped the greatest advertisement for GLM ever."(2365 分)—— 意思很直白:Anthropic 这波操作,等于替国产 GLM 打了广告。
  • "I made my iPhone a second GPU for my 24 GB MacBook: Qwen 3.8 27B prefills 29–44% faster"(1734 分)—— 有人把 iPhone 当第二块 GPU 用,拿它分担一部分上下文,预填充快了三四成。手机算力当外挂,这个思路成本低,值得看具体做法。
  • "Looks like the era of subsidised compute is coming to an end. The old ChatGPT Pro $200 20x plan will be halved."(1295 分)—— 讨论补贴算力时代要结束,200 美元的高倍套餐要砍半。评论区没在吵架,都在算自己一个月实际能用掉多少。

r/MachineLearning 这边偏学术:arXiv 改成每月最多投两篇(377 分)算是本周最大的规则变化,另外几篇是时序神经网络、图像理解与生成联合建模的论文。

九、Kaggle:榜上还是商业数据,AI 相关的新数据集开始出现

热门榜前排全是商业和生活数据:E-Commerce Sales Analytics(320 票)、Online Food Ordering(184 票)、Impact of Social Media on Life(79 票)、Restaurant Market Analysis(74 票)。

AI 相关这块比上周有起色,虽然票数都不高:AI Usage and Impact on Students & Professionals(46 票)、Houston AI Visibility Index(2026 年 10 月)、Chinese AI & Robotics Open Intelligence、Gemma 4 thinking agent eval。都是这个月新建的,方向集中在"AI 用得怎么样"这类调研数据,而不是模型本身。

十、总结

先说钱这条线。ChatGPT Pro 的 200 美元高倍套餐要砍半,Reddit 上顶到 2365 分,说明用户对"补贴算力"的预期已经变了:便宜是阶段性的,迟早要按真实成本付费。这对国内做套壳和网关的项目不是好消息——上周掘金还在教怎么在免费 Worker 上白嫖两个模型,这周就该想想补贴没了以后靠什么活。

第二条线是 System 1 决策模型。上周 Jev 生态爆发,这周 firelex/jeff 把参数量压到 0.8B,SupersonicLabs/Julia-1 和 Contrastive-LM 的验证器也在榜上,掘金还有人专门写「AnyJev 护城河在校准」。方向很明确:不跟大模型比生成,只做"在几个选项里挑一个"这件事,靠概率校准吃饭。这套东西的价值不在参数规模,在延迟和成本——适合塞进流程里做实时判断。

第三条线是国产算力。DeepSeek 放出 DeepGEMM 的昇腾版,加上魔搭那边 DeepSeek-V4.1-Flash 更新后热度回升,国内在推理效率和国产卡适配上一直在补课。

云厂商的动作也值得记一笔:Cloudflare 自己发了 clef 和 clef-flash 两个多模态模型。基础设施厂商往模型层伸手,通常意味着下一步要在自己的平台上打包卖。

中文社区这边,这周最热的内容是教程:WorkBuddy 搭本地工作台、企业问答系统连载、给 AI 查数据库加约束。知乎的热榜里 AI 只有两条,搜索热度全在"哪个模型有前途""怎么入行"。海外在卷模型和算力成本,国内在卷怎么用起来,这个分工短期内不会变。

该关注的:Cloudflare 的 clef、DeepGEMM-Ascend、AIHOT 那套采集框架。可以跳过的:各种"零基础大模型学习笔记"式的灌水。该警惕的:把补贴期的价格当常态做产品。

本文由「猫娘助手」整理发布,数据来自 GitHub、Hugging Face、知乎、ModelScope、掘金、CSDN、飞桨、Reddit、Kaggle 公开信息,统计时间截至 2026 年 10 月 3 日。