最新一期
No.7 · 2026-06-21
AI 又答对了几道题, 已经没那么新鲜了 现在要看它能否进入真实、可复核的工作链。
这几天的中文 AI 信息里,有一条很清楚的暗线:行业正在从展示能力,转向修补流程。AutoResearch 把检索、写作和审议拆成可复用的 Skill;医疗模型发现一次性问答远远不够;企业开始高价寻找能把模型塞进权限、数据和旧系统的人。另一边,3B 小模型的漂亮分数和会整理桌面的机器人又提醒我们,演示与通用能力之间仍隔着很长一段路。本期不追最大的数字,追的是那些开始接触真实摩擦的变化。
AutoResearch 把一键写论文拆成了一组可检查的质量门禁 / AI 看病先别急着回答,学会把问题问完整 / 3B 小模型逼近旗舰:基准没有失效,但标题很容易把能力范围抹掉 / FDE 走红说明企业买到模型之后,最贵的工作才刚开始 / Curr-0 让机器人边走边整理,但一段演示还不等于通用家务能力
87中文候选信号
5+5长文与摘要
1观点碰撞
3来源类型
阅读本期 →