SIG·NAL
AI 观察每周一 · 三 · 五
最新一期 No.7 · 2026-06-21

AI 又答对了几道题, 已经没那么新鲜了 现在要看它能否进入真实、可复核的工作链。

这几天的中文 AI 信息里,有一条很清楚的暗线:行业正在从展示能力,转向修补流程。AutoResearch 把检索、写作和审议拆成可复用的 Skill;医疗模型发现一次性问答远远不够;企业开始高价寻找能把模型塞进权限、数据和旧系统的人。另一边,3B 小模型的漂亮分数和会整理桌面的机器人又提醒我们,演示与通用能力之间仍隔着很长一段路。本期不追最大的数字,追的是那些开始接触真实摩擦的变化。

AutoResearch 把一键写论文拆成了一组可检查的质量门禁 / AI 看病先别急着回答,学会把问题问完整 / 3B 小模型逼近旗舰:基准没有失效,但标题很容易把能力范围抹掉 / FDE 走红说明企业买到模型之后,最贵的工作才刚开始 / Curr-0 让机器人边走边整理,但一段演示还不等于通用家务能力
87中文候选信号
5+5长文与摘要
1观点碰撞
3来源类型
阅读本期 →
往期存档
No.6 · 2026-06-15
AI 不再只等你喂材料, 它开始自己找、自己看、自己踩边界 真正该补的不是新功能,而是判断和护栏。
NotebookLM 不只是读你给它的资料,它开始想把研究直接做成交付物 / Siri AI 这次终于像助手了,但手机 Agent 最难的关仍然是私人上下文 / 本地 Agent 最危险的地方,是它看起来像工具,其实像一个账号
No.5 · 2026-06-12
AI 开始真正碰钱、碰情绪、碰复杂流程, 决定权该不该交出去 比模型参数更值得写。
Visa 把支付网络接进 ChatGPT,购物 Agent 第一次碰到通用结算层 / 压缩模型突然变成大生意,能离线跑的强模型开始有了现实路径 / 科学工作流里的 AI 开始学会留痕、复现和少说空话
No.4 · 2026-06-11
AI 开始碰那些不能轻易重来的决定, 真正难的是把责任留在桌面上。 这一期从志愿填报、股市、价格、实验室和多 Agent 工作台看五个边界
阿里把高考志愿做成 Agent,真正卖的是可追责的过程 / Robinhood 把股票和信用卡交给 AI 代理,金融 Agent 第一次碰真账户 / MiniMax 把单个助手改成 Agent Team,多 Agent 的价值是少盯着它
No.3 · 2026-06-10
AI 开始替你找资料、看手机、戴在身上, 但真正的门槛是验证。 这一期看五个更接近真实生活的压力测试
NotebookLM 从资料问答变成云端研究工作台 / Siri AI 与 iOSWorld 暴露手机 Agent 的真实难度 / OpenClaw 漏洞提醒本地 Agent 需要按数字身份治理
No.2 · 2026-06-08
AI 开始碰最贵的数据, 也开始碰最难的责任。 这期值得看的不是新功能,而是谁敢把流程交出去
ChatGPT 个人理财入口 / 科研工作流可执行化 / Agent 安全与权限边界
No.1 · 2026-06-08
Agent 不再只等你提问, 它开始抢占工作入口。 SIGNAL AI 观察
ChatGPT super app 与个人 Agent 边界 / Microsoft Scout 与桌面 Agent / Make MCP Toolboxes 与可控自动化
No. · 2026-06-07
AI 开始离开聊天框, 进入工作成形的地方。 SIGNAL 创刊号预览
Codex Sites 与工作物种 / 会议之后的 AI 接力 / AI 视频进入可控编辑