本期内容
本期从安全、设计、自动化三个维度切入 AI 工具的现实落地。OpenAI 同一天发了两篇技术文章,一篇关于 ChatGPT 如何在高危对话中识别用户情绪状态,一篇关于 Codex 在 Windows 上的沙盒隔离架构;另一篇揭露了一起真实的 npm 供应链攻击事件,值得每个写代码的人认真对待。Mistral 的 Workflows 进入公开预览,把"多步骤自动化"的门槛降到了自然语言描述的程度。最后一个产品 Tendem 方向相反,专门在 AI 工作流里插入人类审核层,触碰了一个真实但少有人正面讨论的问题:你什么时候不信任 AI 的答案。
本期要点
- ChatGPT 更新情境识别能力,可在敏感对话中评估用户状态并主动建议联系真实的人,AI 产品与用户的关系开始从"使用"走向"托付"
- OpenAI 工程博客拆解了 Codex 在 Windows 上的沙盒方案,核心是在 WSL 2 内部再加一层隔离,解决了代理执行权限和安全边界之间的平衡问题
- 攻击者在 npm 发布 TanStack 同名恶意包,安装后窃取环境变量中的密钥,供应链风险在 AI 代理普及后变得更加直接
- Mistral Workflows 进入公开预览,允许用自然语言定义多步骤业务流程并自动执行,每个节点可以是语言模型在做判断而非固定规则
- Tendem by Toloka 主打把 AI 任务转交真人专家,在全行业强调自动化的背景下反向押注,本质是在卖"人类审核层"作为一种服务
参考资料
Helping ChatGPT better recognize context in sensitive conversations — https://openai.com/index/chatgpt-recognize-context-in-sensitive-conversations/
Building a safe, effective sandbox to enable Codex on Windows — https://openai.com/index/building-codex-windows-sandbox/
Our response to the TanStack npm supply chain attack — https://openai.com/index/our-response-to-the-tanstack-npm-supply-chain-attack/
Mistral Workflows: work that runs the business — https://mistral.ai/news/workflows
Tendem by Toloka — https://www.producthunt.com/posts/tendem-by-toloka
---
BearTalk 狗熊有话说播客,始于 2012 年。
订阅地址:https://beartalking.com/page/podcast