本周动态
OpenAI 推出 ChatGPT Work 与 Codex 的 Admin plugin:管理动作可在同一段对话中完成
OpenAI 8 月 25 日发布 Admin plugin,管理员可在 ChatGPT Work 和 Codex 中查看工作区使用与额度、管理成员和群组、核查权限、调整用量限制,并处理相关请求;官方强调它遵循既有角色、策略和审批要求,且对影响较大的变更支持先审阅再执行。经营者视角:企业 AI 管理的重点已从“给员工开账号”转向“谁能看什么、谁能改什么、费用何时触发审批”。即使不是使用该产品,也应把成员、权限、额度和变更日志做成每月一次的管理清单。
AWS 发布框架无关的 AgentCore Evaluations:用同一套标准评估不同 Agent
AWS 8 月 26 日介绍 Amazon Bedrock AgentCore Evaluations:只要 Agent 输出符合 OpenTelemetry 或 OpenInference 约定的遥测数据,即可用统一的正确性、帮助性、目标达成率或自定义评估器评分,覆盖 OpenAI Agents SDK、LangGraph、Google ADK、Claude Agent SDK 等框架,并支持上线前按需评估和生产流量在线评估。经营者视角:不要只验收 Agent “能不能跑通”,还要为关键流程预先写出 10 至 20 条标准任务、预期结果和不允许发生的动作;上线后按周看通过率、人工接管率和异常成本,再决定是否扩大。
来源:AWS Machine Learning Blog · 相关工具:Dify
Slackbot 增加 Big Mode、Skill Sets 与 Deep Research:团队可把有效工作流打包复用
Slack 8 月 27 日发布 Slackbot 的 Big Mode、Skill Sets 和 Deep Research。Big Mode 用于长篇研究、分析与文件起草;Skill Sets 可把一组技能按团队或频道一次性分发;Deep Research 可结合组织数据与公开网页输出带引用的研究报告。经营者视角:销售、招商、外贸和项目管理团队最容易先受益,但前提是把“好用的个人提示词”整理成有负责人、适用范围和输出模板的团队技能包,并明确哪些结论必须回看原始来源。
Google Cloud 推出 Gemini Enterprise for Legal:专业 Agent 的价值取决于权限、技能和可追溯引用
Google Cloud 8 月 25 日发布 Gemini Enterprise for Legal 预览版,面向合同审阅、法规跟踪、法律研究和文档起草等高精度工作;官方描述其由领域技能、受现有权限约束的 MCP 连接器、可执行任务的 Agent 和集中治理组成,并强调可追溯引用和私有数据隔离。经营者视角:这给所有专业服务、工程投标和采购审查一个提醒:模型能力只是底座,真正可交付的系统必须把内部规则、可信资料、访问边界、输出引用和复核责任一起配置。
来源:Google Cloud Blog · 相关工具:Gemini
本站数据速览
- 本站数据速览:当前工具库收录 150 款工具;本期相关入口集中在 ChatGPT、Gemini、Dify 和 Slack AI,可从“老板提效”“企业知识库”“数据分析”和“外贸 / 招商”场景先选一个流程试跑。
- 本站关于国内访问、中文支持和价格入口的工具信息仍以各页面的人工复核日期为准;本期海外产品发布不等同于在中国大陆可用或适合直接采购。
- 外贸、电商、制造和装潢工程团队若把 AI 接入客户资料、报价、合同或项目文件,先规定资料范围、可执行动作、人工复核人和异常停止条件,再把高风险环节交给 Agent。
本周可直接照做:给一个团队 AI 流程写出上线验收标准
把下面提示词发给 ChatGPT、Gemini、Claude 或 Kimi:“请为我们准备上线的 AI 工作流生成一页验收卡。流程是:{填写,例如根据项目资料和公开来源生成投标初稿};使用团队是:{填写}。请输出:1)允许读取的数据和禁止读取的数据;2)允许自动执行、必须人工批准、绝不允许执行的动作;3)15 条验收任务及每条预期结果;4)每周要看的成功率、人工接管率、错误类型和成本;5)保存的来源链接、操作日志和复核人;6)发现越权、无引用或成本超限时的停止规则。先指出最高风险的三项,再给出首周最小试点范围。”只启动能明确回答以上六项的一个流程。