OpenAI 把企业数据接进 ChatGPT
企业级 AI 的竞争正从模型能力转向工作流入口:OpenAI 把内部数据直接搬进对话框,百度让业务人员亲手搭系统。与此同时,Anthropic 的威胁报告提醒,模型滥用已从个案变成可监测的安全议题,能力越强,治理越贵。
- 🏢 ChatGPT Work 直连企业数据源
- 🛡️ Anthropic:AI 攻击更自主更低门槛
- 🎭 Tavus 134 毫秒生成超写实数字人
一、今日AI

海外新闻
1. OpenAI 为 ChatGPT Work 接入企业数据,同步推出金融服务版
OpenAI 为 ChatGPT Work 上线数据插件,用户可在对话框内直连公司内部数据源,用自然语言追问业务指标,取数、分析、结论压缩进同一窗口,无需在 BI 与报表间切换;同步推出 ChatGPT for Financial Services,内置金融数据与模板,覆盖投研、合规。
海外新闻
2. Anthropic 发布 9 月威胁情报报告:AI 网络攻击更自主、门槛更低
Anthropic 发布 9 月威胁情报报告,梳理八个月来攻击者滥用 Claude 的手法,覆盖监控行动到武器研发。两个关键判断:AI 在网络攻击中更自主,需人工介入的环节持续减少;复杂攻击不再依赖高水平攻击者,门槛显著拉低。Anthropic 称已识别并中断多起恶意使用。
海外新闻
3. Tavus 发布 Phoenix 4.5:134 毫秒生成超写实数字人
Tavus 发布数字人模型 Phoenix 4.5,主打超写实与实时交互,可渲染带非语言线索的 AI 人类形象,包括上半身细微动作与表情,让对话者感知 AI 在倾听;官方称其渲染速度最快,视频生成延迟仅 134 毫秒,接近真人视频通话实时水平,瓶颈从算力转向内容真实度。
国内新闻
4. 月之暗面 Kimi 目标年化收入 20 亿美元,一年翻倍冲刺
据彭博报道,月之暗面把年底年化收入目标定在 20 亿美元,较 8 月运行率翻倍。K3 模型今夏发布后表现强劲,OpenRouter 数据显示 K3 系列每天生成 token 最高达 3000 亿。但收入规模仍远小于 OpenAI 的 400 亿与 Anthropic 的 650 亿美元。
国内新闻
5. 百度秒哒再升级:不懂代码的人开始亲手搭企业系统
百度无代码平台秒哒完成升级,从一句话生成应用走向嵌入企业核心业务系统。量子位报道两家几乎无技术人力的中小企业案例:近 30 人服装品牌搭起商品企划、供应链跟单、付款与库存全链路;新材料企业做出办公系统并接入企业微信,供数百员工处理项目、差旅审批与邮件,搭建者是零编程经验的创始人与业务团队。
二、AI大神

Box CEO Aaron Levie
1. 走访数十家企业:agent落地七大现实议题
Levie与银行、媒体、保险等数十位技术负责人交流后总结,企业agent的头号焦虑是网络安全,多数公司并行部署多个前沿模型难以标准化,真正回报来自流程再造而非把agent塞进旧流程,eval仍处极早期且是最大机会。
Meta AI总监Madhu Guru
2. 做eval要衡量步骤,而非只看结果
Madhu Guru提出做eval的第十条原则:衡量步骤而不只是结果。两条agent轨迹可能给出同一答案,但工具调用次数、来源正确性与纠错路径高下立判,因此应定义workflow每一步并单独度量,看eval先看步骤再看结果。
OpenAI Codex负责人Thibault Sottiaux
3. OpenAI暂停200美元Pro订阅保体验
Thibault Sottiaux宣布,为确保现有用户持续获得Astra访问权,OpenAI暂停200美元Pro档订阅,因该档对系统压力最大,这是维持最广泛访问的最小一步,其他档位与API仍可用,显示头部agent产品推理容量仍是最大瓶颈。
Anthropic工程师TQ
4. 一段提示让Claude采访你并写入记忆
Anthropic工程师TQ分享实用提示:让Claude用自由文本深入采访你,必要时改用AskUserQuestion工具,覆盖它还不知道的与你生活相关的关键信息,并全部保存到记忆里,一轮对话即可补齐个人上下文,之后每次对话都能用上。
OpenClaw作者Peter Steinberger
5. 写代码时代,复制不痛苦,抽象才痛苦
Peter Steinberger评论代码设计观点称,如今复制逻辑已不再痛苦,真正痛苦的是抽象。在coding agent让代码生成与重复实现极廉价的时代,过去为消除重复付出的抽象代价开始不划算,架构决策重心正从避免重复转向控制抽象复杂度。
三、AI研究

[Arxiv]
1. 心智拓扑:基础模型能在拓扑空间里推理吗?
论文提出 MindTopo——首个锚定认知科学与形式拓扑的拓扑直觉基准,覆盖连续性、分离性、有序性、包围关系与纽结五大属性,每项分推理与规划两层,含13类程序化任务、11,030个实例,评测14个多模态大模型。结果显示所有 MLLM 推理均优于规划,最佳模型仍远低于人类;在 Qwen3-VL-2B 上监督微调与强化学习对推理提升大于规划。
四、Agent工具
⭐ 12,356 stars/周
1. mattpocock/skills — 把工程经验封装成技能
mattpocock/skills 是 TypeScript 教育者 Matt Pocock 公开的真实开发技能集,反对 vibe coding 与重型流程框架,技能文件小而可改、可组合,一条 Claude Code 插件命令即可安装。
⭐ 11,638 stars/周
2. DietrichGebert/ponytail — 让代理只写必要的代码
DietrichGebert/ponytail 给编码 agent 装上「最懒的资深开发」人格,动手前先爬七级阶梯:真需要存在吗、代码库已有、标准库、平台原生能力、已装依赖、能否一行,最后才是最小实现。
⭐ 6,051 stars/周
3. bilawalsidhu/gods-eye-view — 语音代理操控实时地球
bilawalsidhu/gods-eye-view 是浏览器里的卫星模拟器,实时航班、船舶、卫星轨道、地震、交通与公共摄像头汇入 CesiumJS 与 Google 真实感 3D 瓦片地球,可锁定目标、进入真飞行器驾驶舱视角、跟 ISS 过境。