OpenAI 首席科学家呼吁为前沿 AI 设安全门槛
前沿模型能力狂飙,安全治理与产业落地正被同时推上桌面。OpenAI 首席科学家呼吁设安全门槛,国内最高法首部 AI 裁判规则落地,监管与创新开始正面交锋。
- 🛡️ OpenAI 首席科学家呼吁设 AI 安全门槛
- 🌀 多家 AI 公司密集更新,企业选型疲劳
- ⚖️ 最高法发布首部涉 AI 纠纷裁判规则
一、今日AI
海外新闻
1. OpenAI 首席科学家呼吁为前沿 AI 设安全门槛
OpenAI 首席科学家 Jakub Pachocki 撰文警告机器智能快速提升的风险,主张加强模型对齐、监控与独立安全评估,并在无法满足安全条件时协调放缓开发。此举延续 OpenAI 对前沿 AI 治理的主动表态,也呼应全球监管对安全门槛的呼声。
海外新闻
2. 多家 AI 公司密集更新模型,企业面临选型疲劳
CNBC 梳理 Anthropic、OpenAI、Meta 和 Google 的密集更新,指出企业用户需持续比较能力、成本与安全风险。模型迭代速度本身已成为采购和治理难题,选型疲劳正从开发者蔓延至企业决策层。
海外新闻
3. 黄仁勋称“AGI 已经到来”,引发定义争议
NVIDIA CEO 黄仁勋公开称“AGI 已经到来”,以最新模型和大规模 GPU 训练为依据。此番言论引发外界对通用人工智能定义、能力边界及硬件叙事的讨论,凸显行业对 AGI 标准仍无共识。
国内新闻
4. 最高法发布首部涉 AI 纠纷司法裁判规则
最高人民法院发布首部涉 AI 纠纷司法裁判规则,共 5 部分、24 条,覆盖 AI 换脸拟声、AI 幻觉侵权、网络开盒、大数据杀熟、自动驾驶和模型训练等问题。为 AI 应用划定法律边界,对国内产业合规影响深远。
国内新闻
5. 华为发布新一代三折叠旗舰与麒麟芯片
华为发布新一代三折叠旗舰与麒麟 9050 Pro 芯片,并介绍 CPU、GPU、端侧模型与逻辑折叠技术方向。展示终端侧算力和系统协同路线,强化其在高端折叠屏与自研芯片上的竞争力。
二、AI大神
NVIDIA CEO 黄仁勋
1. NVIDIA 收购 Hugging Face 承诺保持开放
黄仁勋宣布 NVIDIA 同意收购 Hugging Face,并承诺平台继续支持多云、多加速器和各类开放模型,开发者无需使用 NVIDIA 算力也能继续构建和部署。
Anthropic 研究团队
2. Claude 用 Lean 形式化费马大定理
Anthropic 表示 Claude 借助多智能体协作和 Prove2Me 平台,约 11 天生成可由 Lean 检查的完整证明,形式化工具可降低数学验证负担,但不应替代面向人的解释。
Microsoft 首席负责任 AI 官 Natasha Crampton
3. 负责任 AI 不能是静态清单
Microsoft 首席负责任 AI 官 Natasha Crampton 表示,负责任 AI 需嵌入开发过程,并通过治理、评估和跨行业共享实践持续更新,才能跟上 Agent 等能力的快速变化。
Microsoft Rani Borkar
4. AI 基础设施要用有效产出来衡量
Rani Borkar 提出用“yield”视角衡量 AI 基础设施,不能只看投入规模或路线图,而应看实际产生了多少可用智能,以及这些产出是否转化为现实价值。
Frederick AI Luka Gamulin
5. Agent 正从调用工具走向构建环境
Luka Gamulin 认为 Agent 的变化不仅是回答问题,还包括为任务创建小工具、搭建隔离环境并持续运行工作流,真正落地仍需权限边界、沙箱和可审计记录。
三、AI研究
[Anthropic]
1. 用 Lean 形式化费马大定理
该研究针对复杂数学证明依赖少数专家人工核验、成本高且易漏缺口的问题,让 Claude 通过多智能体协作与 Prove2Me 图结构组织子定理,在约 11 天内生成完整证明并由 Lean 逐步检查通过。这表明自动形式化能降低同行评审负担并辅助发现错误,但仍应保留面向人类读者的可理解证明。
四、Agent工具
1. browser-use/browser-use — 让 Agent 操作浏览器完成网页任务
browser-use 让 Agent 直接操作浏览器完成网页任务,把页面转化为可执行的点击、输入等动作,适合网页采集、表单填写和后台重复操作。亮点是打通了从理解页面到执行动作的闭环,能显著减少人工操作;但登录态、反爬机制和页面结构变化都会影响稳定性,试用时需重点验证。
2. OpenHands/OpenHands — 在隔离环境中执行软件开发任务
OpenHands 在隔离环境中执行软件开发任务,能读取仓库、运行命令、调试并产出代码变更,适合修复缺陷、实现小需求和批量代码改造。亮点是端到端自动化开发流程,把编码交给 Agent 在沙箱内完成;使用前需准备模型凭据,并设置可靠的沙箱权限边界以控制风险。
3. crewAIInc/crewAI — 用角色和任务编排多智能体协作
crewAI 用角色和任务抽象来编排多智能体协作,让多个 Agent 按分工共同完成复杂工作,适合调研、写作、审核等多角色流水线。亮点是抽象直观、上手快,能快速搭起协作流程;但升级时容易破坏任务与输出结构,建议锁定版本并持续验证。