← 返回 AIVIZENS 首页
5 分钟阅读

OpenAI 首席科学家呼吁为前沿 AI 设安全门槛

前沿模型能力狂飙,安全治理与产业落地正被同时推上桌面。OpenAI 首席科学家呼吁设安全门槛,国内最高法首部 AI 裁判规则落地,监管与创新开始正面交锋。

  • 🛡️ OpenAI 首席科学家呼吁设 AI 安全门槛
  • 🌀 多家 AI 公司密集更新,企业选型疲劳
  • ⚖️ 最高法发布首部涉 AI 纠纷裁判规则

一、今日AI

海外新闻

1. OpenAI 首席科学家呼吁为前沿 AI 设安全门槛

OpenAI 首席科学家 Jakub Pachocki 撰文警告机器智能快速提升的风险,主张加强模型对齐、监控与独立安全评估,并在无法满足安全条件时协调放缓开发。此举延续 OpenAI 对前沿 AI 治理的主动表态,也呼应全球监管对安全门槛的呼声。

阅读原文

海外新闻

2. 多家 AI 公司密集更新模型,企业面临选型疲劳

CNBC 梳理 Anthropic、OpenAI、Meta 和 Google 的密集更新,指出企业用户需持续比较能力、成本与安全风险。模型迭代速度本身已成为采购和治理难题,选型疲劳正从开发者蔓延至企业决策层。

阅读原文

海外新闻

3. 黄仁勋称“AGI 已经到来”,引发定义争议

NVIDIA CEO 黄仁勋公开称“AGI 已经到来”,以最新模型和大规模 GPU 训练为依据。此番言论引发外界对通用人工智能定义、能力边界及硬件叙事的讨论,凸显行业对 AGI 标准仍无共识。

阅读原文

国内新闻

4. 最高法发布首部涉 AI 纠纷司法裁判规则

最高人民法院发布首部涉 AI 纠纷司法裁判规则,共 5 部分、24 条,覆盖 AI 换脸拟声、AI 幻觉侵权、网络开盒、大数据杀熟、自动驾驶和模型训练等问题。为 AI 应用划定法律边界,对国内产业合规影响深远。

阅读原文

国内新闻

5. 华为发布新一代三折叠旗舰与麒麟芯片

华为发布新一代三折叠旗舰与麒麟 9050 Pro 芯片,并介绍 CPU、GPU、端侧模型与逻辑折叠技术方向。展示终端侧算力和系统协同路线,强化其在高端折叠屏与自研芯片上的竞争力。

阅读原文

二、AI大神

NVIDIA CEO 黄仁勋

1. NVIDIA 收购 Hugging Face 承诺保持开放

黄仁勋宣布 NVIDIA 同意收购 Hugging Face,并承诺平台继续支持多云、多加速器和各类开放模型,开发者无需使用 NVIDIA 算力也能继续构建和部署。

阅读原文

Anthropic 研究团队

2. Claude 用 Lean 形式化费马大定理

Anthropic 表示 Claude 借助多智能体协作和 Prove2Me 平台,约 11 天生成可由 Lean 检查的完整证明,形式化工具可降低数学验证负担,但不应替代面向人的解释。

阅读原文

Microsoft 首席负责任 AI 官 Natasha Crampton

3. 负责任 AI 不能是静态清单

Microsoft 首席负责任 AI 官 Natasha Crampton 表示,负责任 AI 需嵌入开发过程,并通过治理、评估和跨行业共享实践持续更新,才能跟上 Agent 等能力的快速变化。

阅读原文

Microsoft Rani Borkar

4. AI 基础设施要用有效产出来衡量

Rani Borkar 提出用“yield”视角衡量 AI 基础设施,不能只看投入规模或路线图,而应看实际产生了多少可用智能,以及这些产出是否转化为现实价值。

阅读原文

Frederick AI Luka Gamulin

5. Agent 正从调用工具走向构建环境

Luka Gamulin 认为 Agent 的变化不仅是回答问题,还包括为任务创建小工具、搭建隔离环境并持续运行工作流,真正落地仍需权限边界、沙箱和可审计记录。

阅读原文

三、AI研究

[Anthropic]

1. 用 Lean 形式化费马大定理

该研究针对复杂数学证明依赖少数专家人工核验、成本高且易漏缺口的问题,让 Claude 通过多智能体协作与 Prove2Me 图结构组织子定理,在约 11 天内生成完整证明并由 Lean 逐步检查通过。这表明自动形式化能降低同行评审负担并辅助发现错误,但仍应保留面向人类读者的可理解证明。

阅读论文

四、Agent工具

1. browser-use/browser-use — 让 Agent 操作浏览器完成网页任务

browser-use 让 Agent 直接操作浏览器完成网页任务,把页面转化为可执行的点击、输入等动作,适合网页采集、表单填写和后台重复操作。亮点是打通了从理解页面到执行动作的闭环,能显著减少人工操作;但登录态、反爬机制和页面结构变化都会影响稳定性,试用时需重点验证。

查看仓库

2. OpenHands/OpenHands — 在隔离环境中执行软件开发任务

OpenHands 在隔离环境中执行软件开发任务,能读取仓库、运行命令、调试并产出代码变更,适合修复缺陷、实现小需求和批量代码改造。亮点是端到端自动化开发流程,把编码交给 Agent 在沙箱内完成;使用前需准备模型凭据,并设置可靠的沙箱权限边界以控制风险。

查看仓库

3. crewAIInc/crewAI — 用角色和任务编排多智能体协作

crewAI 用角色和任务抽象来编排多智能体协作,让多个 Agent 按分工共同完成复杂工作,适合调研、写作、审核等多角色流水线。亮点是抽象直观、上手快,能快速搭起协作流程;但升级时容易破坏任务与输出结构,建议锁定版本并持续验证。

查看仓库