← 返回 AIVIZENS 首页

概览

6 分钟阅读

OpenAI 年内不上市,Altman 称时点不明智

安全叙事正从公关话术变成资本节奏的变量:Altman 以安全为由推迟 IPO,Anthropic 内部却把「10% 灭绝概率」摆上台面。与此同时,Agent 的可靠性短板在长跑场景暴露,具身与视频生成则把竞争推向规模化落地。

今日 AI 简报
  • 🚀 OpenAI 年内不上市,Altman 称时点不明智
  • 🧠 长跑 Agent 会悄悄丢掉合规规则
  • 🤖 LightNav-0 一个模型通吃四种机器人

今日精选

一、今日AI

AI 圈末日警告大辩论:离职研究员与招股书

海外新闻

1. OpenAI 年内不上市:Altman 直言时点不明智

OpenAI 已保密递交上市申请,但 CEO Sam Altman 明确今年不会 IPO,称「考虑到安全方面正在发生的一切,现在是不明智的时点」,并否认 2026 年可能,称「还有很多事要做」。此前《纽约时报》报道其原目标 2026 年三或四季度上市,因科技股波动与财务压力倾向 2027 年。

阅读原文

海外新闻

2. 长跑 Agent 会悄悄丢掉合规规则,扩上下文也没用

VentureBeat 报道,企业长跑型 AI Agent 会在运行数天后悄悄「忘掉」系统提示中的合规规则:不崩溃、不告警,仍产出违规结果,数周后审计才暴露,常回溯到第 9 天规则被挤出活跃记忆。

阅读原文

海外新闻

3. AI 圈末日警告大辩论:离职研究员与招股书

TechCrunch 报道,AI 行业正经历迄今最激烈的「末日论」交锋。导火索是研究员 Jacob Coxon 从 Anthropic 离职,称头部公司正「拿所有人的生命赌博、直奔自我改进的超级智能」;Anthropic 对齐负责人转发并称「我们确实真心认为 AI 可能杀死全人类」,个人判断是「未来…

阅读原文

国内新闻

4. LightNav-0:一个导航模型通吃四种机器人本体

亮源新创发布通用导航模型 LightNav-0:基于 Real2Sim2Real 数据引擎,把 2,000 多个互联网真实场景转为可复用仿真环境,生成 4,000 多小时视觉、语言与动作经验用于通用导航后训练;同一模型可零样本迁移到四种不同机器人本体,无需逐硬件适配。

阅读原文

国内新闻

5. MiniMax H3 开源加速 12 倍:5 秒视频 29 秒出片

RunningHub 开源 MiniMax H3 多卡加速方案(GitHub 项目 MiniMax-H3-MultiGPU-Lightning)

阅读原文

二、AI大神

Anthropic Claude Code成员Thariq: 2018年的我见到今天的Claude Code会认为是AGI, 但我们需要时间加固系统

OpenAI CEO Sam Altman

1. Altman认同减速并引入独立评估者

Altman公开支持Dario Amodei的减速主张,承诺让独立第三方评估者获得员工级权限,深入查看研发与安全细节,标志着头部实验室开始接受外部常态化审计。

阅读原文

Box CEO Aaron Levie

2. AI行业自律难免但博弈论难题待解

Levie认为前沿AI行业自律几乎不可避免,但难点在于各方难以就监管内容达成一致,且任何减速都依赖各国共同参与,在风险不够严峻前几乎不可能,未来会很混乱。

阅读原文

Anthropic Claude Code成员Thariq

3. Claude Code如AGI但需时间加固系统

Thariq感叹今天的Claude Code若给2018年的他会被认为是AGI,但变化速度已出现裂缝,他呼吁留出时间加固系统,让社会讨论技术如何被使用与部署。

阅读原文

Vercel CEO Guillermo Rauch

4. 用agent编排不同模型与推理档位

Rauch展示让一个agent编排模型与推理档位各异的子agent,如Fable规划、Grok执行,配置简单且适用于任何模型与网关,靠模型自身智能与编排能力。

阅读原文

AI教程作者Peter Yang

5. 用AI生成一半美术现在就能做星际3

Peter Yang建议用AI生成一半美术资产、人类只做把关,就能更快做出质量在线的游戏,甚至构想一人宏观指挥、队友微观操作的玩法,并调侃ASI会比星际争霸先问世。

阅读原文

工具学习

三、AI研究

记忆增强的优化智能体:在连续自然语言需求中持续演进

[Arxiv]

1. 记忆增强的优化智能体:在连续自然语言需求中持续演进

针对真实运营中需求持续变化、孤立请求式 LLM 优化难以复用既有决策的问题,论文提出 MAPLE:将语言建模与数学规划、进化搜索结合,在多次自然语言请求间保留优化程序、已接受方案与候选解。作者同时发布 NLDO 基准,含 15 条轨迹、180 次更新,覆盖选择、调度、排班、路由与云资源放置。

阅读论文

四、Agent工具

⭐ 2,501 stars/周

1. spec-kit — 规范先行的 AI 编码流程

spec-kit 是 GitHub 官方开源的规范驱动开发(SDD)工具包,已发布 1.0.0。安装 specify CLI 后,可在 Copilot、Claude Code、Codex 等任意 AI 编码代理中按 constitution、specify、plan、tasks、implement…

查看仓库

⭐ 1,380 stars/周

2. Humanlayer/skills — 构建迭代式智能体循环

Humanlayer/skills 是 HumanLayer 开源的 Claude Code 技能集,一条 npx skills add 命令即可安装,目前含 improve-claude-md、build-iterated-agentic-loop、design-control-loop 等 5…

查看仓库

⭐ 1,168 stars/周

3. Tencent/WeKnora — 文档转可推理知识平台

WeKnora 是腾讯开源的 LLM 知识平台(v0.8.0),把散落文档变成可查询知识库、可自主推理的代理与自维护 Wiki,支持 RAG 问答和 ReAct 代理编排检索、MCP 工具、技能沙箱与联网搜索。

查看仓库