← 返回 AIVIZENS 首页
6 分钟阅读

李飞飞Atlas:一张照片重建3D世界

从李飞飞的Atlas到Anthropic的Fable 5.1,再到YC最快独角兽,AI正从文本生成迈向世界模拟与垂直落地。Atlas重新定义空间智能,Fable 5.1以性价比碾压基准,AfterQuery则验证了数据问答的商业爆发力。

  • 📸 一张照片生成3D世界
  • 🏆 Claude新模型八项第一
  • 🚀 YC最快独角兽估值32亿

今日AI

李飞飞团队发布Atlas:一张照片重建3D世界

海外大模型公司 · 最有价值

1. 李飞飞团队发布Atlas:一张照片重建3D世界

李飞飞World Labs发布Atlas,号称全球首个多模态世界模型,可输入文本、图像、视频、3D数据,仅凭一张照片生成1分钟1440p可交互视频,支持像素级相机控制与3D重建,效果超SOTA。还能缝合无关图片,为机器人生成训练数据,Jim Fan赞为机器人领域一大步。已开放早期访问。

阅读原文

海外大模型公司 · 最有价值

2. Anthropic发布Fable 5.1:8项基准全第一

Anthropic发布Claude Fable 5.1与Mythos 5.1,Fable 5.1在8项基准全第一,中低推理档媲美老版Mythos 5极高推理。缓存读取价降75%,成本降25%,安全误报率降60%。Mythos 5.1在蛋白设计与金星地形图任务表现惊艳,并引入反蒸馏机制。

阅读原文

海外 · 最吸引眼球

3. YC史上最快独角兽AfterQuery:估值32亿美元

AI数据分析公司AfterQuery据传以32亿美元估值融资,成YC史上最快独角兽。其主打自然语言数据查询,被视为AI+数据赛道标杆,印证2026年资本对AI原生数据分析的热情。官方未回应传闻。

阅读原文

AI大神

Vercel CEO Guillermo Rauch:Fluid统一所有计算产品,未来单一全球平台

Claude Code Boris Cherny

1. Fable 5.1降价缓存读取降至1/4

Anthropic的Claude Code负责人Boris Cherny公布Fable 5.1更新,写作质量提升且AI腔减少,安全护栏更精准,对良性生物问题的干预减少85%,每个会话网络干预减少约60%。

阅读原文

Box CEO Aaron Levie

2. AI攻防垂直化,安全行业迎黄金时代

Box CEO Aaron Levie判断AI网络攻防将垂直化,模型在发现和利用漏洞上越来越强,企业被安全告警淹没且告警将成倍增长,用更多AI加人工监督做漏洞分诊与自动化修复是唯一出路,安全行业将迎来黄金时代。

阅读原文

OpenAI产品Nan Yu

3. 让agent少烦人是巨大alpha,UX设计师新机会

将加入OpenAI产品团队的Nan Yu提出,让agent不那么烦人藏着巨大alpha,用户要抵达价值就得先停止怒而弃用。

阅读原文

Vercel CEO Guillermo Rauch

4. Fluid统一所有计算产品,未来单一全球平台

Vercel CEO Guillermo Rauch阐述Fluid的底层价值:支撑顶级Build性能、沙盒可靠性与海量并发,并统一Dockerfile、安全边界、网络与文件系统到所有计算产品,Build与Functions共享同一Secur…

阅读原文

AI博主Peter Yang

5. 技能要少而短,警惕AI修一次技能漂一次

AI教程博主Peter Yang分享个人实践:不喜欢装一堆随机技能,只保留约十几个且多为自研,定期删除不用的,并尽量把每个技能写得简短。

阅读原文

AI研究

多日自主软件开发的持续改进框架

[Arxiv]

1. 多日自主软件开发的持续改进框架

本研究提出Harness-of-Harness(HoH)元框架,运行于Codex+GPT-5.5等编码harness之上,通过迭代的规划-编码-测试循环,使LLM智能体在无人工干预下多日自主开发完整软件。HoH平衡修复与能力增长,拆分可验证增量,分离测试与评估,渐进暴露工具并维护版本历史。在GameCraft-Bench等基准上三轮迭代平均提升52.25%,最高82.86%。

阅读论文

AI工程

让 agent 关掉再打开还能接着干

让 agent 关掉再打开还能接着干

1. AI 干活像新来的实习生
做到一半对话一关,它就忘了进度和思路

做到一半对话一关,它就忘了进度和思路。真正的考验不是能否接手,而是关掉重开后还能不能把活接着干完、干对——这需要专门训练,不能靠运气。

2. 管理秘诀是「功能清单 + 证据」
每个功能写进清单,一次只做一件事,做完必须附上能跑通的证据(

每个功能写进清单,一次只做一件事,做完必须附上能跑通的证据(测试结果、运行截图)才能算数;收工时还要写交接笔记,让下次开工知道进行到哪一步。

3. 对比实验最有说服力
同样任务,没约束时 AI 常「宣称完成」却没通过验证;有清单

同样任务,没约束时 AI 常「宣称完成」却没通过验证;有清单和证据把关时,每个功能都留下从失败到通过的完整记录。启示:布置任务写清验收标准,比多叮嘱十句更管用。

Agent工具

⭐ 12,042 stars/周

1. BilawalSidhu/Gods-Eye-View — 实时卫星视角 AI 语音操控台

Gods-Eye-View 是一款浏览器内的实时卫星视角 AI 语音操控台,基于 CesiumJS 构建写实 3D 地球,展示民航、船舶、卫星等公开空间信号,无需密钥即可运行。

查看仓库

⭐ 10,669 stars/周

2. Freestylefly/Awesome-Gpt-Image-2 — 工业级 GPT-Image2 提示词引擎

Awesome-Gpt-Image-2 是工业级 GPT-Image2 提示词引擎,主打 Prompt as Code 理念,逆向 530+ 案例沉淀 20+ 套模板,将散文式提示词压缩为结构化协议,实现稳定可控的图像生成。

查看仓库

⭐ 5,232 stars/周

3. Calesthio/OpenMontage — 开源 Agent 驱动视频工厂

OpenMontage 是首个开源 Agent 驱动视频工厂,采用 Agent-first 架构,AI 编程助手担任总导演,从研究到成片全流程自动推进,含 11 条预置流水线。

查看仓库

昨日焦点

OpenAI Astra 即将上线,能自主攻入计算机系统