← 返回 AIVIZENS 首页
6 分钟阅读

OpenAI自研芯片Jalapeño曝光,推理成本大降

OpenAI自研推理芯片Jalapeño曝光,直指算力成本与英伟达依赖;Anthropic为Claude Cowork补上记忆短板,企业AI助手竞争加剧;Perplexity联手英伟达推本地AI计算机,零token成本或重塑算力格局。三动向共同指向:AI正从云端走向端侧,从单次问答走向持续协作。

  • 🔥 OpenAI自研芯片Jalapeño曝光
  • 🧠 Claude Cowork上线跨会话记忆
  • 💻 Perplexity推本地AI计算机

今日AI

海外大模型公司 · 最有价值

OpenAI自研Jalapeño芯片亮相,专为大规模推理打造

OpenAI自研推理芯片Jalapeño基准测试曝光,专为大规模快速推理设计,旨在降低对英伟达GPU依赖、削减推理成本。测试显示其批量推理吞吐量突出,能以更低成本支撑ChatGPT等产品需求。分析认为,该芯片将成为OpenAI控制算力成本、提升毛利的关键,但官方尚未公布规格与量产时间表。

阅读原文

海外大模型公司 · 最有价值

Claude Cowork终于能记住聊天内容,跨会话记忆上线

Anthropic旗下Claude Cowork推出记忆功能,用户对话信息将被记住并在后续交互中自动调用,解决换会话失忆痛点。该功能支持团队协作中持续记住项目背景与偏好,减少重复说明,被视为Anthropic在企业AI赛道的重要补强,标志AI Agent向持续记忆型演进。用户可查看并管理被记忆内容。

阅读原文

海外 · 最吸引眼球

Perplexity联手英伟达发布本地AI计算机,零token成本

Perplexity与英伟达合作推出Portable Computer,一款完全本地运行的AI Agent设备,模型、文件与计算任务均留存在设备上,本地工作零token成本。任务默认本地启动,仅在需要更强算力时请求用户许可,将部分步骤发送云端。

阅读原文

AI大神

Peter Yang:用 AI 语音拨打客服电话,自动过流程、约人工,怎么实现?

Box CEO Aaron Levie

AI Agent时代,系统记录比以往更重要

Aaron Levie指出,当AI Agent完成的工作量远超人类时,系统记录(Systems of Record)的重要性空前提升,治理、可靠性、安全等成为关键,软件行业面临巨大机遇与颠覆。

阅读原文

Box CEO Aaron Levie

零数据留存是AI增长被低估的引擎

Levie认为,ZDR(零数据留存)极大简化了企业处理子处理器数据的合规流程,若行业不转向这一方向,AI的扩散将陷入停滞,因此它是AI增长的关键推动力。

阅读原文

Peter Yang

用AI语音拨打客服电话,自动过流程

Peter Yang提出用AI语音导航自动语音系统并转接真人的想法,反映IVR电话树的普遍痛点,结合实时语音模型,这一场景正成为可落地的自动化机会。

阅读原文

YC CEO Garry Tan

五步实验循环,形成观点到迭代

Garry Tan给出五步循环:形成观点、变成制品、接触现实、读取结果、修正再跑,强调以现实反馈代替自我欺骗,是创业者快速逼近真相的核心方法。

阅读原文

Replit CEO Amjad Masad

Replit Agent已完全取代Claude CoWork

Amjad Masad确认Replit Agent因更持久、细致且善于利用代码和软件高效完成任务,已完全取代Claude CoWork成为日常工具,体现AI编程代理赛道的快速演进。

阅读原文

AI研究

ReWorld:具备长程记忆的交互式世界模型

[Arxiv]

ReWorld:具备长程记忆的交互式世界模型

ReWorld是港科大(广州)与阿里提出的交互式世界模型,通过混合逐头注意力窗口分离控制与记忆,推理时用有界KV缓存和位姿索引地标库将记忆固定预算。多数头关注近期窗口,少数全局头随机路由处理完整历史,随机分块丢弃使稀疏历史分布内化。统一8类数据源到同一动作尺度。在三轴评测中优于6个近期模型,旋转误差11.95度,64秒往返仍能重建起点,为实时流式可记忆世界模型铺路。

阅读论文

AI工程

把“做完”的标准写成清单,交给机器验收

把“做完”的标准写成清单,交给机器验收

问题

:让 AI 做网站,它说“做完了”,你却发现购物车点不动、支付没接通——因为从没告诉它“做完”长什么样。就像请人装修没给验收标准,工人觉得墙刷了就算完,可插座不通电。没有明确标准,双方对“做完”的理解永远对不上。

方法

:办法是把“做完”写成一份功能清单,每项写清三件事:做什么、怎么验证、当前进度。清单由机器验收,AI 不能自说自话宣布完成,只能提交验证,机器跑测试通过才算数。就像考试由机器判卷,学生不能自报满分。

启示

:布置任务别只说“加个购物车”,要说清“用户能走通下单支付”,并给出可验证标准。案例显示:用结构化清单,完成率高出 45%,新接手的人 3 分钟看懂进度,而不是花 20 分钟猜、还把做过的重做一遍。

Agent工具

⭐ 10,571 stars/周

openai/codex — 本地终端AI编码智能体

Codex CLI 是 OpenAI 推出的本地终端 AI 编码智能体,支持全平台安装,登录 ChatGPT 账户即可使用,也可集成 VS Code、Cursor 等 IDE。

查看仓库

⭐ 2,285 stars/周

modular/modular — AI开发部署统一平台

Modular Platform 是统一 AI 开发与部署的开源平台,包含 MAX 框架与 Mojo 语言,Mojo 作为 Python 的高性能超集,提供极致性能。

查看仓库

昨日焦点

Writer发布AI Harness框架:Token消耗直降40%,企业AI成本迎来结构性优化