← 返回 AIVIZENS 首页
8 分钟阅读

英伟达营收暴涨106%,AI拐点已至

英伟达财报印证AI算力需求爆发,Meta小模型经强化学习追平大模型,Anthropic则让智能体自主上网。三者共同指向:AI正从对话走向行动,效率与成本成为关键。

  • 🚀 英伟达营收暴涨106%
  • 🤖 Claude Cowork 内置浏览器
  • 🧠 Meta 8B 小模型匹敌大模型

今日AI

Meta 8B 小模型经强化学习匹敌 Claude Opus 4.5

海外大模型公司 · 最有价值 Claude Cowork 内置浏览器上线,可自主上网查资料 Anthropic 为 Claude Cowork 加入了内置浏览器能力。当任务需要联网搜索时,Claude 现在可以在聊天界面的侧边面板直接打开自己的网页浏览器,自主导航网页、查找所需信息,而用户可以在旁边实时监督它的操作过程。这一功能将在未来一周内向付费版的桌面应用逐步推送。此举进一步强化了 Claude Cowork 作为智能体助手的定位,让 AI 不仅能读写代码、操作工具,还能像人一样上网检索、完成端到端任务,减少用户来回切换窗口的摩擦。 来源:Anthropic · 阅读原文

1. Claude Cowork 内置浏览器上线,可自主上网查资料

Anthropic为Claude Cowork加入内置浏览器,可自主导航网页查资料,用户实时监督。功能一周内向付费桌面应用推送,强化智能体定位,减少窗口切换摩擦。

阅读原文

海外大模型公司 · 最有价值 Meta 8B 小模型经强化学习匹敌 Claude Opus 4.5 Meta AI 与伊利诺伊大学香槟分校的研究者推出 EvoHarness-RL 框架,把智能体对外部执行环境(harness)的使用从「硬编码规则」变成「可训练的行为」。研究团队以 Qwen3-8B 为底座,在 ALFWorld 多步任务基准上取得了 96.9% 的平均成功率,相较 ReAct 基线提升 49 个百分点,并超越 SkillRL(89.9%)、SkillOS(80.2%)等可训练框架。最关键的是,这个 8B 小模型的有效性能几乎追平了开箱即用的 Claude Opus 4.5(96.4%),而成本远低于前沿闭源模型,为企业在长程智能体任务中「用小模型省钱」提供了新路径。 来源:VentureBeat · 阅读原文

2. Meta 8B 小模型经强化学习匹敌 Claude Opus 4.5

Meta与UIUC推出EvoHarness-RL框架,将外部环境使用变为可训练行为。Qwen3-8B在ALFWorld达96.9%成功率,超ReAct 49个百分点,几乎追平Claude Opus 4.5,成本更低。

阅读原文

海外 · 最吸引眼球 英伟达单季营收 962 亿美元,同比暴涨 106% 英伟达公布 2026 财年第二季度财报:营收 962 亿美元,同比暴增 106%、环比增长 18%;数据中心业务营收 890 亿美元,同比增长 117%;净利润 597 亿美元。公司还给出 Q3 营收 1080 亿美元的指引。CEO 黄仁勋称「AI 已到达拐点」,并透露 Vera Rubin 平台已全面量产。财报公布后英伟达单日市值增幅一度创下全球上市公司历史第二,带动整个 AI 相关板块大涨。 来源:NVIDIA Newsroom · 阅读原文

3. 英伟达单季营收 962 亿美元,同比暴涨 106%

英伟达Q2营收962亿美元,同比增106%,数据中心营收890亿,净利597亿。Q3指引1080亿,Vera Rubin已量产,市值增幅创历史第二。

阅读原文

AI大神

Peter Steinberger 灵魂发问:也许这真的是个泡沫

Anthropic 工程团队

1. AI Agent 破坏半径需环境隔离

Anthropic 发现用户会批准约93%的权限弹窗,人工监督因审批疲劳失效,因此转向环境级隔离与自动模式降低风险,并披露 Claude Mythos Preview 因爆炸半径过高未发布。

阅读原文

Matt Turck

2. 英伟达或是全球最好风投

FirstMark 合伙人 Matt Turck 认为英伟达可能是全球最好的风投,超幂律重塑格局,应用变实验室快于实验室变应用,并警示 AI 泡沫与久期错配风险。

阅读原文

OpenAI Codex 负责人 Thibault Sottiaux

3. OpenAI 几周抵别家几年

OpenAI Codex 与 ChatGPT 负责人 Thibault Sottiaux 称在 OpenAI 几周完成的工作量抵得上其他公司几年,节奏快得疯狂,引发广泛共鸣。

阅读原文

OpenAI Sam Altman

4. Sam Altman 推荐坏事件报告

OpenAI CEO Sam Altman 转发一份报告并评价为关于一件坏事的好报告,暗示其记录负面议题,作为行业领袖的背书迅速引发社区热议。

阅读原文

OpenClaw 创始人 Peter Steinberger

5. 也许这真的是个泡沫

OpenClaw 创始人 Peter Steinberger 转发内容并质疑 AI 估值与投入是否过热,呼应近期泡沫论,引发关于 AI 泡沫的讨论。

阅读原文

AI研究

WikiSkill:将智能体经验编译为持久知识以推动技能进化

[Arxiv]

1. WikiSkill:将智能体经验编译为持久知识以推动技能进化

Google团队提出WikiSkill框架,让智能体技能与持久知识库协同演化,将工作区分为原始、知识、技能三层。每轮迭代由推理智能体、Wiki维护者、技能提出者与门控回滚机制驱动,持续固化经验。在5个基准与5个模型上,WikiSkill一致超越现有方法;Qwen家族中4B/9B/27B模型性能分别提升12.3%/17.5%/23.9%,增益随规模递增,带技能的9B可反超不带技能的27B。

阅读论文

AI工程

给 AI 装一扇窗,看清它每一步怎么干活

给 AI 装一扇窗,看清它每一步怎么干活

1. AI 干活像黑盒
忙了半天告诉你"做完了,但有两个测试没过",问它为什么,只会

忙了半天告诉你"做完了,但有两个测试没过",问它为什么,只会说"不太确定"。看不见过程,就分不清是真做对还是"看着像对",只能靠猜。

2. 装两层"窗户"
一层记录系统实际做了什么,另一层记录"为什么这个改动该被接受

一层记录系统实际做了什么,另一层记录"为什么这个改动该被接受"(计划、评分标准、验收条件)。实测加暗色模式,从盲试 45 分钟缩到 15 分钟,效率差 3 倍。

3. 验收别凭"感觉不对"
像老师改卷用评分标准,给每项工作定好可量化的通过条件,反馈要

像老师改卷用评分标准,给每项工作定好可量化的通过条件,反馈要带具体证据(如"按钮对比度不达标"),别含糊说"不好"。这样 AI 一次就能改对,不用反复瞎试。

Agent工具

⭐ 8,530 stars/周

1. tt-a1i/archify — 把代码库变成交互式架构图

Archify 是一个 Node.js 渲染与校验系统,面向 Cursor、Claude Code 等 Agent,将代码库或系统描述转化为交互式架构图。

查看仓库

⭐ 4,706 stars/周

2. MadsLorentzen/ai-job-search — Claude Code 驱动的求职助手

ai-job-search 是构建于 Claude Code 的 AI 求职助手,通过 /setup、/scrape、/apply 等命令自动化搜索职位、评估匹配度、定制简历与求职信。

查看仓库

⭐ 4,657 stars/周

3. Alishahryar1/free-claude-code — 免费运行多款编码 Agent

Free Claude Code (FCC) 聚合 50 个 ToS 友好提供方,每月提供 1.3B+ 免费 token,在统一 UI 下运行 10 款编码 Agent,如 Claude Code、Codex 等。

查看仓库

昨日焦点

Anthropic 发布模型硬件标准 MHS,让 AI 智能体安全操控物理设备