每日 5 分钟
学会 AI

获取最新 AI 资讯,了解为什么重要,学习如何应用到工作中。

免费 · 一键退订 · 我们尊重你的隐私

已有 100,000+ 读者,来自这些公司:

字节跳动
阿里巴巴
腾讯
DeepSeek
小米
华为

最新文章

每日精选,覆盖模型、工具、趋势、监管全景

模型

OpenAI 发布 GPT-6:推理时长可控,Agent 模式默认开启

GPT-6 引入 thinking budget 参数,开发者可显式限制单次推理最长思考时间;同时 Agents API 从 preview 转为 GA,工具调用并发上限提高到 32。

模型

Anthropic Claude Fable 5 中文版评测:长文本能力接近母语水平

第三方 CLUE 基准显示,Claude Fable 5 在中文长文本理解、代码生成、数学推理上超过前代 20%,Anthropic 官方称其为「首个真正 bilingual 的旗舰」。

模型

DeepSeek R2 开源:MoE 架构 + 671B 总参数,推理成本再降 40%

DeepSeek 在 GitHub 发布 R2 权重(MIT License),采用改进版 MoE + shared expert 设计,每 token 激活 37B 参数。第三方复现显示 API 成本可压到 GPT-6 的 1/8。

工具

Cursor 3.0 引入常驻 Agent:每晚自动 refactor,早上给你留 PR

新版 Cursor 支持后台常驻的 refactor agent,会在开发者下班后扫描代码库,把重复代码、命名不一致、type-any 修好,早上 review 一批 PR 即可。付费用户已开放。

研究

Meta 发布 LLaVA-Video-70B:单模型统一视频理解、生成、编辑

Meta 开源了首个视频三合一模型 LLaVA-Video,可在同一模型里完成视频问答、文本生成视频(720p, 20s)、视频局部编辑。权重、训练数据、评估集全公开。

监管

国家网信办发布《生成式 AI 服务管理办法(2026 修订)》

新版办法引入分级备案制:面向消费者的通用大模型(To C)走完整备案,垂直行业(企业内部)只需承诺制。开源模型免除备案义务但需在项目页显著标注训练数据来源。