AI News 简报 · 2026-08-25
涵盖 AI精选 · 热点动态
🔥 AI精选
来源:AIHOT · 精选热点
| 日期 | 标题 | 来源 | 分类 |
|---|---|---|---|
| 08-24 | MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议 | Meta Engineering Blog(RSS) | ai-products |
| 08-24 | NVIDIA Vera Rubin NVL72 树立 AI 智能体效率新标准:每瓦特工作量提升至 30 倍 | NVIDIA Blog(RSS) | ai-products |
| 08-24 | OpenAI 正为一切构建 AI 智能体,但用户会愿意交出控制权吗? | TechCrunch:AI(RSS) | tip |
| 08-24 | GPT-5.6 登陆 Kiro,为开发者提升性价比 | OpenAI:官网动态(RSS · 排除企业/客户案例) | ai-models |
📡 热点动态
来源:AIHOT · 全量热点(近 1 天)
-
08-25 阿里云 Wan3.0 发布,视频生成质量飞跃 —
X:阿里云 / Alibaba Cloud (@alibaba_cloud)
阿里云发布 Wan3.0 视频生成模型,被评测者评价为”质量持续高水准,而非偶发”,相较 Wan2.7 堪称全新模型。该模型支持文生视频(T2V)、图生视频(I2V)和参考生视频(R2V),现已上线 fal 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。 -
08-25 OpenAI 称 DevDay 2026 将创历史最佳 —
X:Tibo (@thsottiaux)
OpenAI DevDay 2026 将是我们公司历史上最好的一届 DevDay。其他届将远远不及。 -
08-25 硅基流动GLM-5.2登顶OpenRouter份额 —
X:硅基流动 SiliconFlow (@SiliconFlowAI)
硅基流动在 @OpenRouter 上 GLM-5.2 的 token 份额排名第一。🚀 🔥 42.5% token 份额 ⚡ 91.8% 缓存命中率 🟢 100% 可用性 以高效、可靠的推理大规模驱动 GLM。敬请期待硅基流动上的 GLM-5.3。👀 -
08-25 老板电器新一代 AI 烹饪眼镜明年 3 月发布,搭载”食神”AI 烹饪大模型 —
IT之家(RSS)
老板电器新一代 AI 烹饪眼镜预计明年 3 月正式发布,将面向消费者销售。新品比前代约 89g 更轻盈,显示方案从全彩改为单色,充电方式改为换电方案,搭载”食神”AI 烹饪大模型,光波导光学模组由谷东智能提供。 -
08-25 Apodex 1.1 开源多 Agent 实测打脸暴富营销 —
X:阿易 AI Notes (@AYi_AInotes)
Apodex 1.1 开源 35B 权重多 Agent 架构及本地 harness FrontierAgent,支持单机部署。实测 8 个 Agent 并行跑 AI 副业任务,公开采样中满足 A 级证据的个人收入成功案例为 0,并推翻文案需求居首的断言,指出视频剪辑需求最多。交付含证据清单、验证优先级表等可落地文件,30 天为验证周期而非回本承诺。 -
08-25 微软 CEO 纳德拉示警:企业要掌控 Token 资本,使用 AI 不能押注单一模型 —
IT之家(RSS)
微软首席执行官萨蒂亚·纳德拉警告称,企业若依赖单一人工智能模型,可能把自身知识和思考能力”外包”给模型提供商,甚至失去独立生存能力。他认为企业会持续创造知识,这些知识应留在企业内部,而不应被绑定到某个模型或服务商,并提出了涵盖提示词上下文、员工与模型交互记录的”Token 资本”概念。纳德拉强调,任何模型都可能停止服务,企业必须掌控自身知识和发展方向。 -
08-25 美媒分析中国 AI 追赶速度:清华人才网络与开源技术是关键 —
IT之家(RSS)
《华尔街日报》报道称,中国 AI 模型与美国头部模型的差距已缩小至数月,背后是清华等高校长期形成的人才网络、开源技术、人才回流及更高算力效率共同推动。智谱 AI 唐杰、月之暗面杨植麟、DeepSeek 梁文锋等研究者构成重要力量。报道还指出,DeepSeek 通过 MLA 与 MoE 技术降低算力需求,但高端芯片数量仅为 OpenAI、谷歌同行的五分之一。 -
08-25 冻结主干只训投影层:新模态不损原能力 —
X:Rohan Paul (@rohanpaul_ai)
新研究提出”Projector Is All You Train”:为语言模型添加新模态只需训练连接编码器与主干的投影层,无需微调模型本身。3D 测试中,冻结主干的模型性能持平或超越联合微调,训练速度快一倍,而联合微调的 Llama 在 GSM8K 上从 86.96% 暴跌至 0.61%。 -
08-25 Arm 成立 36 年来首颗自研芯片:AGI CPU 细节披露,1000 亿晶体管、支持 6TB 内存 —
IT之家(RSS)
Arm 在 Hot Chips 2026 大会披露其首颗自研量产芯片 AGI CPU 细节。该处理器基于第 3 代 Neoverse V3 核心,采用台积电 3nm 双芯粒设计,共 1000 亿晶体管,最大 TDP 300W。芯片支持 DDR5-8800 内存,单颗容量达 6TB,内存延迟低于 100ns,并提供 96 条 PCIe Gen6 通道。 -
08-25 Apodex 1.1 发布:Agent Team 拆解复杂研究 —
X:karminski (@karminski3)
Apodex 1.1 模型家族发布,主打异步 Agent Team 功能,可并行协调多智能体拆解复杂任务并持续整合结果。同步开源 FrontierAgent 本地研究工具台及 Apodex 1.1 mini 开放权重模型,后者支持本地运行复杂工作。 -
08-25 通义千问回应:中国开源模型已成研究默认选择 —
X:通义千问 / Qwen (@Alibaba_Qwen)
一项基于50万篇arXiv论文的分析显示,约40%论文提及中国开源LLM,美国开源模型降至25-30%,中国模型已成研究默认选择。通义千问(Qwen)持续增长,如今提及任何LLM的论文中1/3提到Qwen;Llama在2025年4月达30%峰值后持续下滑。 -
08-25 Qwen3.8-27B登顶Code Arena前十唯一小模型 —
X:通义千问 / Qwen (@Alibaba_Qwen)
通义千问Qwen3.8-27B在Code Arena: WebDev中以1595分位列总榜第9,是前十名中唯一同尺寸级别模型,并重塑了帕累托前沿。该模型仅比更大的Qwen3.8-Max低6个名次,而4月发布的Gemma 4-31B仅排第80位。 -
08-25 SWE-bench Science:编码智能体难解科学缺陷 —
X:Rohan Paul (@rohanpaul_ai)
新基准 SWE-bench Science 用开源科学仓库的真实缺陷测试编码智能体,发现它们擅长消除可见故障,却难以恢复底层科学逻辑,且领域知识帮助有限。最佳配置 Claude Code 配 Opus-5 通过 96.64% 公开测试,但 Pass@1 仅 47.90%。瓶颈在于验证而非知识:智能体无法将科学解释与可执行证据对照时,会锚定解释而非检验它。 -
08-25 LinkedIn”看起来像是 AI 垃圾”按钮收效显著,相关内容浏览量下降四成 —
IT之家(RSS)
LinkedIn 推出”看起来像是 AI 垃圾”反馈按钮后,被认定为 AI 劣质内容的帖子浏览量较几周前下降 40%。自 7 月 30 日上线以来,已有超 100 万人点击该按钮反馈可疑帖子和评论。获足够社区反馈的帖子将在”帖子分析”中突出显示,LinkedIn 同时建立了防止用户遭不公平集中举报的保护机制。 -
08-25 DeepSeek Harness 之后,重读最早定义开源的一群人 —
elsewhere:文章(RSS)