AI Radar 简报 · 2026-08-13
涵盖 AI精选 · 热点动态 · AI简报 · 论文速递
🔥 AI精选
来源:AIHOT · 精选热点
| 日期 | 标题 | 来源 | 分类 |
|---|---|---|---|
| 08-13 | 阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文 | IT之家 | 模型 |
| 08-13 | 微软首发自研推理模型 MAI-Thinking-1 | X: Mustafa Suleyman | 模型 |
| 08-13 | DeepSeek V4 Pro 与 Grok 4.6 同日发布,双双逼近 Claude Fable 5 体验 | 公众号: 数字生命卡兹克 | 观点 |
| 08-13 | Anthropic 研究:新兴多智能体系统的模式与问题 | Anthropic Research | 研究 |
| 08-13 | Claude in Chrome 侧边栏升级为 Claude Cowork 会话 | Claude Blog | 产品 |
| 08-13 | WorkBuddy 上线远程控制,国内也有了最丝滑的 Agent 工作方式 | 公众号: 数字生命卡兹克 | 产品 |
| 08-13 | 空货架还是丢钥匙?Google 研究:Recall 是参数化事实性的瓶颈 | Google Research | 研究 |
| 08-13 | AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求 | GitHub Blog | 技巧 |
| 08-13 | Meta 开源 Muse Glimmer 登陆 OpenRouter | X: OpenRouter | 产品 |
| 08-13 | 我写了一本 AI 教科书——AI 还要多久才能写得更好? | Interconnects | 观点 |
📡 热点动态
来源:AIHOT · 全量热点(近 1 天)
-
08-13 辛顿、李飞飞、吴恩达齐发声:呼吁保持 AI 一定程度的开放 —
IT之家
Ai4 大会上三位巨头均认为 AI 需保持一定开放、担忧发展节奏被少数大公司掌控:辛顿反对开放权重(认为可被低成本再训练用于攻击)但承认”争论已经输了”,吴恩达主张开放以提升美国竞争力,李飞飞反对开放/封闭的二元对立——AI 开放性辩论进入新阶段。 -
08-13 OpenAI Codex 用户破 1500 万并重置用量,Codex Realtime 即将上线 —
X: Testing Catalog
Codex 达成 1500 万用户里程碑并重置用量限制,Codex Realtime 被视为一大解锁——编程 Agent 的用户规模持续爆发,实时能力成下一个竞争点。 -
08-13 马斯克确认 SpaceX 将用员工数据训练 Grok AI:”你们将成为 AI 的父母” —
IT之家
马斯克在全员会上称将用内部信息(含员工贡献数据)训练 Grok、让模型继承其思想价值观;SpaceX 以 600 亿美元收购 Cursor 的交易预计数月内完成,并推出可自主执行任务的 Grok Bot——马斯克的 AI 版图加速整合。 -
08-13 OpenAI 奥尔特曼:6 个月内 AI 将实现”完美理解用户使用情境” —
IT之家
奥尔特曼称未来 6 个月后续模型将能”读懂”用户屏幕、录制会议和通话、全面了解用户生活,用户可划定访问范围、AI 充当助手而非替用户决策——”情境完美理解”或只差 1 代模型,隐私与能力的张力升级。 -
08-13 DeepSeek-V4-Pro 以低价逼近 GPT-5.6,却撤回 0813 发布公告 —
X: Rohan Paul
V4-Pro 在 Code Arena WebDev 获 1607 分仅落后 GPT-5.6 Sol xHigh 15 分、混合 token 价约为其 1/31($0.435/$0.87 每百万);但官网随后撤下发布公告疑似回滚,Artificial Analysis 评分全球第 9、不及 Kimi K3,外界猜测部署问题或推错模型。 -
08-13 GPU 折旧周期意外延长:CoreWeave 签下 A100 多年期合同至 2029 年 —
X: Rohan Paul
2020 年发布的 A100 在推出约 9 年后仍有客户承诺长期容量;CoreWeave 将设备使用寿命从 5 年上调至 6 年、称旧集群可转向托管推理——CUDA 让 Ampere/Hopper/Blackwell 持续升级,GPU 资产耐用性超预期,利好 AI 基建折旧模型。 -
08-13 Dyna Robotics 发布 Dyna-2:基于 100 万小时人类视频预训练的世界-动作模型 —
MarkTechPost
在超 100 万小时第一人称人类视频上预训练的世界-动作模型,验证了 1000→100 万小时的缩放定律并首次零样本迁移至未见机器人数据,视频联合去噪在 39/39 任务上优于仅动作训练、零样本 MSE 从 0.340 降至 0.120——”看人类视频学操作”的数据缩放路线走通。 -
08-13 英国研究多种防范措施,避免恐怖分子利用 AI 制造生物武器 —
IT之家
英国政府拟监管 AI 在基因合成领域的应用:修改现行法律建立基因合成筛查制度、要求实验室确认客户身份并上报异常订购,还考虑介入 AI 企业与学术合作——AI 生物安全从行业自律走向政府立法监管。 -
08-13 微软首发自研推理模型 MAI-Thinking-1 —
X: Mustafa Suleyman
微软 AI CEO Mustafa Suleyman 官宣首个自研推理模型——微软在深度依赖 OpenAI(贡献七成 AI 收入)的同时加速构建自有模型能力,降低单一供应商依赖。 -
08-13 英特尔 CEO 陈立武自掏 1200 万美元参与 200 亿美元股票增发 —
IT之家
英特尔公开发行约 2.105 亿股、融资扩至 200 亿美元(发行价 95 美元/股),为 1971 年上市以来最大单次股权融资,资金用于 AI 芯片迭代量产及代工扩张;CEO 以个人资金第二次认购——管理层用真金白银为转型背书。 -
08-13 阿里云 AgentLoop:游戏智能体生产环境优化法 —
X: 阿里云
一套 3 天 7 步方法应对”演示表现好、生产环境失败”:追踪证据而非声明、评估工具与 API 事实、用技能护栏修复根本原因、用数据集与告警做回归测试——Agent 从 Demo 到生产的工程化(LLMOps)方法论沉淀。 -
08-13 荣耀 Robot Phone 上手:云台相机成最大亮点 —
X: X.PIN
搭载类似大疆 Osmo Pocket 的云台相机、防抖出色但重近 250g,骁龙 8 Elite Gen 5、7060mAh 电池,起售 9999 元——手机形态创新在 AI 影像方向探索新可能。 -
08-13 Meta 开源 Muse Glimmer 登陆 OpenRouter —
X: OpenRouter
Meta 的 30B 开源本地智能体模型 Muse Glimmer 上架 OpenRouter——开源模型通过聚合路由平台快速触达开发者,Meta 重新强调开源的战略落地。 -
08-13 swyx 将在 MongoDB .local 谈 AI 智能体与嵌入 —
X: swyx
Latent Space 团队出席 MongoDB .local,讨论 AI 智能体基础设施、嵌入/重排序现状、可穿戴 AI 及托管 MCP——嵌入与向量检索仍是 Agent 基础设施的核心议题。 -
08-13 荣耀 Robot Phone 延伸:AI 影像手机的差异化竞争 —
X: X.PIN
在手机同质化背景下,硬件厂商用云台+AI 影像寻求差异化——AI 时代的手机创新正从”算力堆叠”转向”独特交互形态”。
📋 AI简报
来源:AI Digest
2026-08-13
-
Twitch 默认允许亚马逊用直播内容训练生成式 AI,主播须主动退出 — Twitch 新增生成式 AI 训练设置,确认主播频道内容(直播、VOD、剪辑、直播聊天及频道图片文字)可用于训练亚马逊模型,且所有用户默认同意——没留意公告或没改设置的主播会持续供给内容。退出需进账户安全设置底部关闭对应开关,但 Twitch 未说明此前已用多少内容、历史数据能否删除。退出只针对生成式训练,不停止 AutoMod 等社区安全功能——平台用”默认加入+主动退出”的方式最大化训练数据获取,引发内容创作者数据权利争议。
-
Google 将美国手语输入带到 Pixel 11,首批接入 Gboard 和 Live Transcribe — Google DeepMind 与 Android 团队发布 SL2T 1.0,将美国手语输入从研究项目带入手机产品,Pixel 11 用户可在 Gboard 和 Live Transcribe 中免费率先使用。项目由聋人 Google 员工 Sam Sepah 提出,聋人合作伙伴深度参与数据收集、评估与影响评估,并成立 AI 手语咨询委员会——AI 无障碍能力落地到主流消费产品,展示了 AI 服务边缘群体的实际价值。
-
Google 披露 Gemini 使用画像:月活破 10 亿,63% 活跃用户使用语音 — Gemini 成为 Google 增长最快的产品,月活达 10 亿。负责人称 63% 活跃用户使用语音输入、纯语音用户在增加;Gemini Live 用户中 20% 会共享摄像头画面或屏幕请 AI 根据实时视觉提供帮助;学校相关请求 38% 含附件;用户每天借助 Google AI 生成 1.5 亿张图片——语音和实时视觉正成为主流交互方式,AI 助手的使用形态从”打字问答”快速多模态化。
📄 论文速递
来源:AI Brief
重点关注
训练时借视频生成学习世界如何变化,推理时却把视频分支整个拿掉——SimWAM 让预训练视频专家与轻量动作专家联合训练,用隔离注意力保证轨迹预测不依赖未来画面,部署时只保留能直接输出轨迹的动作分支。两个专家不共享参数、只通过统一注意力接口交互,因此视频骨干可替换、动作分支可独立扩展。配合 RL 优化组合式驾驶奖励,在 NAVSIM 达 91.5 PDMS,以显著更低延迟超过此前世界-动作规划器,并零样本迁移到 nuScenes。实用路线:把生成模型当训练期教师,吸收动态规律后不再为其长期推理成本买单。
通用 PEFT 在实时检测器上会静默失效:流程照常运行,但异构算子、检测头语义和部署约束可能让适配器放错位置。YOLO-PEFT 把模块选择改造成可审计的约束规划,为每个被排除模块记录原因、方案不可靠时拒绝训练。按 VOC07+12 协议,规划出的 RS-LoRA 在 YOLO11s/12s 上达 0.7138/0.7307 mAP50-95,高于全量微调;到 RT-DETR-L 时 7 种 LoRA 配置全部越过灾难阈值,系统建议回退全量微调——”知道何时不用 PEFT”同样有工程价值。代价:LoRA 峰值显存减 43.9%,但训练时间增至 1.72 倍。
把所有伪造线索一次压成真假结论,可能正是深伪检测难以泛化的原因。这项工作让四个取证角色分别检查纹理、光照、运动和物理一致性,再由裁判汇总证据并解释;关键不在 Agent 数量,而在不同线索能否保持相对独立。配套数据集含 10 万段视频、覆盖 33 种换脸与人脸生成方法。这套完全由小型开源多模态模型组成的框架,在域外测试中超过 GPT 和 Gemini 等闭源模型,并在该基准全部指标上排名第一。真正的考验仍是面对训练/评测未覆盖的新合成方法时分工取证能否继续有效。
也值得关注
- 生活事件驱动的 LLM Agent 人格演化基准 — 长期角色一致性不等于人格永不变,检验 Agent 经历生活事件后能否产生合乎心理学逻辑的变化。
- 用题目级概率变化审计”去记忆”是否真恢复了原始能力 — 污染缓解后总分回到原点仍可能掩盖逐题差异,主张分层逐题概率评估。
- C4:把创意理解收窄为跨概念解码 — 评测多模态大模型能否读出表面无关概念之间的隐含联系。
- Capek 0.5:把具身智能重点放回执行闭环 — 每次动作改变环境后模型都要重新感知、推理并验证,而非一次性生成完整计划。