AI Radar 简报 · 2026-08-19
涵盖 AI精选 · 热点动态 · AI简报
🔥 AI精选
来源:AIHOT · 精选热点
| 日期 | 标题 | 来源 | 分类 |
|---|---|---|---|
| 08-19 | GLM-5.3 上线:AA 智能指数 60 分并列开源第一,成本更低 | 公众号:智谱(GLM) | 产品 |
| 08-19 | Claude 加速蛋白质设计:15 个靶点成功 14 个,命中率 22.6%-35.1% | Anthropic Research | 研究 |
| 08-19 | Mojo 语言正式开源,编译器与工具链全面开放 | Hacker News | 产品 |
| 08-19 | Claude 现已支持 Gmail 邮件与 Google Drive 文件管理 | X:Claude | 产品 |
| 08-19 | OpenAI 在”关键网络能力”时代放缓模型开发节奏 | OpenAI 官网动态 | 观点 |
| 08-19 | Claude Tag 如何担任 Anthropic CI/CD 故障的一线响应者 | Claude Blog | 技巧 |
| 08-19 | 智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准 | Hugging Face Blog | 研究 |
| 08-19 | OpenAI 推出 ChatGPT for Teens:面向青少年的学习体验与更强安全保护 | OpenAI 官网动态 | 产品 |
| 08-19 | 设计 AI 评测:先求清晰,再谈可视化 | Google AI DEV | 技巧 |
📡 热点动态
来源:AIHOT · 全量热点(近 1 天)
-
08-19 唐杰谈缩放定律:GLM-5.3 作为受控后训练实验 —
X:唐杰
唐杰反思缩放定律:参数规模需与数据、算力、推理成本协同,Chinchilla 最优比例并非终点。GLM-5.3 与 5.2 同架构同参数,仅靠一个月长程环境与 RL 后训练带来显著提升——证明”缩放不止参数一个旋钮”,后训练成为智能提升的新增长极。 -
08-19 GLM-5.3 (max) 人工分析基准:智能领先、价格合理但输出冗长 —
Hacker News
GLM-5.3 (max) 在 Artificial Analysis Intelligence Index 得 60 分,远超同类中位数(35)——国产开源模型在第三方独立评测中坐实”智能领先”,唯输出冗长成为待优化项。 -
08-19 DeepSeek V4 Pro 与 GPT-5.6 Sol 路由对比:允许重试时反超 —
X:小北
Together AI 在 DeepSWE 上对比:单次执行 Sol 更强(pass@1 72.7% vs 62.8%),但允许重试时 DeepSeek pass@4 达 88.5%、反超 Sol 的 85.8%——”单次能力”与”多次采样性价比”成为模型选型的两条不同赛道。 -
08-19 Anthropic 用 Claude 设计蛋白结合剂,14/15 靶点命中 —
X:小北
Claude Mythos Preview 和 Opus 4.8 为 15 个蛋白靶点自主选择结合位点、调用多专业模型优化,湿实验命中率 22%~35%,高于行业典型的 10%~15%——AI 正从”辅助分析”迈向”自主设计”新分子,尽管仍是药物研发极早期步骤。 -
08-19 美国 AI 数据中心遭遇反对潮,科技巨头砸钱”灭火” —
IT之家
盖洛普调查显示 71% 美国人反对本地建数据中心,Q1 遭阻止或延期项目数创历史新高;OpenAI 承诺向佐治亚社区投资 8000 万美元,Meta 设 10 亿美元基金、今年资本支出最高 1450 亿美元——AI 基建的社会阻力正转化为巨额社区公关成本。 -
08-19 斯坦福研究:X 平台推荐算法优先推送煽动愤怒内容以提高互动 —
IT之家
基于 715 名用户数据,PNAS 论文发现算法更倾向推送与用户价值观不一致的内容,形成”越生气、越互动、越被推荐”的循环;X 前产品负责人称研究公布后平台已将此类推荐降低一个数量级——算法的情绪操纵机制被量化揭示。 -
08-19 日本公布生成式 AI 开发者指导方针草案,要求披露训练数据 —
IT之家
内阁府草案要求开发者披露训练数据及收集方式、建议避免从盗版网站收集,并要求建立内部通知系统——虽无法律约束力,但推动训练数据透明度成为 AI 版权治理的新方向。 -
08-19 Memmy 开源:跨 Agent 共享本地记忆,”Switch agents, not context” —
X:阿易 AI Notes
Memmy 将 Codex、Claude Code、DeepSeek Harness 接入同一份本地 SQLite 记忆,让对话中未落盘的决策也能跨工具传递——多 Agent 时代的”记忆互操作性”成为提升协作连续性的新基础设施。 -
08-19 台积电完成 A16 背面电轨先进逻辑制程研发与认证 —
IT之家
A16 是首个导入背面电轨的 2nm 衍生工艺,预计 2026 下半年生产就绪:相较 N2P 同电压速度增快 8~10%、同速度功耗降低 15~20%、密度提升 10%——为下一代 AI 芯片提供关键制程基础。 -
08-19 Grok Bot 清理 Gmail 垃圾邮件获马斯克力挺 —
X:Elon Musk
用户用 @Grok @Bot 处理两个 Gmail 账户共 9 万封邮件、清除垃圾内容,马斯克转发力挺——邮箱清理成为个人 AI 智能体最直观的高频落地场景之一。 -
08-19 comma.ai 推出 chestnut eGPU 扩展坞,车载 AI 浮点运算提高约 100 倍 —
IT之家
chestnut 外置 eGPU 扩展坞售价 249 美元,含 AMD Radeon RX 9060 8GB 的真机套件售价 799 美元——把消费级 GPU 算力引入车载场景,大幅提升自动驾驶本地推理能力。 -
08-19 PICO Space Pro 头显定档 9 月 2 日发布 —
IT之家
搭载 4000 PPI micro-OLED 面板、双芯片架构(主处理器 CPU/GPU 为骁龙 XR2 Gen 2 两倍),配备追踪控制器与边界绘制功能——国产空间计算头显硬件规格向 Meta Quest 看齐。 -
08-19 从王昭君到 AI:表象如何取代真实 —
X:ZHO
ZHO 借《红楼梦·五美吟》咏昭君诗指出”个人真实价值被媒介、图像、中间人决定”的现代性——将”画工”替换为摄影、社交媒体、算法与 AI,AI 对文明的重塑本质是 Representation 取代 Reality。 -
08-19 马斯克调侃 Grok 与 Bot 二选一 —
X:Elon Musk
马斯克以”抉择,抉择”调侃 @Grok 与 @Bot 的定位关系——xAI 在对话模型与个人智能体两条产品线之间的营销互动。 -
08-19 唐杰重申 GLM-5.3 意义:缩放不止参数一个旋钮 —
X:ZHO / 唐杰讨论
围绕 GLM-5.3 的社区讨论持续发酵,核心观点聚焦”后训练 Scaling”路线的有效性——在参数增长趋缓背景下,长程 RL 后训练被视为智能提升的下一个主战场。
📋 AI简报
来源:AI Digest
2026-08-19
-
以色列政府承包商搭建”智库”网站,百余篇报告被指专为影响 AI 回答而设计 — 名为 Hanover Institute 的美国”智库”自 8 月 6 日起发布逾 100 篇以巴议题报告,报告均无署名,页底声明显示由 Piro 代表以色列政府广告机构创建(获 90 万美元)。报告采用目录、脚注、中性语气,标题写成用户可能向聊天机器人提出的问题;Piro 自称制作”符合大模型可信度判断方式”的内容、称之为”AI Story Optimization”——以影响 AI 回答为目标的信息操纵手法正在成型。
-
独立 AI 使用观测平台汇总 2.45 万段对话:套用 Anthropic 口径会过滤近半样本 — AI Observatory 汇总 7 个数据集、约 5000 名用户与 52 个模型的 24521 段真实对话。将 Anthropic Economic Index 方法用于该样本发现 48% 对话会被排除,被过滤部分中健康人际、成人非法、骚扰仇恨、性内容占比均远高于 Anthropic 分析——厂商报告的”工作用途”口径系统性低估了 AI 的真实使用场景,独立观测提供重要参照。
-
Cursor 推出代码托管服务 Origin:付费用户可建仓库,并与 GitHub 双向同步 PR — Cursor 将仓库、代码审查和编码代理放进产品内 Codebase 标签页,处于早期测试、向所有付费计划开放。用户可新建 Origin 托管仓库或连接 GitHub 同步(GitHub 仍是事实来源、PR 评论双向同步),Cursor 可针对浏览代码回答问题、改代码、更新 PR,并接入 Vercel/Depot/Buildkite——AI 编程工具向”agent-native 代码托管”纵向整合,正式定价与后续功能待公布。