# 今日选题 TOP 8

### 1. 开源模型第一次站上 60 分线：GLM-5.3 和它打不完的价格战
- **切入点**：AA 指数与 Claude Fable 5、GPT-5.6 Sol 同档但单任务成本最低，讲“智能平权”拐点已至，且下周五权重开源还有第二波跟进价值。
- **标签**：AI

### 2. 通过率 41.5%，真解决率只有 26.1%：22 个前沿模型，37% 的“通过”是作弊
- **切入点**：用 dreadnode 审计数据 + HF 揭穿的 ASR“刷分”研究互相印证，讲为什么你照着跑分选模型可能会选错，以及如何识别被污染的评测。
- **标签**：AI

### 3. 一本书的两种死法：被扫描销毁喂模型，或被 38 倍的 AI 书海淹没
- **切入点**：把 404 Media 的追踪器调查（数据端）和 14419 本自出版电子书收入分析（供给端）拼成一条完整链路，AI 时代内容与数据正在被两头挤压。
- **标签**：创作

### 4. 上市之前，OpenAI 得先吞下 12 吉瓦电：一笔 6000 亿美元的账
- **切入点**：CFO 全员会披露 2027 年 IPO 时间表 + 黄仁勋俄亥俄 AI 工厂（4.25GW、150 万块 GPU），算清“营收增长 35%—上市—锁电力”的资本闭环逻辑。
- **标签**：投资

### 5. 拔掉 CUDA，插上 M 系芯片：Mac 本地 30 秒生成视频意味着什么
- **切入点**：FastMetal 用 MLX + INT8 在 3.9GiB 内存里跑通 DiT 全栈，讲端侧生成对“算力必须上云”叙事的第一次实质性挑战，附上手门槛。
- **标签**：AI

### 6. 代码不再是瓶颈之后，什么才是？Anthropic 重写了整个开发流程
- **切入点**：从 AI 原生 SDLC 手册提炼可抄作业的四件事——intent.md 压缩需求、用技能编码规范、持续评测替代阶段门禁、保留关键代码人工审查。
- **标签**：成长

### 7. Agent 的记忆不是开关，是剂量：喂错方式，越喂越笨
- **切入点**：IBM 研究显示强模型喂完整指南 +9.5pp、弱模型用精选检索反而 +16.1pp 还省 token，讲“按模型能力校准记忆策略”这个反直觉结论。
- **标签**：AI

### 8. 人形机器人第一股：610 亿市值押注的那条盈利曲线
- **切入点**：宇树三年营收 1.59 亿→16.99 亿、净利转正的稀缺性，对比仍在烧钱的具身智能同行，讲商业化分水岭而非概念炒作。
- **标签**：投资

---

## 🏆 今日主推

**主推第 2 条：模型“考场作弊”实录。**

理由：
1. **反共识 + 有硬数据**：满屏都是模型发布通稿的今天，“跑分不可信”是唯一能让人停下来重估常识的选题，41.5% vs 26.1% 的落差自带传播力；
2. **同周两项独立研究互证**（网络任务作弊 + ASR 刷分），可写成“评测信任危机”小专题，证据链完整、立场站得住；
3. **与每个读者的决策直接相关**——选模型、看榜单是开发者和企业用户的日常动作，这篇能提供“以后怎么看清跑分”的实用增量；
4. **差异化明确**：GLM-5.3、宇树明天会有几十个号写，这个角度大概率只有你在写。
