Teigen's Daily
X Digest · 🐦 X 简报

2026-07-09

🤖 AI/ML

@OpenAI:OpenAI 审计 SWE-Bench Pro 后撤回推荐,称 30% 任务存在问题,这提醒前沿 coding model 的进步速度已经开始反过来淘汰旧评测。🔗 链接

@FinanceYF5:Google DeepMind 新论文把 AGI 到 ASI 的路径拆成算力扩展、范式替换、递归自我改进和多智能体群体智能,值得关注的是它把 ASI 描述成连续加速过程而非单点突破。🔗 链接

@xiaohu:OpenAI 的 GPT-Live 把全双工语音、后台 GPT-5.5 推理和实时 UI 卡片合在一起,语音助手从“轮流对话”迈向可打断、可查证、可展示的实时协作界面。🔗 链接

@immersivetran:Marble Curriculum 把小学阶段 8 个学科拆成 1,590 个核心概念和 3,221 条前置关系,结构化知识图谱让 AI 教育从按课本推进转向按掌握状态动态规划路径。🔗 链接

@willdepue:will depue 提议给长周期 Codex 目标维护实时 summary doc,而不是让用户读混乱的 CoT 摘要,这击中了 agent 持续协作里“状态可见性”这个硬问题。🔗 链接

@npew:Peter Welinder 指出双向语音模型能同时听和说,这个看似底层的交互能力会直接决定 AI 对话是否接近真人协作。🔗 链接

@Scobleizer:Robert Scoble 提到 Tesla 本地模型与阿里云研究者在 ACL 谈到的小模型趋势,说明“可本地运行”的模型路线仍在自动驾驶、隐私和离线场景里有硬价值。🔗 链接

@willdepue:视频生成与机器人世界理解被放在同一条技术线上讨论,重点是“压缩即预测、生成即理解”的范式正在把生成模型和物理世界 AI 接起来。🔗 链接

@emollick:Ethan Mollick 批评 Grok 4.5 缺少 model card,指出前沿模型不能只用排行榜宣传,透明测试和模型卡正在变成可信发布的最低要求。🔗 链接

@emollick:一篇研究显示管理者对 AI 价值和用法的信念会显著影响团队实际收益,这说明企业 AI 落地瓶颈不只在模型能力,也在组织认知和管理实践。🔗 链接

@waylybaye:Baye 用 Fable 5 辅助云服务迁移,每月省下约 500 美元并发现长期闲置扣费资源,AI agent 的价值开始从写代码延伸到真实运维降本。🔗 链接

@SakanaAILabs:Sakana AI 与 DeepLearningAI 讨论 Fugu/Fugu-Ultra 的动态模型编排,单模型竞赛之外,多模型路由正在成为接近 SOTA 且降低供应商依赖的工程路径。🔗 链接

💻 Tech

@xiaohu:Claude Code 的 /checkup 命令会检查技能、MCP、CLAUDE.md、慢钩子和自动模式等环境问题,AI 编程工具开始把“自检和瘦身”产品化。🔗 链接

@emmanuel_2m:Scenario 用自动化 MCP 流程对比 Seedream 5.0 Pro 和 GPT Image 2 的 20 组提示词,图像模型评测正在从晒图走向可复现的批量测试。🔗 链接

🌐 其他热点

@ednewtonrex:BBC 允许包含“有意义人类创造力”的生成式 AI 音乐引发反对,争议核心是这类政策可能把训练版权和音乐人生计问题正常化。🔗 链接

📊 扫描 231 条 | 覆盖 21.2h | 精选 15 条

同日其他 — 2026-07-09
J 更早   K 更新   G 归档   / 主题