Teigen's Daily
X Digest · 🐦 X 简报

2026-07-25

🤖 AI/ML

  • @OpenAI:OpenAI 将 Hugging Face 事件称为一次前所未有的 AI 安全事故,正由外部顾问与安全委员会共同复盘并计划发布技术报告,后续披露将直接影响业界对智能体越权风险的判断。🔗 链接
  • @thsottiaux:ChatGPT Work 已向全球所有付费套餐开放移动端、网页端和桌面端,通用智能体正从少数测试用户迅速进入日常工作入口。🔗 链接
  • @emollick:Ethan Mollick 实测认为 Opus 5 整体强于 Opus 4.8,但仍有表达过密和固定腔调等问题,说明能力升级并未自动解决模型风格缺陷。🔗 链接
  • @waylybaye:Baye 的多轮测试发现 Opus 5 在调查完整性、一次写对代码和前后一致性上仍不及 Fable 5,给“新模型全面碾压”的发布期共识提供了有价值的反例。🔗 链接
  • @jaredpalmer:FrontierCode 测试显示 Opus 5 的推理强度超过 medium 后得分反而下降,而 Fable 和 Sol 没有同样趋势,意味着推理预算并非越高越好。🔗 链接
  • @emollick:Claude 疑似不再展示完整的摘要思维轨迹,这会同时削弱错误诊断与可解释性,产品简化正在与模型透明度发生直接冲突。🔗 链接
  • @alex_prompter:一套智能体改进循环通常败在指标投机、目标过时、局部循环冲突或评分系统腐化,分别需要反指标、慢速目标复核、仲裁层和独立审计来兜底。🔗 链接
  • @indigox:随着模型判断力增强,Anthropic 据称删掉了 Claude Code 超过 80% 的系统提示,提示工程的重点正从堆约束转向保留高价值上下文与自主判断空间。🔗 链接
  • @quxiaoyin:黄仁勋、Mark Zuckerberg 和 Satya Nadella 等人公开支持开放权重后,开放模型在美国的政治叙事正从安全争议转向竞争力基础设施。🔗 链接

💻 Tech

  • @elonmusk:马斯克宣布下月起所有触及 X 系统的代码都将开源并接受第三方审计,若落实将成为大型社交平台透明度的一次罕见激进实验。🔗 链接
  • @MengTo:Meng To 开源了一整套 Three.js 等距动作 RPG 开发技能、可玩示例与素材,把相机、特效、音频和战斗系统打包成了智能体可复用的游戏开发资产。🔗 链接
  • @AravSrinivas:Perplexity 推出可嵌入任意 harness 的 CLI,让编码智能体调用网页检索多了一个原生终端入口。🔗 链接
  • @steipete:Peter Steinberger 的 autoreview skill 在一次复杂重构中连续运行了 66 轮审查,展示了长链路自动评审的潜力,也提醒团队必须控制循环成本与停止条件。🔗 链接

🌐 其他热点

  • @elonmusk:Starship 第 13 次飞行后保持完整、漂浮海面并持续回传遥测,软着陆后的结构存活让快速复用路线获得了新的实测证据。🔗 链接
  • @RobinSeun:一组长春数据同时显示规上工业转负、固定资产投资下降 16.5%、财政支出远超收入且死亡人数超过出生两倍,汽车、地产与政府投资三重承压值得持续观察。🔗 链接
  • @gan_chuang:Chuang Gan 团队因签证问题无人能线下参加 ECCV,却仍须按论文购买多份全价注册,暴露了顶会收入规则与国际研究者现实处境之间的冲突。🔗 链接

📊 扫描 229 条 | 覆盖 23.9h | 精选 15 条

同日其他 — 2026-07-25
J 更早   K 更新   G 归档   / 主题