X Digest · 🐦 X 简报
2026-07-11
SAT · July 11, 2026
二〇二六年七月十一
🤖 AI/ML
- @AravSrinivas:Arav 预测 6 个月内会出现便宜 3-4 倍的 Fable 5 级模型、12 个月内会有本地设备可跑的 Opus 4.8 级模型,值得关注前沿能力成本曲线可能继续陡降。 🔗 链接
- @MengTo:Meng To 用 GPT-5.6 Sol Ultra 基本一次生成了带图层、检查器和实时协作的 HTML/React 无限画布,说明设计工具正在被“好品味 + 多智能体实现”重塑。 🔗 链接
- @svpino:Santiago Valdarrama 认为 AI 视频会从静态短片走向可互动的直播式体验,这把生成视频的竞争焦点从画质推向实时交互闭环。 🔗 链接
- @Scobleizer:Scobleizer 连发讨论 AI 视频的下一步不是“生成漂亮片段”,而是让视频模型实时响应用户动作,游戏和娱乐可能因此从观看内容变成进入生成世界。 🔗 链接
- @indigox:indigox 总结 Thinking Machines 新文章,强调生产性知识是局部、隐性、私人化的,反对把所有知识集中进少数中心化 AI 的路径。 🔗 链接
- @SakanaAILabs:Sakana AI 复现 PicBreeder 的 VLM 研究显示,多样化人格的智能体群体能扩大开放式探索,但当前模型仍更容易优化既有模式而不是持续追逐意外发现。 🔗 链接
- @simonw:Simon Willison 发现 ChatGPT 移动端 Work 模式疑似能运行可联网代码,而 Chat 模式不行,这意味着“模式差异”可能不只是 UI,而是工具权限边界。 🔗 链接
- @emollick:Ethan Mollick 对比 NotebookLM 与 ChatGPT Work 处理同一批 70+ 文件的表现,认为 NotebookLM 更重视流程和来源,这点对知识工作产品很关键。 🔗 链接
- @OpenAI:OpenAI 宣称 GPT-5.6 Luna 在健康智能上超过 GPT-5.5 最高推理档且成本低 25 倍,医疗/健康场景正在成为大模型降本提质的重点战场。 🔗 链接
- @Google:Google Gemma 团队和 Hugging Face 组织 100+ AI agents 与开发者进行 6 天冲刺,把 Gemma 4 开源模型推理速度提升 5 倍,开源模型优化开始出现“人类定方向、智能体协作”的新范式。 🔗 链接
- @polynoamial:polynoamial 提到 GPT-5.6 Sol Ultra 为一个 50 年数学猜想产出证明,而且是公众当前可访问模型完成的,这让 AI 辅助科研的可复现实验门槛明显降低。 🔗 链接
- @Scobleizer:Scobleizer 介绍 Kinetiq Ascend 让机器人在真实生产任务中用强化学习自我练习,拣选成功率从 80% 到 98%、双臂搬运吞吐翻倍,物理 AI 的学习曲线开始像语言模型一样可规模化。 🔗 链接
💻 Tech
- @cursor_ai:Cursor 推出 side chats,让用户在不打断主对话的情况下开启持久 agent 支线并可回带上下文,这是 IDE 内多线程协作体验的重要产品化。 🔗 链接
- @op7418:op7418 提到小红书上线 AI“小工具”,允许把 vibe coding 做出的网页工具挂载到图文/视频里,封闭社区开始把 AI 小应用分发当成高 ROI 发布层。 🔗 链接
🌐 其他热点
- @1stForAll:一名纽约男子起诉联邦移民官员,称 ICE 代理主管收到批评邮件后派人上门侵犯第一修正案权利,这件事把执法回应与言论自由边界推到前台。 🔗 链接
📊 扫描 253 条 | 覆盖 25.1h | 精选 15 条
J 更早 K 更新 G 归档 / 主题