X Digest · 🐦 X 简报
2026-09-24
THU · September 24, 2026
二〇二六年九月廿四
🤖 AI/ML
- @FinanceYF5:Muse Connector Platform 上线数日便收到逾 2000 份连接器提交,说明个人 Agent 的生态竞争正迅速从模型能力转向第三方工具覆盖。🔗 链接
- @LinusEkenstam:一套获准自主发帖的夜间 Agent 在无人监督时误发内容,作者随即撤销发布权限,这个真实事故提醒“可执行”必须配套人工确认和责任边界。🔗 链接
- @xiaohu:Boltzbit 与剑桥团队提出用超网络把交互信息动态编译成可持续演化的 LoRA 权重,试图以固定轮次成本解决长上下文反复读取和会后遗忘的问题。🔗 链接
- @xiaohu:Claude Opus 5.5 仅靠代码、浏览器截图和 ffmpeg 就完成分镜并并行绘制手绘 MV,展示了编程 Agent 已能把创意制作拆成可协作的端到端流水线。🔗 链接
- @indigox:约 950 个 Claude Agent 用 21 小时和 2.1 亿 token 从海量 DNA 中筛出疑似新型 ART 酶系统,把生物学的假设生成成本压缩到“算力筛选、人类实验验证”的新范式。🔗 链接
- @rileybrown:新版 ChatGPT 语音可直接调用插件,用户散步时仅靠对话就处理了约 10 封邮件,语音界面正在从问答入口变成可核验的行动入口。🔗 链接
- @NousResearch:Hermes Desktop 已支持实时观看 Agent 操作浏览器和终端并随时人工接管,为凭证输入、纠错和高风险操作提供了更实用的人机交接机制。🔗 链接
- @Azaliamirh:开源 CLM-8B 通过轻量微调在 DeepSWE 达到 81.6%、Terminal Bench 2.1 达到 87.6%,并宣称在多类 Agent 任务上以最高 9 倍速度接近 Jev,凸显专用小模型的效率潜力。🔗 链接
- @CAIS:HLE-Diamond 在多研究社区参与下历时一年清洗 Humanity’s Last Exam,说明前沿模型评测的瓶颈正从题量转向污染控制和题目可信度。🔗 链接
- @xiaohu:Claude Code 正式提供托管云端会话,即使本地电脑关机也能继续运行任务,编码 Agent 的工作形态进一步从本机工具转向可持续的云端执行环境。🔗 链接
💻 Tech
- @alex_prompter:OJO 把先行完成的设计方案通过 CLI 交给 Codex 实现,揭示 AI 产品开发更有效的分工可能是“设计 Agent 定义视觉,编码 Agent 负责落地”。🔗 链接
- @justinryanio:Meta 发布约 100 克、配外置计算模块的 VR 眼镜,集成眼手追踪、全身全息通话和微型 OLED,并以 1299 美元定价把高端空间计算推向更轻形态。🔗 链接
- @FinanceYF5:七家超大规模云与芯片公司的表外承诺及信贷支持据称已超 3.1 万亿美元,AI 基建扩张虽减轻表内压力,却把芯片贬值和数据中心过剩风险留在担保链条中。🔗 链接
- @FinanceYF5:自 6 月以来主流模型平均 token 价格大幅下跌而 B200、H200 租金分别上涨约 50% 和 28%,显示模型服务趋近商品化时稀缺价值正在向算力基础设施迁移。🔗 链接
🌐 其他热点
- @RobinSeun:从“调休就不消费”到抵制单休企业商品,越来越多劳动议题被转化为消费选择,折射经济下行期个人与企业之间的对抗正在外溢到市场行为。🔗 链接
📊 扫描 255 条 | 覆盖 24.7h | 精选 15 条
J 更早 K 更新 G 归档 / 主题