2026-07-16
🤖 AI/ML
@james406:当前 Agent 竞赛过度聚焦循环、规划和工具调用,却低估了用户需求、业务优先级与线上状态等环境上下文,而“知道什么值得解决”可能比“能反复执行”更决定产品成败。🔗 链接
@SakanaAILabs:Sakana AI 将 NVIDIA Nemotron 开放模型接入多模型编排系统 Fugu,让模型按任务动态分工并用真实多步工作流反馈同时优化模型与编排层,展示了开放模型从单体走向“集合智能”的路线。🔗 链接
@thsottiaux:OpenAI 调查确认 GPT-5.6 极少数误删文件事件多发生于无沙箱的完全访问模式下,模型为临时目录改写 $HOME 时误删了用户目录,说明 Agent 权限隔离和高风险动作复核仍不可省。🔗 链接
@emollick:Thinking Machines 新开放权重模型 Inkling 在实测中尚未达到中国前沿开放模型水平,甚至未通过近年主流前沿模型都能完成的 Lem Test,为发布期的高调性能叙事提供了必要校正。🔗 链接
@vlmrun:开源工具 mm 把 find、cat、grep 等 Unix 操作扩展到图片、视频和富视觉 PDF,并支持本地优先与自选模型,补上了命令行 Agent 处理多模态上下文的关键缺口。🔗 链接
@Saboo_Shubham_:Google 发布面向 Agent 的评测 Skill,可自动发现质量缺陷、实施修复并验证效果,且兼容 Antigravity、Claude Code 和 Codex,让 Agent 自我改进开始具备可复现的闭环。🔗 链接
@levie:多家大型企业 IT 负责人反馈,Agent 落地的瓶颈已从模型能力转向流程改造、数据与权限建模、嵌入业务的工程人才和多模型路由,传统企业软件若不能无界面化开放能力将面临明显风险。🔗 链接
@petergyang:ChatGPT Live 无法直接调用已连接的文档、邮件和浏览器工具,暴露出语音交互与 Codex 执行能力彼此割裂的问题,而把两者打通可能才是真正可行动语音助手的起点。🔗 链接
@simonw:Grok Build CLI 开源仓库规模达 84.4 万行 Rust,其中内置可用 Unicode 方框字符在终端渲染 Mermaid 图的完整组件,显示成熟 Agent 产品正把大量基础设施直接内建到客户端。🔗 链接
@OpenAIDevs:OpenAI 与 Work Louder 推出 Codex Micro 实体控制台,可把按键和摇杆映射到工作流并常驻置顶对话,意味着多 Agent 操作正从纯软件界面向专用硬件交互延伸。🔗 链接
💻 Tech
@rauchg:Vercel Sandbox 日活按月增长 100%、每天创建超过 350 万个沙箱且已服务多家大型产品,说明隔离执行环境正在迅速成为 Agent 应用的标准底层设施。🔗 链接
@xiaohu:MIT 与 EPFL 的仿生机器人能在水下游动后以约 70° 角、8 至 10 次拍翼稳定跃出水面继续飞行,为跨空气与水域的新型无人机提供了可验证的力学方案。🔗 链接
@HiTw93:Mac 清理工具 Mole 的新版重点保护正在使用的 Homebrew 链接和应用数据,并能在更新中断后自修复,反映系统级 CLI 正把“默认安全”从口号落实到故障恢复细节。🔗 链接
🌐 其他热点
@RobinSeun:2025 年全国医保基金收入 3.59 万亿元、支出 3.01 万亿元,但 1.08 亿退休职工医疗费用已超过 2.81 亿在职职工,老龄化正把改革重点从扩大参保推向提升资金使用效率。🔗 链接
@LinusEkenstam:加拿大山火烟雾已从太空清晰可见并飘至欧洲大陆,同时出现居民住宅被焚毁的现场记录,显示这轮灾情的影响已从区域火灾扩展为跨大西洋环境事件。🔗 链接
📊 扫描 261 条 | 覆盖 23.5h | 精选 15 条