X Digest · 🐦 X 简报
2026-08-28
FRI · August 28, 2026
二〇二六年八月廿八
🤖 AI/ML
- @rryssf:PhoneLLM 用 Nemotron 3 Nano 30B 做全权重微调,在关闭思考链后仍能可靠调用工具,并称相较 GPT-5.6 Terra 成本低 94%、P95 首字延迟快 1.3 秒,直击语音 Agent 的推理延迟与执行可靠性矛盾。 🔗 链接
- @op7418:腾讯混元 Hy4 Preview 以 770B 总参数、49B 激活参数在 Arena WebDEV 排到第五,国产大模型的前沿竞争继续转向大规模 MoE。 🔗 链接
- @FinanceYF5:GLM-5.3 Flash 身份揭晓后披露 AA 得分 57、价格约为前沿模型的 1/100 且完全由国产芯片驱动,低成本模型的规模化调用优势正在显现。 🔗 链接
- @indigox:Anthropic 预览开放的模型硬件标准 MHS,让 Agent 能通过 MCP、CLI 或 API 统一操控显微镜、机械臂等设备,AI Agent 的标准化接口开始从软件延伸到物理世界。 🔗 链接
- @Scobleizer:一份覆盖大量真实案例的 Grok Bot 调研指出,浏览器执行和生活事务可能是首批杀手场景,但共享凭证面、用量成本与不可逆操作前的审批仍是规模化落地的核心风险。 🔗 链接
- @thinkymachines:Thinking Machines 与 UIUC、Bridgewater 的研究显示,RLVR 前期最费力的环节仍是清洗数据和校准奖励函数,而这部分工程投入能够把模型推到复杂任务的最优水平。 🔗 链接
- @percyliang:开放模型 Marin 535B-A23B 已完成约 7% 训练且进展正常,团队将公开讨论此次大规模训练的设计取舍和阶段性经验。 🔗 链接
- @DavidSHolz:Midjourney 开始测试 V8.2 编辑模型,新增指令编辑、参考图生成、局部重绘与扩图,并兼容个性化、情绪板和风格参考,图像编辑能力进一步并入统一工作流。 🔗 链接
- @emollick:Ethan Mollick 实测 H3 Max 已能在短于成片播放时长的时间内生成较高质量视频并包含提示词增强,AI 视频迈过接近实时生成的重要门槛。 🔗 链接
- @svpino:PRAXIST 通过多 Agent 并行试验和显式评估器,在 75 项任务中拿到 49 枚金牌且声称成本约为 Claude Code 方案的十二分之一,展示了以验收目标驱动自主研发的新范式。 🔗 链接
💻 Tech
- @petergyang:Peter Yang 观察到重度 AI 用户不愿为每个新产品重新注册和重建上下文,未来工具若不能直接嵌入 ChatGPT、Grok 等主流 Agent 容器,采用门槛会越来越高。 🔗 链接
- @cursor_ai:Cursor 已把新建 Web 应用、Origin 存储代码和部署到 Vercel 串成工具内闭环,AI 编程产品正从写代码扩展为完整交付环境。 🔗 链接
- @levie:Aaron Levie 认为企业 Agent 不会取代确定性软件层,而会依托 Salesforce、Box、ServiceNow 等系统的权限、数据和业务规则执行任务,两者采用率可能同步增长。 🔗 链接
🌐 其他热点
- @FinanceYF5:英伟达据报同意以 129 亿美元收购 Hugging Face,若交易落地将把模型生态、开源社区与算力平台更紧密地捆绑在一起。 🔗 链接
- @Google:Google 搜索 AI Mode 新增机票价格与积分追踪及对话式酒店筛选预订,通用搜索正继续侵入 OTA 的决策和交易链路。 🔗 链接
📊 扫描 244 条 | 覆盖 25.1h | 精选 15 条
J 更早 K 更新 G 归档 / 主题