2026-09-22
🎬 YouTube
Grok 4.7 来了:Elon 是否已经追上?
Matthew Berman 围绕 Grok 4.7 的发布展开评测,核心问题是新版本是否已经追上头部模型。视频把焦点放在实际能力差距,而不只是版本号升级,适合关注 xAI 模型迭代与竞争格局的人。
CoreWeave 首套 NVIDIA Vera Rubin NVL72 机架亮相
Weights & Biases 展示 CoreWeave 的首套 NVIDIA Vera Rubin NVL72 机架。内容聚焦下一代 AI 基础设施的整机形态,以及云算力厂商如何部署高密度 NVIDIA 系统。
🎙️ 播客
Jev:面向生产环境的 System One 模型,而非“万能神模型”
Latent Space 对话 TypeSafe AI CEO Diogo Almeida,主题是 Jev 所代表的 System One 模型。它强调针对生产决策任务构建快速、专用的模型路线,与追求通用能力和大规模推理的“万能模型”方向形成对照。
📝 博客
Jev 提出一种新的 LLM 形态:System One / Decision Models
Simon Willison 介绍 Jev 所称的“System One”模型,也称 Decision Models。这个概念把重点放在快速完成特定决策,而非让模型执行冗长推理,指向一条面向低延迟生产任务的模型路线。
Cloudflare Python Workers 正式全面可用
Cloudflare 的 Python Workers 已进入 GA 阶段,意味着 Python 运行时从预览走向可用于正式生产。对 AI 应用开发者而言,这扩大了在边缘环境中部署 Python 服务和轻量推理工作流的选择。
用智能体迭代,把 Rust 代码优化到超过顶尖库
minimaxir 记录了一次以编码智能体反复优化 Rust 性能的实验,目标是让实现快于现有先进库。文章关注的不只是生成代码,而是让智能体围绕基准测试持续定位瓶颈、改写实现,展示 agentic iteration 在性能工程中的用法。
新版 AI Siri 的 125 项测试
David Pogue 用 125 项测试系统考察新版 AI Siri,而不是依赖少量演示判断效果。大量测试的价值在于同时观察能力覆盖、稳定性与失败边界,为评估苹果 AI 助手的真实可用性提供更完整样本。
🗞️ Techmeme 热点
阿里计划训练 5 万亿至 10 万亿参数 AI 模型
阿里巴巴 CEO 吴泳铭表示,公司计划训练参数规模达 5T—10T 的 AI 模型,并将推进模型、芯片和数据中心的整体布局。
阿里平头哥发布真武 V900 AI 加速器
平头哥称真武 V900 的性能达到上一代的三倍,并可扩展至最多 50 万颗芯片组成的集群,凸显阿里在自研 AI 算力上的投入。
腾讯发布混元图像 3.5 Preview
腾讯称混元图像 3.5 Preview 在内部测试中的表现可媲美字节跳动 Seedream 5.0 Pro,国内图像生成模型竞争继续升温。
多所大学停用 AI 检测器
由于误报加剧师生之间的不信任,一些大学已经禁止使用 AI 内容检测器;部分教师甚至直接取消了写作作业。
Apple 在与 OpenAI 的诉讼中寻求审查取证材料
Apple 请求法院允许其专家审查案件使用的取证镜像,并索取与 OpenAI 部分硬件研发有关的文件,争议进一步延伸到研发证据层面。
📊 YouTube 2 条 | 播客 1 条 | 博客 4 条 | Techmeme 5 条 | 精选 12 条