Teigen's Daily
AI Daily · 🤖 AI 信息源

2026-07-17

🎬 YouTube

本轮抓到 1 条新视频,但页面详情获取失败,无法生成可靠摘要,已按规则跳过。

🎙️ 播客

The Lab of the Future Should Feel Like a Data Center — Latent Space

Lila Sciences 把自动化实验室视作“AI 数据中心”:仪器是计算节点,实验编排类似 Slurm 队列,机器人全天候执行实验并用自然规律充当验证器。团队称已积累超过 10 万亿个经实验验证的科学推理 token,并尝试让化学、生物、药物发现和材料科学共享同一套通用模型。节目还讨论了如何将气体吸附测量提速约 2,500 倍,以及物理实验中的奖励作弊、推理轨迹不可靠等现实难题。

🔗 链接

📝 博客

Kimi K3:2.8 万亿参数,以及“鹈鹕基准”还能告诉我们什么

Moonshot 发布 Kimi K3,参数规模 2.8 万亿,并承诺在 7 月 27 日前开放权重。其自报成绩多数超过 Claude Opus 4.8 Max 和 GPT-5.5 High,Artificial Analysis 的长周期知识工作 Elo 达 1547;价格为每百万输入/输出 token 3/15 美元。Simon 的实测也暴露了代价:一个简单 SVG 任务消耗 13,241 个推理 token、成本约 0.25 美元,说明单一“最大推理”档位可能过度思考;文章因此强调,今天更重要的衡量维度是工具调用和长对话可靠性,而非单一图形基准。

🔗 链接

GPT-5.6 意外删除文件:高危组合已被定位

OpenAI 的 Thibault Sottiaux 表示,团队调查了少量 GPT-5.6 意外删文件的报告。问题最常见于同时开启 Full Access、关闭沙箱和自动审查,并让模型改写 $HOME 来充当临时目录时;模型若误删该变量指向的位置,可能直接波及整个用户目录。这是代理式编码工具必须保留沙箱、审查机制并避免复用关键环境变量的具体警示。

🔗 链接

Inkling:Thinking Machines Lab 发布首个开放权重多模态模型

Inkling 是一个总参数 975B、激活参数 41B 的 MoE 模型,以 Apache 2.0 许可发布,并在 45 万亿个文本、图像、音频和视频 token 上训练。团队将它定位为适合定制的开放底座,主打多模态、较高推理效率和可在 Tinker 上微调;另有 276B 总参数、12B 激活参数的 Inkling-Small 仍在测试。它未宣称整体最强,但为美国开放权重生态增加了一个可与中国头部开放模型竞争的新选项。

🔗 链接

不调用真实 API,如何系统测试 Agent Skill

直接做 Skill 评测可能产生巨额调用量、污染线上数据,并因外部状态变化导致结果不稳定;例如 50 个场景、3 个模型、每个重复 5 次,至少会发出 750 次 API 请求。文章建议用 Dev Proxy 根据 JSON 配置拦截真实 URL,并以本地种子数据返回符合 HTTP 语义的响应:Skill 本身无需改 URL,每轮数据可自动重置,也不会触发真实 PATCH/DELETE。核心原则是把 Agent Skill 的评测当作正式工程环节,避免对生产 API 做“集成测试”。

🔗 链接

Quiche Browser 默认关闭带 AI 摘要的搜索结果

Quiche Browser 宣布默认禁用搜索结果中的 AI Overview,转向无 AI 摘要的网页搜索体验。这个小众浏览器的选择反映出一类日益明确的用户需求:希望直接访问原始网页和来源,而不是先经过搜索引擎生成式摘要的重写。

🔗 链接

🗞️ Techmeme 热点

前 AWS 高管 Dave Brown 将加入 Meta,参与数据中心建设

消息称,前 AWS 计算、AI 与平台高级副总裁 Dave Brown 将在未来几周加入 Meta,工作重点是公司的数据中心扩建。此举显示 Meta 仍在加强支撑前沿 AI 训练与推理的基础设施领导层。

🔗 链接

Nadella 批评 Claude Fable 5 的拒答边界“受编辑控制”

据 CNBC 报道,微软 CEO Satya Nadella 在内部会议上批评 Claude Fable 5 受到过强的“编辑控制”,认为它拒绝执行某些“随机事情”的逻辑缺乏合理性。这凸显模型安全边界与通用可用性之间的持续拉扯。

🔗 链接

Demis Hassabis 拟推动美国“前沿级”AI 标准机构

消息称,Google DeepMind CEO Demis Hassabis 下周将在华盛顿与美国政策制定者会面,讨论建立一个总部位于美国、面向“前沿级”AI 的标准机构。议题意味着头部实验室正试图把模型分级与安全规范进一步制度化。

🔗 链接

微软拟推出多模型 AI 安全工具

据 The Information 报道,微软计划本月发布一款 AI 安全工具,同时使用 Anthropic、OpenAI 和微软自研模型,并将其定位为 Mythos 的低成本替代方案。多模型组合表明安全产品正在从押注单一模型转向交叉能力与成本优化。

🔗 链接

MLB 禁止用联盟配发 iPad 调用生成式 AI 做临场决策

MLB 备忘录禁止球队在比赛期间通过联盟配发的休息区 iPad 使用生成式 AI辅助战术决策;消息称此前至少三分之一球队曾这样做。职业体育开始为“赛前分析”和“实时 AI 指挥”划出更清晰的制度边界。

🔗 链接


📊 YouTube 0 条 | 播客 1 条 | 博客 5 条 | Techmeme 5 条 | 精选 11 条

同日其他 — 2026-07-17
J 更早   K 更新   G 归档   / 主题