Teigen's Daily
AI Daily · 🤖 AI 信息源

2026-07-07

🎬 YouTube

Matthew Berman:Cut your AI cost IN HALF (EASY)

这期视频聚焦 AI 使用成本优化,标题指向通过较简单的方法降低模型调用或工具使用成本。适合关注个人/小团队 AI 工作流成本的人,重点可能在模型选择、调用策略或替代服务上。
🔗 链接

Weights & Biases:W&B Weave: Observability and continuous improvement for production agents

Weights & Biases 这期介绍 Weave 在生产级 Agent 上的可观测性与持续改进能力。重点是把 Agent 运行过程、评估、调试和迭代闭环产品化,对正在做 Agent 工程化的人比较有参考价值。
🔗 链接

🎙️ 播客

无近期更新。

📝 博客

Simon Willison:tencent/Hy3

Simon 记录了腾讯 Hy 团队发布的 Hy3:一个 Apache 2.0 许可的 295B MoE 模型,活跃参数 21B,MTP 层参数 3.8B。模型上下文长度 256K,完整权重约 598GB,FP8 量化版约 300GB,并在 OpenRouter 上限时免费开放到 7 月 21 日。
🔗 链接

Terence Eden:I'm just so bored of AI

这是一篇强烈的 AI 疲劳感短文,作者把当下关于 AI 的狂热和反 AI 说教都视为同一种令人厌倦的噪声。它的价值不在技术细节,而在提醒:AI 讨论已经进入社交疲劳期,传播方式和语气本身会影响人们是否愿意继续听。
🔗 链接

Martin Alderson:GLM 5.2 and the coming AI margin collapse (part 1)

Martin Alderson 认为 AI 经济学真正重要的变化不在训练成本,而在推理成本和毛利结构。文章以 GLM 5.2 为切入点,判断开放权重模型正在接近 Opus/GPT 级别体验,这可能压缩前沿模型 API 的高毛利空间;他也指出 GLM 5.2 目前偏慢且无视觉能力。
🔗 链接

🗞️ Techmeme 热点

OpenRouter:美国公司使用中国 AI 模型的 token 占比自 2 月以来每周超过 30%

OpenRouter 数据显示,自 2 月 8 日以来,中国 AI 模型在美国公司 token 使用量中的占比每周都超过 30%,峰值达到 46%,而此前 12 个月只有 11%。这说明中国开源/开放模型在企业真实调用中的渗透速度很快。
🔗 链接

阿里 Qwen 已成 AI 强势模型,但商业化仍有挑战

报道认为,阿里 Qwen 系列让阿里成为全球 AI 模型竞争中的重要玩家,但其全球流行度尚未稳定转化为利润。核心矛盾是开源/低价模型带来影响力,也会压低直接商业化空间。
🔗 链接

OpenAI、Anthropic 等顶级 AI 实验室向创业公司提供 token credit 和促销

顶级 AI 实验室正在用 token credit 和特殊促销吸引创业公司,以争取长期企业收入流。这说明模型供应商竞争已经从单纯能力比拼,进入开发者/企业客户锁定阶段。
🔗 链接

Wikipedia 面临 MAGA、AI 和外国威权压力,Wikimedia 新 CEO 被聚焦

纽约时报报道 Wikimedia Foundation 新任 CEO Bernadette Meehan 的背景与挑战。Wikipedia 正同时面对政治压力、AI 内容生态冲击,以及外国威权环境下的信息治理问题。
🔗 链接

Anthropic 研究者详解 Claude 的 J-space 内部表征

Anthropic 研究者介绍 J-space:Claude 中一小组神经模式,能揭示模型输出中未直接呈现的内部思考痕迹。这类研究对模型可解释性、监控隐藏意图以及安全评估都有潜在意义。
🔗 链接


📊 YouTube 2 条 | 播客 0 条 | 博客 3 条 | Techmeme 6 条 | 精选 10 条

同日其他 — 2026-07-07
J 更早   K 更新   G 归档   / 主题