↓ 下拉刷新

📊 今日更新摘要 · 生成于 2026-07-03 23:41

🐦 X 推文 · 今日 +117 / 累计 9,412
📝 简报卡片 · 今日 10
📚 深度洞察 · 今日 25 / 14 天 137
📢 官方公告 · 今日 1 / 14 天 37
📦 产品榜 · 今日 269
🇨🇳 即刻 /cn/ · ✅ 今日 07-03 23:36(2242 KB)
🛠 Builder /builder/ · ⚠️ 今日未生成(保留前一日)

📰 今日主编早报

主编已扫 · 推文 10 / 长文 15 / 产品 45 · 2026-07-03 07:15:00

🔴 必看 · 3 个主议题

1

AI 成本经济学正在被重写——路由工程是降本第一杠杆

三组独立数据在同一周指向同一结论。Tomasz Tunguz 计算出 Anthropic 推理与训练支出已达工资总额的 2.3 倍,折合每名员工约 200 万美元/年算力成本。Coinbase 宣布将 AI 支出削减 50%,成为企业 AI 投入 ROI 清算的早期信号。Tunguz 另一篇分析指出,70-80% 的 Agent 流量可通过路由工程跑在本地模型上,成本降低 90% 以上。

我认为这是 AI 行业从「增长不计成本」转向「成本即战略」的拐点信号。用芒格的逆向思维模型来看:过去两年大家问的是「用不用 AI」,现在问题已经变成「每花一块钱 AI 成本,能量化出多少业务产出」。Coinbase 削减 50% 不是个例——当 B2B AI 服务的 ROI 清算时刻到来,没有可量化产出指标的 AI 投入都将面临预算压缩。Tunguz 的路由洞察更值得重视:大多数团队的第一个决策是选模型,但正确顺序应该反过来——先设计路由器,决定哪类请求走哪个模型。这不是工程偏好,是成本结构问题。Sonnet 5 新 Tokenizer 使英文 token 消耗增加约 42%(中文几乎不受影响),进一步说明 token 经济学已成为产品定价和利润率的核心变量。CIO 资金流向数据也在印证这一判断:基础设施与开发工具估值暴涨 68.5%,而基于席位计价的应用软件暴跌 36.2%——市场在用真金白银告诉你,AI 时代的价值在基础设施层,不在应用层。
🎯 商业机会雷达

缺口绝大多数企业的 AI 部署缺乏成本工程意识——没有路由器、没有分级调度、不区分实时与异步任务,所有请求打到最贵的模型上。中国中小企业主对 AI 成本结构的理解接近于零。

你能切两个切入点。第一,为自己的项目(AI 全球风向标、引流宝内容生成)建立路由工程范式:用 Haiku/本地模型处理 70% 常规任务,Opus 只处理高价值判断——这本身就是可复用的方法论。第二,将「AI 成本审计」作为知识付费选题测试:帮中小企业主理解自己的 AI 支出结构,找出浪费的 80%。与你「不创新先模仿」的哲学一致——不需要原创框架,把 Tunguz 的路由方法论翻译成中国中小企业主能听懂的语言。

何时动手现在在自己项目中实验路由分级。3 个月后若跑通且数据好看,再考虑是否作为知识付费内容输出。不急于商业化,先吃自己的狗粮。

风险/本分方向本分。风险在于:AI 成本审计作为知识付费选题偏技术向,受众面窄于引流宝类通用选题。但如果只服务「用 AI 构建公司的 CEO」这个细分群体,反而精准。子弹容错率高——实验成本几乎为零,只是时间投入。

🔭 长镜头5 年后回看,2026 年中是 AI 行业从「算力军备竞赛」转向「算力效率竞赛」的分水岭。正如 PC 时代从追求 CPU 主频转向追求性能功耗比,AI 竞争维度正从「谁的模型最强」滑向「谁用最低成本解决问题」。段永平说的「不要因为走得太远而忘了为什么出发」——绝大多数企业的 AI 投入正在偏离初始目的,成本工程化将是回归本分的必经之路。
📖 看原文🔬 实验 · 在 daily_brief.py 中实验分级路由:briefs 简报摘要用 Haiku 处理,仅主议题分析用 Opus,记录成本差异和质量对比💬 约聊 · 关注 Tunguz (@ttunguz) 后续关于 AI 成本工程的系列文章📌 研究 · 「AI 成本路由工程」方法论 + Coinbase AI ROI 清算案例复盘 + Sonnet 5 Tokenizer 成本影响评估
2

AI 工具穿透非工程师边界——组织效率分水岭已至

两个独立数据源同时揭示同一趋势。Anthropic 内部工具 Claude Tag 已从工程部门扩散至产品、数据、销售、营销,AI 版本承担了 65% 的产品 PR 提交。Gergely Orosz 亲访 OpenAI 后报告:95% 的非工程师已在使用 Codex,云端 Agent 时代正式到来。Boris Cherny 同日宣布 Claude Code Artifacts 向 Pro/Max 用户扩展开放。

我认为这是 AI 应用史上最重要的拐点之一:编程工具不再是工程师的专属品。用 Aggregation Theory 分析,Claude Tag 和 Codex 正在消解「会写代码」这道组织内部准入门槛——当销售、营销、产品经理都能通过 AI 提交代码级变更,软件开发的供给侧正在被重构。Anthropic 选择此时公开 Claude Tag 的内部故事,是经典的「内部工具→公开案例→产品化」路径——Slack 和 Notion 都走过这条路。Boris Cherny 亲自出镜讲述从 Claude Code 到 Claude Tag 的演进,CPO Mike Krieger 同日在 X 上晒使用场景,这不是碰巧——这是一次有计划的产品预热。Claude Tag 的商业化版本可能在 Q3-Q4 到来。Gergely Orosz 在 OpenAI 内部观察到的 95% 非工程师使用率更值得警醒:如果你的非工程师团队还没有这样的工具渗透率,你与顶尖 AI 公司的组织效率差距正在每天扩大。
🎯 商业机会雷达

缺口绝大多数中国企业还停留在「让工程师用 AI 写代码」的阶段。没有人系统性地帮非工程师使用 AI 编程工具——这是一个巨大的教育和工具市场空白。

你能切你 10 年运营实战经历本身就是最好的资质——你不是工程师出身,却在用 Claude Code 构建完整项目,这恰好就是「非工程师用 AI 编程」的活样本。两个方向值得考虑:一是将你自己从运营人到 AI 开发者的转型路径结构化,作为知识付费内容测试(对标引流宝课程方法论);二是关注 Claude Tag 商业化后的第三方生态——如果 Anthropic 开放 Claude Tag 给企业,谁来帮中小企业落地部署?这可能是服务机会。但注意你的第三哲学「不干涉用户因果」——做轻交付教程可以,做重交付企业陪跑不行。

何时动手Claude Tag 商业化前(预计 Q3-Q4),先观察产品形态。现在可做的是:记录自己作为非工程师使用 Claude Code 的方法论和踩坑经验,为未来内容输出积累素材。这是零成本的先手准备。

风险/本分轻交付教程方向本分,子弹消耗低。风险在于 Claude Tag 是否真的开放给外部企业——如果 Anthropic 只做自用工具不商业化,服务机会不存在。但「非工程师 AI 编程」教程的需求与 Claude Tag 是否商业化无关,需求是确定的。

🔭 长镜头回看历史,每一次工具民主化都带来一轮巨大的价值重分配。Excel 让非财务人员能做财务分析,WordPress 让非工程师能建网站,Canva 让非设计师能做设计。Claude Tag / Codex 正在做的是同一件事:让非工程师能构建软件。5 年后,「会不会写代码」将不再是核心竞争力,「能不能定义问题并验证 AI 的输出」才是。这与段永平的「本分」哲学暗合——核心能力永远是理解业务本质,工具只是放大器。
📖 看原文🔬 实验 · 记录本周使用 Claude Code 完成的 3 个非工程类任务(内容生成、数据分析、流程自动化),评估「非工程师 AI 编程」教程选题的可行性💬 约聊 · 持续关注 Boris Cherny (@bcherny) 关于 Claude Tag 的后续动态;Gergely Orosz (@GergelyOrosz) 的企业走访系列📌 研究 · Claude Tag 商业化路径追踪 + 「非工程师 AI 编程」知识付费选题调研 + 中文市场竞品扫描
3

Agent 框架军备竞赛——谁建基础设施谁拿下一轮入场券

AI 工程师世界博览会(AIEWF)最后一天,Agent 基础设施成为焦点议题。Vercel 首席软件官 Andrew Qu 宣布从 v0 产品痛点中孵化出 Agent 框架 eve,并提出 skills.sh 标准化 Agent 技能的发现和复用。Adobe 首席科学家展示 Agentic Site 原型——网站为每位访客实时组装专属页面。AIEWF 核心辩论聚焦于 AI 自主编程循环是否已具备实用价值,正反双方激烈交锋。

我认为 Agent 正在经历从「技术 demo」到「基础设施争夺」的相变。用第一性原理剥开:Agent 的核心瓶颈不是模型能力(已经够用),而是三件基础设施——可复用的技能标准(Vercel skills.sh)、结构化的上下文管理(上下文基础设施)、和可预测的成本控制(路由工程,与 A1 呼应)。Vercel 的策略值得注意:他们不是在做 Agent,而是在做「让所有人能做 Agent」的平台——这是经典的 Aggregation 打法,与 AWS 早年做「让所有人能做云」的逻辑一致。Adobe 的 Agentic Site 代表另一个方向:Agent 不仅是内部效率工具,也将改变面向用户的产品形态。当网站能按每个访客的意图实时组装内容,传统 CMS 和 A/B 测试的逻辑将被彻底颠覆。AIEWF 的辩论提供了冷静校准:自主编程循环的「技术可行」与「规模经济可行」是两个独立问题,当前阶段更适合小范围试点。
🎯 商业机会雷达

缺口Agent 生态正在分化为两层:上层是各种 Agent 应用(太多人在做),底层是 Agent 基础设施(框架、技能标准、上下文管理、成本控制)——后者严重供不应求。对独立开发者来说,做 Agent 应用已经拥挤,做基础设施的工具或方法论教程才是差异化方向。

你能切你不需要去造 Agent 框架(那是 Vercel 级别的事)。但两件事可做:一是把自己用 Claude Code + MCP + Agent 工作流构建项目的经验,沉淀为「独立开发者 Agent 基础设施选型指南」——这种实操经验在中文世界几乎空白。二是关注 Adobe Agentic Site 的方向,思考引流宝 / 育儿宝落地页是否可以用 Agent 化的方式做千人千面——不需要 Adobe 技术栈,用 Claude + 结构化内容库就能实现 MVP。

何时动手Vercel eve 和 skills.sh 还在早期,适合跟踪不适合 all in。Adobe Agentic Site 的思路可在现有项目中小范围实验——用 Claude 根据访客来源动态生成不同版本的页面文案,成本极低,本周就可以动手。

风险/本分Agent 基础设施选型指南属于知识付费轻交付,本分。千人千面落地页实验成本也低。主要风险是 Agent 生态变化太快,内容容易过时——需要判断做「常青方法论」还是「时效工具评测」。建议先以自用实验为主,方法论成熟后再考虑内容化。

🔭 长镜头Agent 基础设施争夺让人想到 2010 年代初的云计算竞赛。AWS、GCP、Azure 的胜负在于「谁的基础设施让开发者最容易上手」——不是谁的服务器最多。Agent 时代的类比是:谁的框架让 Agent 最容易被构建、部署、监控和计费,谁就拿下这个时代的 AWS 位置。乔布斯在《乔布斯传》里说过,真正的创新往往发生在技术和人文的交叉口——Agent 基础设施的竞争本质也是如此:不是谁的技术最强,而是谁最理解开发者需要什么。
📖 看原文🔬 实验 · 在引流宝落地页做一个简单实验:用 Claude 根据 utm_source 参数动态生成 3 个版本的页面标题和副标题,测量转化率差异💬 约聊 · 关注 swyx (@swyx) 关于 AIEWF 后续报告 + Andrew Qu 关于 eve 框架的更新📌 研究 · Vercel eve 框架 + skills.sh 标准 + Adobe Agentic Site 技术细节 + AIEWF State of AI Engineering 年度报告

🟡 知道就行 · 11 条扫读

  • Chollet:当前 AI 不会引发大规模失业·「@fchollet」ARC-AGI 发起人认为当前模型是记忆与插值而非真正推理,就业替代被高估(非新论点,但校准预期有用)
  • Perplexity CEO:本地模型最佳场景是个人机器人·「@AravSrinivas」隐私驱动边缘推理成为机器人赛道结构性选择,但离商业落地尚远(跟踪即可)
  • xAI Grok Build 集成 Railway 沙箱·「@xai」开发者工作流渠道卡位,非技术突破,coding agent 赛道又添一个选手(噪音偏多)
  • Kent Beck:AI 时代核心职责是积累信任·XP 创始人警告代码积累速度远超信任积累速度——反直觉但重要的提醒(播客 45 分钟,扫要点即可)
  • Geoffrey Litt「理解才能参与」框架·与 AI Agent 协作时不深入理解代码会积累认知负债——对管理工程师团队有参考价值(非战略级)
  • Simon Willison 用 Fable 5 两轮对话构建 coding agent·「@simonw」llm-coding-agent 0.1a0 发布至 PyPI,展示 AI 构建 AI 工具的闭环速度(能力边界展示,非商业信号)
  • Fable 出口禁令解除 + 前沿模型管控讨论·美国政府已将前沿 AI 模型视同出口管制物资,政策反复暴露决策层缺乏共识(合规提醒,非即时行动项)
  • Codex Agent 97 秒自主完成出租车预订·Ben Tossell 实战拆解:上下文 + 工具 = Agent 自主完成任务,验证了 Agent 工程范式(场景验证,非新方法)
  • Simon Willison 征集 Fable 最有野心的用例·「@simonw」社区晴雨表式征集,回复中可低成本获取一批真实 Fable 使用案例(不急,回头扫一眼即可)
  • Glaze by Raycast:AI 聊天创建原生 Mac 应用·PH 日榜第一(332 票),Raycast 团队出品——AI 原生应用生成方向的新产品,但生态锁定在 Mac(观察)
  • swyx 观察:AIEWF 掌声最热是谈心理健康·「@swyx」AI 工程师社区形成新共识——高增长与心理健康不对立,人才吸引的软性信号(文化趋势,非商业信号)

🟢 深挖线索 · 5 条

提供了 AI 成本经济学的基准数字(顶尖公司 8.9 万美元/人、中位数 1.37 万美元/人),直接关联三多哥「AI 给行业带来什么商业机会」的核心思考——成本审计选题的数据基础在这里。

如果 Agent 技能可被标准化发现和复用,将大幅降低 Agent 开发门槛。三多哥若要做「独立开发者 Agent 选型指南」,eve 的设计决策和 skills.sh 的标准是必须研究的素材。

GitHub 周榜第二(201 stars),支持 158+ 语言的毫秒级索引。对 AI 全球风向标项目有直接工程价值——可增强 Claude Code 对项目代码库的理解能力,值得评估是否集成。

网站按访客意图实时组装个性化页面——这与引流宝落地页优化直接相关。如果用 Claude + 结构化内容库能实现类似效果,将是一个成本极低的竞争力提升。

开源与闭源差距持续收窄,混合部署正在成为严肃选项。三多哥的 AI 全球风向标若要降低对 Claude Max 的单一依赖,了解本地部署的工程现实是必要的预研。


🔥 Claude Tag 发布

2最高 8.6
@_catwu · 2026-07-03 01:17
8.6
@_catwu
Cat Wu · 0 followers
L3 市场反馈 Claude Tag
Claude Tag 正在解锁我们整个组织的生产力:工程、产品、数据、销售、营销均已覆盖。我们的内部版本承担了 65% 的产品 PR,我们共同……(原文截断)
Claude@ClaudeAI · 2026-07-03 00:54
7.6
Claude
@ClaudeAI · Claude · 0 followers
L5 商业动作 Claude Tag 🎙 播客
关于从 Claude Code 到 Claude Tag 的路径,以及它如何从工程部门扩散至 Anthropic 其他部门的对话——Boris Cherny 与 Cat Wu 共同讲述……(原文截断)

🔥 Claude Code Artifacts 向 Pro/Max 扩展

2最高 7.8
鲍里斯·切尔尼@bcherny · 2026-07-03 04:20
7.8
鲍里斯·切尔尼
@bcherny · Boris Cherny · 424K followers
Anthropic Claude Code 产品负责人,主导这款 AI 编程工具的产品决策;推文常分享 Claude Code 的使用技巧、产品思路和更新预告,是了解第一手产品方向的信源
L3 商业动作 Claude Artifacts
Boris Cherny(Claude Code 产品负责人)原文:Claude Code 中的 Artifacts 功能改变了我的工作方式。很兴奋能将其扩展至 Pro 和 Max 用户!
麦克·克里格@mikeyk · 2026-07-03 05:29
6.8
麦克·克里格
@mikeyk · Mike Krieger · 0 followers
L2 市场反馈 Claude Artifacts
Mike Krieger(Anthropic CPO,Instagram 联创)原文:这是我们近期最喜欢的产品之一,今天我用它将一组复杂的实验条件与逻辑可视化,并传达给团队……(推文被截断)。结合同日 Boris Cherny 宣布 Claude Code Artifacts 扩展至 Pro/Max,此处所指疑为 Claude Code Artifacts 功能。

🔥 Grok Build Railway 集成

1最高 5.4
@xai · 2026-07-03 01:46
5.4
@xai
xAI · 0 followers
L5 商业动作 Grok Build
Grok Build 现已安装在 Railway 沙箱中。

🔥 AI Engineer World's Fair 2026

1最高 3.6
@swyx · 2026-07-03 03:12
3.6
@swyx
swyx · 154K followers
Latent Space 主理人、AI Engineer 大会创办者;定义 AI Engineer 职业概念
L4 商业动作 AI Engineer 大会
swyx 原文:大家都来 AIE 博览会吧,12 点半,会有一个特别的【闪现惊喜】(你看到就知道了),然后去 Expo Stage 2 参加……(被截断)。