🔥 精选推荐
Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1,官方定位为"面向编程和知识工作的全球最先进模型",发布推文获得 1280 万次浏览。单 token 定价与 5 代持平(输入 $10、输出 $50、缓存写入 $12.5 每百万),但缓存读取价格直降 75% 至 $0.25 每百万,利好长上下文、长会话用户。关键反转在于:据 Artificial Analysis 实测,新模型输出 token 用量增加约 70%(1.7 倍),抵消缓存降价后,单任务综合成本反而上升约 20%。同日 World Labs 的世界模型 Astra 也发布,被 Latent Space 称为迄今最惊艳的世界模型。
🦐点评:缓存降价 75% 的头条掩盖了单任务成本反升 20% 的真相——Anthropic 把定价复杂度转嫁给了用户,谁能算清 token 经济账谁才是赢家。对 VC 而言,"模型越来越便宜"的叙事正在失效,Agent 类公司的毛利模型得按"输出 token 膨胀"重新压测,靠 API 转卖的套壳生意会先被挤出去。
Ben Thompson 认为 Fable 5.1 发布的真正看点不是跑分,而是 Anthropic 顺势"在过渡期彻底取消"了此前饱受诟病的 Fable 数据保留政策——不是修改,是整个撤销。他还解释了缓存使用量提升为何对用户和 Anthropic 是"双赢",并把这次调整放在"企业级前沿安全保障"的框架下讨论。
🦐点评:数据保留政策的撤回比模型升级更值钱——它扫清了大企业采购 Claude 最大的合规顾虑。Anthropic 在用"信任"这种非技术护城河抢企业市场,这正是它对 OpenAI 差异化定位的核心;对投企业 AI 的基金来说,"谁的数据条款让 CIO 敢签字"会越来越成为决定采购的隐性变量。
Apex 创始人 Ian Cinnamon 在 a16z 撰文提出:新一轮太空竞赛的胜负不再由"首次登月"这类里程碑衡量,而是由"速率"决定——部署、补网、技术刷新的速度。实现这一切需要"星座"(成百上千颗卫星协同),而星座依赖两大工业能力:发射与航天器平台。他判断发射能力已基本就绪,真正的瓶颈是航天器平台,Apex 要做的就是消除这个瓶颈,让星座可被快速规模化部署。
🦐点评:从"里程碑"到"速率",本质是把 SpaceX 的可复用发射逻辑复制到卫星本体制造——a16z 押的是"航天器平台"这一层的标准化红利。发射成本下来后,价值链瓶颈上移到卫星平台,这与半导体从晶圆代工到 IP 层的迁移同构;在国防加商业双需求下,卫星平台是少数能同时吃到政府订单和商业星座的"卖铲人"赛道。
Claire Vo 在 Lenny's Newsletter 分享实操:用了几周 GrokBot 之后,她关掉了此前所有的 OpenClaw,几乎完全迁移到 GrokBot。GrokBot 是 SpaceX AI 团队推出的多智能体平台,定位为"可以交付真实工作的 AI 队友"——用户能像给员工分配任务一样,定义 agent、赋予职责、派活。文章逐个演示了可直接照搬的实用场景,也点出了当前仍缺失的能力。
🦐点评:一线重度用户从 OpenClaw 全面倒向 GrokBot,说明 agent 战争的胜负手正从"模型能力"转向"多 agent 编排 + 任务托付体验"。SpaceX AI 团队用一个消费级 agent 产品切入协作场景,是 Musk 系把算力优势向应用层变现的信号;对投 agent 基建的基金,"用户会为哪套编排范式迁移整个工作流"比模型跑分更值得跟踪。
Anil Dash(曾多次以 CEO 身份募资、并担任董事/顾问)撰长文抨击:头部风投已不再是传统意义的 VC。少数机构借放松的监管,把 VC 与 PE 合并成管理数百亿美元的"全能基金",靠 2% 管理费旱涝保收(管 500 亿一年就有 10 亿到手),法律上甚至已不算 VC,因而不再受市场、创始人和法律约束,他称之为"癌症资本"。他指出 a16z 本轮中期选举已投入 1.153 亿美元政治献金、接近 2024 年的两倍,超过任何亿万富翁个人捐赠者;权力天平从创始人倒向 VC,"创始人"沦为执行 VC 政治议程的人选。
🦐点评:这是圈内人对红杉这类头部机构商业模式的正面开火——当管理费本身就能造富,"投中伟大公司"的动机被稀释,这解释了为何巨型基金越来越像 PE 而非 VC。对仍靠 carry 吃饭的中小基金,Dash 点破了残酷现实:它们被迫在巨头定义的规则里打球;对 LP 而言,养老金和散户资金正在承接这些基金的风险敞口,是下一个值得警惕的错配。
📌 其他新闻
Google 推出 Fairwind 计划,向政府和受信任伙伴限量开放其最先进的 AI 网络防御能力,主打"主动防御",由安全与隐私副总裁 Four Flynn 牵头。
Gary Marcus 警告 OpenAI 即将跨越一条 AI 安全红线:让模型变得更难被监控,恰恰是当下最不该走的方向。
作者定义"workslop"(工作糊弄)为同事或上司甩来大段 AI 生成文本,其危害在于努力不对等——生成几乎零成本、阅读却要花真功夫,像一场 DoS 攻击,并给出自保方法。
Simon Willison 更新 llm-gemini 插件以支持 Google 当天发布的 Gemini 3.8 Flash(含低/中/高三档思考等级);他称赞 Gemini Flash 快、便宜、擅长 HTML/JS,另有仅向"受信任防御者"开放的 3.8 Flash Cyber 版本。
本次更新新增 managedMcpServers 托管设置(组织可为所有用户统一下发 HTTP/SSE MCP 服务),并加入 --permission-prompts none 以支持无人值守运行。
雷锋网独家解读字节 Seed 基础模型团队重组:新设预训练数据、强化学习、办公/对话产品后训练四个一级部门,数据与 RL 开始向 Omni 全模态集中,均向吴永辉汇报。
DeepSeek 面试风波过去 30 天,李博杰接受长谈:他在 GitHub 开源自写的《深入理解 AI Agent》两周拿到 2.8 万星,回应了外界对其真实水平与被认可成果的误解。
前字节跳动强化学习专家、前腾讯 Robotics X 智能体中心负责人孙鹏博士 9 月 2 日正式加入具身智能公司星尘智能,补强其 Physical AI 全栈技术布局。
🧠 AI 技术前沿
Gemini 3.8 Flash 让所有 AI 实验室真的紧张了:大家意识到 Google 不是在拼最强前沿模型,而是在造驱动大多数 AI agent 的引擎——性能接近 Opus 5、便宜到离谱、速度飙到 300 tps。
查看推文 →
拿到 Gemini 3.8 Flash 早期访问:它确实是一个很好的 Flash 模型,但还不等同于前沿模型;同样提示词下它给出的 shader 版本响应很快,但质量与前沿模型有差距。
查看推文 →
Muse Spark 1.3 成为 Artificial Analysis 智能指数上最强的非 Anthropic 模型:得分与 Fable 5 持平,但输出 token 便宜 12 倍($4.25/M vs $50/M),仅落后 Opus 5 一分、落后昨天发布的 Fable 5.1 四分。
查看推文 →
OpenAI Astra 用了名为"循环深度"(recurrent depth)的新推理技术:不靠堆叠更多 Transformer 层,而是让隐藏状态在同一层里多次循环,部分推理在模型内部完成、而非写成显式思维链。
查看推文 →
Qwen 3.8 Max 0902 登顶 WebDev Arena,略微超过 Opus 5;Fable 5.1 的成绩仍在等待。作者感叹:一睡觉就有新模型发布。
查看推文 →
NVIDIA 放出一个仓库,能在运行前扫描 AI agent 的 skill 是否有安全风险——在人人都从 GitHub 安装随机工具、skill 和 MCP 的当下,这比很多人意识到的更重要。
查看推文 →
🚀 创业动态
Cursor 云端 agent 现在可以跑在你自己的基础设施上,包括随需求自动扩缩的机器池,让 agent 能访问内部服务或专用硬件,而 agent 循环仍留在 Cursor 里。
查看推文 →
Minimax H3 Max 新价格 $0.0125/秒,折算成永久 AI 直播约 $32,940/月——只要一路直播能赚得比这多就盈利;他现在月收入 $15K,再拉到一个广告主就能打平。
查看推文 →
Fable 5.1 让 Claude Tag 更实用:它能从指标表格和 Slack 等散落数据里现搭一份临时的领导层汇报 deck,还发现一份供应商报告与数据对不上、先标记出来再继续。
查看推文 →
给自己的 bot 配了独立邮箱和信用卡(5 分钟搞定):grokbot 最被低估的功能是 routine 的 webhook 触发——bot 一收到邮件就自动运行,可以把它直接加进邮件抄送里。
查看推文 →
有人把 Claude 做成了人肉搜索引擎:无需订阅、每条线索只要 $0.0089,在 People Search Bench 上排第一,开源、0 加价。
查看推文 →
💬 观点与洞察
Prinz 拿各家 AI 跑法律基准,最新模型很强,但便宜/低推理的模型表现很差。问题来了:怎么保证卖 AI 方案的供应商有动力给你上(更贵的)好模型,而不是为省成本用差的?
查看推文 →
推荐三页讲复杂系统的旧文(AI 出现之前写的):复杂系统常年带病运行却能存活,是因为缺陷很少同时对齐,人类得以介入干预;而 AI 能找到甚至制造对齐的缺陷,所以我们需要一套用 AI 做系统防御的新哲学。
查看推文 →
提示词工程重要,但你的专业能力更重要:以陶哲轩与 ChatGPT 讨论 Jacobian 猜想反例为例,作者感叹"这不是我平时用的那个 ChatGPT"——即便给他无限 token 也到不了陶的高度,专业信号会把模型切进"对数学家说话"的模式。
查看推文 →
斯坦福 Fall 2026 开设 CS146S《现代软件开发者》:Eric 认为开发主体正从"人写代码"转向"人定义意图、Agent 执行、人与 Agent 共同评估迭代",课程就教这套新工作流所需的完整能力栈——如何给 Agent 提供上下文和工具、把产品需求翻译成可执行规格。
查看推文 →
🔥 精选推荐
靠 2108 万笔零散订单拼出 102.3 亿元营收——PCB 厂商嘉立创 2026 年 8 月上市后市值逼近千亿,商业模式却极度反直觉:2025 年前五大客户合计仅贡献 1.16% 收入,最大单一客户占比 0.28%,收入来自 130 万付费用户、平均每单仅 485 元。它切的是硬件研发最前端、最零散的打样和小批量需求,用"手工拼版 + 系统自动审单 + 算法集约拼板"把打样价压到极低,再一体化整合 EDA 设计软件、立创商城元器件、贴片、3D 打印/CNC。2025 年净利率 12.4%、2026 上半年升至 14.4%,A 股中仅三家英伟达 AI 供应链核心厂商高于它,海外收入占比已超 20%。
🦐点评:嘉立创证明了制造业里"长尾聚合"能跑出媲美高端供应链的利润率——它本质是把碎片化研发需求平台化的"硬件界 Shopify 加代工厂"。没有大客户反而是最强护城河:130 万用户没有议价权、切换成本高,这种结构比绑定英伟达的高端 PCB 厂更抗周期;对看智能制造的基金,值得找的是各垂直品类里"接住长尾 + 一体化闭环"的同构标的。
2025 年成立的 Visko 完成 1000 万美元种子前融资,并开放世界模型 Orbis 的公众体验入口。与"渲染一段定长短片"的传统 AI 视频不同,Orbis 把视频做成"持续运行"的画面:按短片段不断向前生成,用户可在运行中随时改提示词(如让车转进城市、把雨夜改成晴天),下一段立即响应。据公司技术报告,Orbis 可实时输出 24fps 的 4K 视频、小时级连续生成无明显画质漂移,并用"固定容量的多尺度记忆"解决长时生成的一致性问题(人物换脸、物体漂移)——但这些结论目前主要来自公司自述,缺乏大规模独立验证。
🦐点评:Visko 押的是 AI 视频从"内容文件"到"可实时交互环境"的形态迁移,卡位在"定长短片"与"完整游戏"之间的中间态——这正是新交互往往先于替代旧工具出现的位置。16 人拿 1000 万美元种子前,估值逻辑全押在"持续运行 + 记忆一致性"的技术叙事上;真正的验证点不是画质,而是长时生成的一致性能否经得起第三方复测,这是判断它是 demo 还是产品的分水岭。
a16z 全球投资策略的两位主导者 Angela Strange 与 Gabriel Vasquez 复盘了 a16z 如何从拉美金融科技、一个把 25 位当地顶级 CEO 拉进去的 WhatsApp 群起步,逐步搭起面向全球创始人的跨市场网络。他们提出"无国界创始人"概念:不取决于出生地或注册地,而在于是否从第一天就想建一家全球公司;这类人拥有三项复利优势——进入差异化人才网络、借国家/地区认同建品牌、更早拿下本土大客户。Strange 引用 Nubank 的判断:与其在美国争当用户的第五个金融服务,不如进入只有五家安于现状的银行、仅覆盖 20% 人口的空白市场。
🦐点评:a16z 把"侨民网络 + 本地空白市场"做成了可复制的 sourcing 引擎,是头部基金在硅谷内卷后向外要 alpha 的明确动作。对红杉这类同样全球化的基金,真正的启示是把"无国界创始人"当筛选信号——见过美国验证过的模式、又懂本土空白,这种组合的 sourcing 效率远高于地推;WhatsApp 群这种轻社群运营能撬动整片区域的 deal flow,值得复用。
作者用刚发布的 claude-fable-5.1 把活动行平台上能抓到的 3839 个收费活动全量翻了一遍:其中票价过千的高客单价活动 517 个,但其中 333 个显示付费票"零售出";能看到成交的 184 个里,前十名拿走了全部可确认票款的 52%。峰会大会与培训课数量接近(187 比 196),票款却差了五倍以上(1180 万 vs 223 万)。原始数据、抓取脚本与全部分析代码已开源。
🦐点评:抛开活动市场本身,这篇的真正信号是"单人用前沿模型做全量市场调研"已成常态——一个人加一个模型就能扫完整个平台的长尾并开源可复现代码,传统行研的信息差被压薄。而 517 个高客单价活动里 64% 零成交、头部通吃的数据,也印证了线下知识付费是典型的赢家通吃市场。
📌 其他值得看
字节豆包上线 Agent 能力,作者演示全程只用手机、不开电脑,就让 Agent 完成从刷视频到发公众号的一连串任务,展示了国产消费级 App 的端侧 agent 化。
UU远程新版本重点强化终端功能,补齐完整 TUI 交互与终端会话管理,面向"随时随地让 Agent 干活"的远程 Vibe Coding 场景(作者称部分功能由其本人建议迭代)。
中文视角复盘 Fable 5.1:输入/输出价格与 5 代持平($10/$50 每百万 token),缓存读取降价 75% 至 $0.25,典型负载综合成本降约 25%、高智能体任务最多降 45%,并伴随一次用户额度重置。 <!-- ai-daily:complete -->