🔥 精选推荐

Codex 活跃用户在 7 月 14 日达到 700 万,GPT-5.6(7 月 9 日发布)上线后一天内净增约 100 万。OpenAI 的 Fidji 3 月披露 Codex 有 200 万用户,年初基数约 55–70 万,意味着半年增长近 10 倍。对照之下,Claude Code 最近一次公开数据停留在 2 月的约 200 万用户、25 亿美元 ARR,此后对用户量保持沉默(善意解读是把编码流量迁到了 Claude Tag/Slackbot,口径不可比)。OpenAI 还临时取消 Plus/Business/Pro 的 5 小时用量限制、给全员发"回充"额度助推增长。
🦐点评:一个在闷声 10 倍增长、一个停止披露用户数——编码 Agent 这个此前由 Claude Code 定义的品类,领先权正在易手。对 VC 的信号有二:其一,OpenAI 把 Codex 塞进 ChatGPT Work 订阅、用取消限速+回充做增长,是典型的"以捆绑和补贴换品类",独立编码工具(Cursor 等)的议价空间被两大模型厂从上游挤压;其二,Anthropic 的沉默值得追问——若真把编码迁到 Slackbot 形态,说明护城河已从 CLI 工具转向工作流嵌入,那才是该跟踪的真实战场,而非用户数口水战。
latent.space
Ben Thompson 的核心论点:OpenAI 已把 Codex 重塑成"新的 ChatGPT"——一个以 Agent 为中心的超级应用,而非原来的对话框,并由此追问 OpenAI 是否正在放弃它亲手开创的"聊天"品类。这一判断在本期 AINews 报道中得到侧证:OpenAI 已把 Codex 与 ChatGPT Work 的用户量合并计数(7M active users now using Codex and ChatGPT Work),印证了"聊天正在收敛为编码/工作台"的方向。
🦐点评:"ChatGPT = Codex"这个等式若成立,意味着 OpenAI 主动把消费级对话产品往 Agent 工作台上收,通用聊天正被更高 ARPU 的 Agent 工作流吃掉。对投资人的推演:连开创者都判定纯 chatbot 不是终局,那大量以"更好的对话 UI/套壳助手"为卖点的应用层公司估值逻辑要重估——价值锚点从"回答问题"移向"完成任务",能沉淀工作流、权限和状态的产品才配得上超级应用叙事。
stratechery.com
George Sivulka 抛出一个反直觉命题:"人类历史上第一次,人比软件更便宜"——头部公司的人均 token 支出已高到这个地步,而且 AI 采纳后是在增加而非减少岗位。他用铁路作类比:1841 年因协调失败发生撞车,倒逼铁路业发明现代管理(分区经理、书面职责、层级汇报),铁路才成为首批十亿美元产业。如今 AI 又打破系统:我们给每个员工(哪怕最差的)都配了近乎无限的"人手和预算",而管理 AI 比管理人更难,因为 AI 会瞬间放大功能失调。他给出"Agent 与人类劳动力的 7 个对应":tokenmaxxing 是"堆人头"、loops 是"开会讨论开会"、浪费的 token 是新的冗员——根源在于约 100 人里只有 1 人真会给 AI 喂上下文。
🦐点评:这篇实质是 a16z 在给"Agent 管理/编排层"赛道做估值铺垫——瓶颈被明确判给"管理"而非"模型能力","100 人里只有 1 人会写 prompt"直接量化了中间层的市场规模。对 VC 的落点:与其追逐模型层军备竞赛,不如投把"人的意图→可靠 Agent 执行"这段翻译做扎实的公司(上下文工程、评估、权限与状态管理);而 Sivulka 本人是 Hebbia 创始人,这套"企业 Agent 要像管人一样管"的叙事,恰好也是他自家产品的护城河故事——读的时候得把这层动机折进去。
a16z.news
2026 年 AI 工程师世界博览会释放的最强信号:AI 工程进入"围绕 Agent 造系统"而非"用 Agent 造东西"的新阶段。最能说明趋势的是 Lilian Weng 的两篇文章对比——2023 年《LLM Powered Autonomous Agents》讲 Agent 的规划/记忆/工具三件套(AutoGPT、BabyAGI 为例),2026 年新文《Harness Engineering for Self-Improvement》则主张:模型外围那层"harness"(工作流、上下文、权限、评估、持久状态、持续改进)和模型本身同样重要。今年会上 AutoGPT 几乎无人再提,话题全在 Claude Code、Codex、Gemini CLI、Cursor、Warp 以及让编码 Agent 在生产环境可靠运行的基础设施;"完全自主"被证明既不可靠也不可取,Agent 被重新定位为增强人而非取代人。
🦐点评:"harness engineering"正在从口号变成一门独立学科,这是价值从模型层向工程/基础设施层迁移的明确信号。对投资人的含义:能被创业公司稳固建立壁垒的,恰恰是模型厂不愿或不擅长做的那层——上下文管理、评估闭环、权限与状态编排;连 Lilian Weng(现 Thinking Machines Lab)都把研究重心从"Agent 本体"转向"自我改进的 harness",等于把顶尖研究注意力的流向标了出来,可据此重排 dev-infra 的 watchlist。
latent.space
DeepMind CEO Demis Hassabis 公开支持一版"上市前"安全测试:前沿实验室先自愿在发布前最多 30 天把模型交给一个"标准机构"评审,待评估协议被证明有效后再正式立法——届时前沿模型须通过测试方可在美国市场部署,实验室还需配合处理发布后的关键漏洞,整体参照 FINRA 式行业自律模式。长期倡导者 Gary Marcus(自 2023 年参议院作证起就主张按 FDA 模式做强制、透明、独立的上市前测试)表示欢迎,但强调评审必须纳入独立技术专家,尤其在美国政府正考虑入股 AI 公司、存在利益冲突的当下。
🦐点评:一个 30 天上市前评审 + FINRA 式自律机构若落地,会实打实给前沿模型部署加上时间与合规成本,天然利好有合规资源的头部厂、拉长新入局者的上市周期。更值得玩味的是 Hassabis 站到"支持被监管"这一侧(而非纯加速),叠加 Dario、Demis 同时喊话政府——前沿实验室或许更愿意用"可控的监管"把领先身位锁死,这对押注开源/小厂快速追赶的投资逻辑是个逆风信号。
garymarcus.substack.com

📌 其他新闻

微软本月修补至少 570 个安全漏洞,几乎是上月破纪录数量的三倍,官方将激增直接归因于 AI 辅助的漏洞挖掘——AI 正把漏洞发现的产能推到前所未有的量级。
krebsonsecurity.com
前上海 AI Lab 的李林阳创办芯片设计服务公司 Novasilicon(芯星元),近日完成首轮数千万元融资,由五源资本独家投资,主打用 AI 重做传统 Design House 的芯片设计环节。
leiphone.com
雷峰网独家复盘 Meta 收编华人主导的 AI 安全创企 Virtue AI 团队(核心成员李博等)的全过程,对成员而言这既非普通跳槽也非被大厂整体带走,而是一次关于何去何从的主动抉择。
leiphone.com
36 氪早报,AI 相关头条是 DeepSeek 梁文锋跃升为全球 AI 公司领域新首富;另有小米机器人首次在汽车工厂实现柔性工件长时作业、SK 海力士加速 Y1 工厂建设等看点。
36kr.com
AI 实验室 Agnes AI 发布新一代模型 Agnes-2.5-Flash,号称编程能力跻身全球第一梯队且不限期免费,同步推出对标 Codex/Claude Code 的桌面工具 Agnes Code,直击海外头部编码工具集体涨价、封号的痛点。
qbitai.com

🧠 AI 技术前沿

_akhaliq @_akhaliq
分享新论文《Weak-to-Strong Generalization via Direct On-Policy Distillation》,用直接在线策略蒸馏实现从弱模型到强模型的能力泛化。
查看推文 →
_akhaliq @_akhaliq
Bonsai 27B 模型已可通过 Hugging Face 在 Claude Code 中直接调用。
查看推文 →
Hesamation @Hesamation
DeepMind 的 Demis Hassabis 呼吁政府介入前沿 AI,风险过高时甚至可下令减速,并强调不论模型来自哪国、开源还是闭源都应适用;他与 Dario 正联手推动。
查看推文 →
Hesamation @Hesamation
一名 Google DeepMind 高级研究员联合 600 名员工请愿,反对将模型用于机密军事用途,但 Google 仍签下五角大楼合同;2014 年收购 DeepMind 时曾承诺不用于军事。
查看推文 →
karminski3 @karminski3
国产模型霸榜 OpenRouter 近两周用量 Top6:用量第一是腾讯混元3免费版,其次小米 MiMo-V2.5,DeepSeek-V4-Flash 精准卡位 Agent 用户,与去年只有 DeepSeek/Qwen 破圈两极反转。
查看推文 →
shao__meng @shao__meng
Cloudflare 工程经理 Kate Reznykova 加入 OpenAI,负责 ChatGPT 网络基础设施;她此前主导 Cloudflare Agents 与 Sandbox SDK,Codex/ChatGPT Work 的沙箱能力有望大幅提升。
查看推文 →
shao__meng @shao__meng
Kimi K3 临近发布——运营误将限时充值活动状态设为已发布被 Google 抓到,活动 07.15 开始,模型料将一两天内亮相。
查看推文 →
shao__meng @shao__meng
Codex 的 Computer Use 新增"画中画",可直接观察 Chrome 界面跳转,无需在 Codex 与浏览器间反复切换。
查看推文 →
hongming731 @hongming731
Anthropic 从 30.98 万段真实对话提炼出四条"价值轴",对比三款 Claude 与 20 种语言:Sonnet 4.6 更温暖、Opus 4.7 更谨慎严谨,但四轴仅能解释 15% 的行为差异。
查看推文 →
rileybrown @rileybrown
Codex 更新应用内浏览器,支持多标签页、导入 cookie 和密码;两天后 Claude Code 也跟进了类似更新,正在改变人机协作方式。
查看推文 →
emollick @emollick
Codex 现在能生成完整 PPT,但默认的 presentation skill 总加载一套极其平庸的示例模板,且因夹带大量工具使用说明而难以修改。
查看推文 →
steipete @steipete
把维护者 agent 迁到云端后,它们已经开始"互相打架"了。
查看推文 →
0xROAS @0xROAS
用 Seedance 2.0(V3)约 10 分钟就做出一条 Facebook 广告视频,AI 视频生成的产出速度和质量令人咋舌。
查看推文 →
EXM7777 @EXM7777
引用 OpenAI 总裁 Greg Brockman:竞争已不只关乎模型本身,而在"harness"——模型如何获取上下文、如何连接世界、能采取哪些行动。
查看推文 →

🚀 创业动态

vasuman @vasuman
与数十位十亿美元级公司 CFO 深聊后,Varick 研究团队整理出企业在财务部门正确落地 AI 的具体方法论。
查看推文 →
corbin_braun @corbin_braun
Thumio 上线重大更新,彻底重构了产品的商业化/计费逻辑;同样的活 2025 年 12 月做了两周,这次只用两天完成。
查看推文 →
marclou @marclou
TrustMRR 上第 119 笔创业收购完成:一个月收入 300 美元的 Chrome 扩展以 5000 美元售出。
查看推文 →
marclou @marclou
他几个月前想做"iOS 版 Lovable"未果,如今 vitalikkotyk 用 SuperAppIOS 做成了并拿到 TrustMRR 广告位,闭环完成。
查看推文 →
jackfriks @jackfriks
一位客户申请退款,理由是关掉了线上生意去经营一个 500 头奶牛的牧场。
查看推文 →
godofprompt @godofprompt
用一条 prompt 从零搭出一个 Markdown 笔记应用:分屏编辑、语法高亮、搜索、暗色模式和导出全部自动生成、可自定义。
查看推文 →

💬 观点与洞察

shao__meng @shao__meng
用户用 AI 产品"始于颜值、忠于才华",能留下靠团队是否真重视用户;他点名 Anthropic 反复折腾——Fable 5 要不要移出付费计划一改再改、看到 Codex/GPT-5.6 起势才想起 reset 限制、CEO 一边散播 AI 威胁论一边把自家 Fable 5"关进去"。
查看推文 →
gregisenberg @gregisenberg
偶遇 DeepMind 创始人 Demis,对方称"副作用极小的个性化医疗"将在十年内到来,AGI 最激动人心的用途是为数十亿人终结病痛。
查看推文 →
MengTo @MengTo
44 岁生日感言:AI 能放大人的独特性却无法取代它;他说自己从未如此享受工作、有更多时间陪孩子,因为 agent 接手了大量活儿。
查看推文 →
corbin_braun @corbin_braun
越用 Fable 5 越发现它调度 subagent 的能力,他认为终局是:不再需要开多个对话和 agent,一个对话、一个模型自己铺开成多个子 agent 全包。
查看推文 →
karminski3 @karminski3
他在 Opus 4.7 刚发布时对比了 Opus 4.7 与 GPT-5.5-Pro,随后把主力编程模型换成了 GPT-5.5-Pro。
查看推文 →
emollick @emollick
iOS 版 ChatGPT 用 Codex 远程控制电脑的功能很好用,但应用内设置指引与桌面端菜单对不上;他吐槽各大 AI 实验室的文档普遍过时。
查看推文 →

🔥 精选推荐

7 月 14 日,谷歌 DeepMind CEO 哈萨比斯(Demis Hassabis)发表《A Framework for Frontier AI and the Dawning of a New Age》(前沿 AI 治理框架与新时代的曙光),罕见地给出接近 AGI 的时间判断并呼吁建立治理框架。背景是几天前 OpenAI 发布 GPT-5.6 系列、旗舰 Sol 刷新编程基准,还因网络安全能力太强被要求先过安全审查才放开——顶尖实验室的能力竞赛正把"治理"从口号推成现实议题。
🦐点评:当连最谨慎的 DeepMind 都开始公开谈"只剩几年"和治理框架,投资人该读出的不是时间表本身(那注定被反复打脸),而是监管风险正从尾部变量前移成核心变量——旗舰模型因"能力太强"要过安全审查,意味着下一轮前沿模型的发布节奏、可用地域、能力开放度都会被政策绑住。押注应用层的基金,得开始把"上游模型何时、以何种阉割版落地"当成排期里的硬约束。
AI 深度研究员
晚点拆解 A 股芯片代工厂晶合集成——中芯国际、华虹宏力之后国内第三大晶圆代工厂的诞生、崛起、豪赌与突围。文章把它放进合肥这座城市的产业叙事里:从京东方到蔚来、从面板到新能源车,合肥以近乎固执的方式把"缺什么就补什么"的产业逻辑执行到底,晶合正是这盘棋局里的那枚"棋眼"。
🦐点评:这篇的价值在于给"地方政府产业基金"这套中国特色打法提供了一个可复盘的完整样本——合肥模式的本质不是撒钱,而是用国资在产业链缺口上做逆周期重注、再靠后续资本运作退出。对看硬科技的基金,有两个可迁移的判断:① 晶合这类代工厂的护城河是产能+客户绑定而非制程领先,估值锚要看产能利用率和客户集中度,别按"国产替代"故事给溢价;② 合肥经验能不能复制到别的城市,关键看有没有能承担长周期亏损的耐心资本,这恰恰是多数地方学不来的部分。
晚点LatePost
张巍 2003 年赴美、用 14 年拿到终身教职,2019 年放弃教职回国入职南方科技大学,两年多后创办逐际动力,目前已陆续发布四五款机器人产品——包括一男一女两台机器人 Luna 与 Oli,以及从操作算法到智能体系统的全套技术栈。Luna 身高 160 厘米,能下一字马、走猫步、变换表情。他的核心观点很硬:这个世界上没有技术壁垒,只有迭代速度。
🦐点评:"没有技术壁垒,只有迭代速度"这句该被具身智能赛道的投资人抄下来——它等于当面否认了这个赛道最常见的融资叙事(我们有独家算法/独家本体)。如果创始人自己都认为壁垒只在速度,那尽调的重心就该从"技术有多领先"切到"迭代节奏能不能持续":团队多久出一版、每版的真实改进量、以及供应链能不能跟上这个节奏。这也解释了为什么具身赛道估值波动这么大——速度型壁垒是没有存量价值的,停一个季度就归零。
晚点LatePost
作者盘点今年一连串加入 Anthropic 的重量级人物,最新一位是 Tom Blomfield——他从 YC 请假加入 Anthropic。Blomfield 在英国金融科技圈是标志性人物:联合创办了 Monzo(英国最大的数字银行之一,用户覆盖英国 10% 人口),此前还联创 GoCardless(做银行支付基础设施),两家公司都做到了独角兽、估值超 10 亿美元。文章的疑问很直接:为什么这么多巨佬都选择了 Anthropic。
🦐点评:连续创业成功、本可以自己再开一家的人,选择去别人公司打工,这个信号比任何融资新闻都值钱——它说明这批人判断"下一个十年最大的杠杆点"不在自己创业,而在离前沿模型最近的地方。对 VC 有两层含义:① 顶级创业者的机会成本判断正在集体转向"加入而非创办",这会阶段性抽干早期赛道的顶尖供给;② 人才虹吸本身就是 Anthropic 最难被复制的资产之一,做同行竞品估值时,别只比模型 benchmark,比比谁在赢这场人才战。
数字生命卡兹克

📌 其他值得看

Lyzr 完成 1 亿美元融资、估值 5 亿,亮点是它连续三个季度每季度营收涨 250%——在 agent 公司普遍讲故事的当下,这条增长曲线本身就是个稀缺样本。
Z Potentials
千觉机器人完成亿元融资,由顶级具身智能产业方、吉德电器、天季资本共同投资,方向是触觉感知——具身智能里少数还没被大厂吃透的感知维度。
Z Potentials
Intel 再投 57 亿美元扩建爱尔兰工厂、押注 Intel 3 制程的 AI 芯片制造,追赶台积电代工产能,可与今天合肥晶合那篇对照看代工产能这盘全球棋。 <!-- ai-daily:complete -->
Z Potentials