暂无内容

🧠 AI 技术前沿

cursor_ai @cursor_ai
Claude Opus 5 已上线 Cursor,在 CursorBench 默认档以 66.7 对 66.5 追平 Fable 5,价格只有一半,且与 Fable 不同,它兼容零数据保留(ZDR)。
查看推文 →
bcherny @bcherny
相比各项跑分,Anthropic 更看重的是 Opus 5 是其迄今最难被 prompt injection 攻破的模型;叠加模型对齐、注入探针与 Claude Code 的 Auto Mode 多层防御后,注入成功率进一步大幅下降。
查看推文 →
emollick @emollick
提前试用 Opus 5 的评价:短任务上能追平甚至超过 Fable,但长任务显得不够进取、交付的完整度不如 Fable,是个强但有点怪的模型。
查看推文 →
shao__meng @shao__meng
Black Forest Labs 发布 FLUX 3,定位不是文生图/视频而是"真实世界模型":把图像、视频、音频放进同一套多模态 flow 架构学习世界如何运作,同一底座同时接内容生成与具身/动作预测,分 Video、Image、Action 三条线。
查看推文 →
shao__meng @shao__meng
Together 团队在 DeepSWE 基准上对比 Kimi K3 max 与 GPT-5.6 Sol max:单次 pass@1 GPT 略胜(72.7% vs 68.5%),但 pass@2、pass@4 Kimi 反超(89.4%),且更便宜(每 100 美元多解约三倍题目),结论是各有所长、路由+级联更优。
查看推文 →
emollick @emollick
一项关于 ChatGPT 对大学影响的大型研究给出意外结论:把 COVID 冲击单独建模后,ChatGPT 的引入对成绩没有可检测的影响,学生对学科理解、兴趣和相对负担的课程评价也没有变化。
查看推文 →

🚀 创业动态

gregisenberg @gregisenberg
如果整个工作流只跑在一台 MacBook 上的单个 Claude Code 实例里,等于把 10 倍产能留在桌上;用云端 VM 里的 agent 可以随意并行几十个、各自独立机器互不冲突,开 10 个一起跑也不打架。
查看推文 →
shao__meng @shao__meng
吴恩达团队也开源了桌面端 AI Agent "OpenWorker",定位 AI coworker;作者克隆后又让 Codex、Cursor 各看一遍,坦言没看到与 OpenClaw、Claude Cowork 等特别不同之处——本地优先、模型无关、基于 aisuite 已是自研 Agent 的标配架构。
查看推文 →
jackfriks @jackfriks
分享用 caffeinate + Claude Code remote control 打造的"随处写代码"方案:全程用 Claude Code 订阅和官方 Claude App,无需 VPS、无额外成本,就能在手机上继续 session、随时处理支持工单和代码修复。
查看推文 →
eptwts @eptwts
他发现 Whop CLI 的一个最佳用例是在 Claude Code 里直接为自己的社群造工具:可以一次成型地为成员做出有用的新功能并作为 whop app 注入社群,甚至替代默认课程 app 来自定义信息消费方式。
查看推文 →
marclou @marclou
提醒:哪怕只做了个很小的生意,你也拥有一项资产——按当前倍数,1000 美元 MRR 约合 6.3 万美元、1 万美元 MRR 约合 63 万美元,别让打工的朋友劝你"去找份工作"。
查看推文 →

💬 观点与洞察

Hesamation @Hesamation
黄仁勋在 X 的首帖引发他见过最大规模的科技巨头集体力挺开源 AI:不要把 AI 交给封闭垄断、加速开源、避免对开源模型过早监管,署名方包括 Meta、Nvidia、Microsoft、Reflection、Hugging Face 等。
查看推文 →
Hesamation @Hesamation
他梳理了一条讽刺链条:OpenAI 把 HF 基础设施搞砸、HF 因安全护栏修不好只能改用 GLM 5.2,HF 由此呼吁"美国需要前沿开源权重模型",而国会的反应是"加装 KILL SWITCH"——OpenAI 闯了祸,却换来了它一直想要的监管。
查看推文 →
rileybrown @rileybrown
对多数人来说追模型发布是一种干扰:除非是 Fable 或 5.6 那种级别的跃迁,否则盯着最新模型反而在削弱你有效用 AI 达成目标的能力。
查看推文 →
hongming731 @hongming731
BestBlogs 早报观点:Opus 5 重新计算了模型的性价比,腾讯 WorkBuddy 补齐了 Agent 的上下文/工具/权限/验证控制系统,并追问"为什么组织能力没有随模型能力同步加速"。
查看推文 →

🔥 精选推荐

Etched 完成 3 亿美元 C 轮,估值 103 亿美元,约七个月内从 50 亿翻倍,公司称这是红杉领投的 C 轮里估值最高的一笔,a16z、SK Hynix、Jane Street 及 Peter Thiel、Karpathy 等跟投。三位哈佛辍学生 2022 年创立,专注为 Transformer 架构打造专用推理芯片,芯片已在台积电量产、拿下 10 亿美元订单。其架构从零设计了"低电压 prefill 芯片"与"集群级内存互连",分别攻推理的预填充与解码两个阶段;创始人强调整套系统可跑任意模型(含 MoE、Mamba),并非只为单一 LLM 定制。
🦐点评:红杉把自己 C 轮的估值天花板给了一家"把模型结构刻进硅片"的公司——七个月翻倍、10 亿订单在手,说明推理侧的定制化 ASIC 已从"异想天开"变成英伟达之外的一个确定性下注。更关键的信号是 Karpathy、Noam Brown、Hinton 都是私下试用硬件后才投的,护城河不在流片而在"谁能拿到前沿实验室的真实推理负载做协同设计",这也是谷歌 Frozen v2 在追同一条路的原因。
Z Potentials
多模态公司智象未来(HiDream.ai)完成 15 亿元 C 轮,三个月累计融资超 21 亿元,投后估值突破 10 亿美元跻身独角兽;社保基金四川振兴科创基金领投,上影股份、华策影视等影视产业资本入局。其 HiDream-O1-Image-1.5 在 Artificial Analysis 开源图像模型榜列全球第一,闭源模型全球第三、中国第一,超过字节跳动 Seedream 4.0。公司已完成股改、更名为股份有限公司,IPO 路径逐渐清晰,并发布号称"无限时长"、成片可用率 85% 的创作智能体 vivago R1。
🦐点评:领投的是社保基金和一批影视国资,而非纯财务 VC——这笔钱的潜台词是"国产可控的内容生成底座 + A 股 IPO 退出",和字节 Seedream 的平台路线是两套逻辑。对美元基金更值得盯的是它把上影、华策绑成产业股东,等于提前锁定了商业化订单和影视版权数据,而这恰恰是纯技术团队最缺的一环。
Z Potentials
Vivix 发布两款约 30B 激活参数的实时互动模型 A1(全双工数字角色)与 W1(互动叙事),主打"边生成边接受用户输入"的因果生成,而非请求-响应式的半双工。团队自建了覆盖 2-step 蒸馏(MJD)、面向 Blackwell NVFP4 的"训练即量化"、以及解耦编解码的 VMI 推理引擎的完整技术栈,在消费级显卡上实现首帧 <0.6 秒、端到端 <1.7 秒、原生打断 300–900 毫秒、实时生成成本低于每小时 1 美元。A1 已上线 API,W1 以 Demo 形式展示。
🦐点评:这是把"世界模型"从叙事炒作拉回工程落地的一次——难点不在模型效果,而在让近 30B 激活参数在消费级卡上跑到亚秒延迟还能被随时打断,这套 infra(2-step + FP4 训练 + 编解码解耦)才是真壁垒。如果实时全双工成立,直播电商和 AI 陪伴的单位经济会被重写:每小时 1 美元的生成成本,意味着数字主播第一次可能比真人更便宜。
Z Potentials
晚点专访姚颂:2018 年他 26 岁以 3 亿美元卖掉 AI 芯片公司深鉴,之后参与创立商业航天公司东方空间,去年下半年第三次创业成立正行创新(Striding AI),以"物理 AI"切入通用机器人——他强调物理 AI 要加多机协作、路径规划与远程兜底,不等于只做本体的"具身智能"。他自述创业有两条线:做对人类真正重要的事(能源航天、个体健康、社会效率),以及看着一个技术原点变成被很多人用起来的产品;并通过 SEE Fund 天使投资了银河通用、星海图、破壳等一批清华系具身公司。
🦐点评:姚颂这张清华电子系人脉网(汪玉、韩松、王鹤、高继扬既是连续创业者又是他基金的被投)本身就是一份具身赛道的 deal flow 地图——看这条线的基金,与其追单个项目,不如先看懂这个"师门"的资金和人才如何互相导流。他把物理 AI 定义成"要加多机调度和远程接管",实际是给机器人公司划了一条更接近 Robotaxi 运营的商业化门槛,这个判断值得拿现有 portfolio 逐个对照重估。
晚点 LatePost
Anthropic 经济研究负责人 Peter McCrory 撰文回应"AI 用了三年为何失业率没涨":美国 6 月失业率 4.2% 仍是充分就业,黄金年龄段就业率、初请失业金、裁员率均无异常。他认为并非"为时尚早"——约 20% 的美国企业已在至少一项职能上用 AI(信息业达 40%),质量调整后的 AI 产出 2024、2025 两年增速均超 2000%。核心论证是企业招聘本就基于对未来价值的贴现判断,若真信岗位两年后被替代,今天的离职/裁员/招聘数据就该反映,但增速最猛的软件工程招聘反而自 2025 年 5 月回升。唯一的弱信号,是高 AI 暴露岗位上年轻工人的招聘率在走弱。
🦐点评:这篇最反直觉之处在于——招聘是"贴现未来"的决策,所以劳动力市场本该提前给 AI 冲击定价,但它没有,这比任何一个当期失业数字都更能反驳"大规模替代已发生"。对投资人真正有用的是那条被作者小心处理的弱信号:年轻人的 entry-level 岗位先松动。如果结构性替代是从"不再招新人"而非"裁掉老人"开始,那最先受冲击的会是外包、BPO 和初级白领培训这类生意,而不是软件工程本身。
深思 SenseAI

📌 其他值得看

Anthropic 发布 Claude Opus 5:定价与 Opus 4.8 持平(每百万 token 输入 5 美元、输出 25 美元),约为 Fable 5 一半但性能大幅反超,Frontier-Bench、OSWorld、GDPval 等多项刷新 SOTA、单任务成本更低,网络安全任务仍落后 Mythos 5;系统卡称其为对齐做得最好、却也最"爱把话说满"的模型。
赛博禅心
Bret Taylor 的 AI 客服公司 Sierra 收购成立仅一年、年化营收即将达 1000 万美元的三人 Agent 创企 Takeoff(此前曾获 Matrix、Lachy Groom 等 1500 万美元融资),意在把长周期 Agent 能力补进新产品 Horizon;收购价预计不高,更像人才+能力并购。讽刺的是 Taylor 同时是 OpenAI 董事长,而 OpenAI 刚推出与 Sierra 直接竞争的 Presence。
Z Potentials
Z Potentials 拆解中国 AI 产品"问小白"为何押注更"重"的项目工作台——把文件系统从资料容器升级为长期记忆与任务延续的基础设施,对标 ChatGPT 的 Work 与 Claude 的 Projects,赌注在于 AI 处理持续推进的复杂项目时对上下文延续性的刚需。 <!-- ai-daily:complete -->
Z Potentials