skip to content
Oasis DailyFM
Table of Contents

各位好,今天是2026年的8月15日,星期六,这里是绿洲日报,由绿洲编辑部为你播报。

今天的信息流非常热闹。谷歌正式向全球推送了 Gemini 3.7 Flash,不仅在 Workspace 中实现了“一句话 Prompt 将表格直接生成微应用”,还推出了集成 Magic Capture 的 Pixel 11 手机;OpenAI 秘测 GPT-5.6 Sol 极速模式,生成速度飙升 14 倍至每秒 750 tokens;埃隆·马斯克预测受电网管道延期影响,2029 年轨道算力将成为大模型扩张的唯一解;特朗普政府签发最新政令,对外国制造的 25 公斤以上国防无人机征收最高 100% 关税;而在国内,科创板迎来了市值首日破 400 亿的“量子精密测量第一股”国仪量子,具身智能龙头宇树科技也官宣将于下周正式敲钟。

在这些密集的产业动态背后,有一个非常反直觉的现象引发了编辑部的深度讨论:一方面 AI 的生成速度和推理成本正以惊人速度下探,另一方面企业和开发者却陷入了严重的“算力与记忆焦虑”,甚至催生了 Token 期权对冲这一全新的衍生品市场。当推理速度飙升 14 倍,为什么“记忆”反而成了智能体时代的瓶颈?梳理几条动态之后马上和你聊。

OpenAI秘测GPT-5.6 Sol极速模式:生成速度飙升14倍,DeepSeek与阿里云发起定价新战役

根据 The Information 与科技媒体 8 月 15 日的最新报道,OpenAI 已在 API 端向特定企业客户秘密开启了 GPT-5.6 Sol Ultrafast(极速)模式的测试。测试数据显示,该模式通过重构底层推理并行架构,将文本生成速度提升了 14 倍,达到了创纪录的每秒 750 个 token。与此同时,OpenAI 官方公布其企业级产品营收已全面超越消费者订阅收入,在 Slack 办公场景中,用户日均使用其“计算机历史记录”插件的分析时长占比高达 48%。

在开源与中端市场,价格战正演变为更精细的运营战。财新网报道,DeepSeek 宣布正式上线 DeepSeek V4 Pro 正式版 API,在小幅上调基础价格的同时,首次引入了按 UTC 时间划分的峰谷动态定价机制,引导开发者在低峰期进行长文本批处理。开源阵营中,阿里 Qwen 团队重磅开源了 Sparse MoE 模型 Qwen3.8-2.4T-A95B,该模型拥有 2.4 万亿总参数、激活参数 950 亿,支持 100 万 token 超长上下文,并在 Together AI 和 DigitalOcean 等平台首发上线。

编辑部认为,从 GPT-5.6 Sol 的每秒 750 个 token 到 DeepSeek 的分时计费,大模型市场的竞争已经从“单纯比拼单次推理成本”,全面转向了“高吞吐实时交互与离线大批量的流量调度战”。对于企业而言,单 token 价格虽然在下降,但随着推理智能体(Reasoning Agents)的普及,多轮对话产生的总 token 消耗量反而在激增,如何建立高效的算力预算管理机制成为所有 CTO 的当务之急。

谷歌全面上线Gemini 3.7 Flash:Sheets表格一句话变微应用,硬件端发布Pixel 11

谷歌官方于 8 月 14 日晚间宣布,面向全球 Gemini Chat、搜索 AI 模式(英文版)以及 Workspace 企业订阅用户,全面推送最新的 Gemini 3.7 Flash 模型。本次更新最大的亮点在于 Workspace 生态的突破:谷歌首发了 Google Sheets Canvas(画布)功能,允许用户仅凭一段自然语言 Prompt,就能将复杂的电子表格实时转化为具备完整交互逻辑的“微应用”(Micro-Apps),极大提升了跨文档、跨邮件的复杂推理与数据可视化效率。

在硬件层面上,谷歌同步举办了 Made by Google 新品发布会,正式推出了搭载全新 Tensor G6 芯片的 Pixel 11 系列手机。该机型深度集成了 Magic Capture AI 拍摄功能,能够在毫秒级时间内完成多帧合成、光影重构与背景语义消除。

绿洲编辑部观察到,谷歌正在加速把 AI 从“对话框里的助手”沉淀为“生产力软件的底层逻辑”。把电子表格动态变成微应用,意味着传统 SaaS 软件中大量简单功能的代码开发被直接归零。然而,这种将复杂逻辑完全交由大模型实时渲染的模式,也对云端算力的稳定性和端侧设备的散热提出了极高要求。谷歌硬件与软件的同步提速,正是为了抢占未来“端云协同 AI”的标准制定权。

陆地电网管道延期至2027年:马斯克断言2029年轨道算力成大模型扩张唯一解

据 CNBC 与 Polymarket 平台 8 月 15 日汇总的数据,由于环境保护审批流程延误与地缘监管冲突,Oracle 位于新墨西哥州用于 Stargate AI 数据中心配套的天然气供气管道项目已官宣推迟至 2027 年 2 月交付。这一陆地能源基建的卡脖子事件,迅速引发了硅谷对“电网上限”的二次恐慌。

特斯拉与 SpaceX 首席执行官埃隆·马斯克随后在社交平台公开预测,受制于陆地电力供应封顶与审批周期过长,到 2029 年,部署在地球近地轨道的“太空数据中心”将成为大模型继续按扩展定律(Scaling Law)迭代的唯一途径。目前,包括 SpaceX、a16z 投资组合在内的多家巨头正在积极筹备轨道算力试验卫星,试图直接利用无大气层阻挡的高效太阳能发电。这一趋势甚至催生了全新的商业赛道——太空算力基建保险与轨道数据传输对冲协议。

编辑部分析认为,从 2024 年的芯片荒,到 2025 年的变压器荒,再到 2026 年陆地电网彻底撞墙,AI 产业对能量的饥渴正逼迫人类将算力基建从地表推向太空。虽然轨道算力面临高宇宙射线辐射、散热困难以及每公斤数千美元的发射成本瓶颈,但在陆地能源审批动辄耗时 3 到 5 年的背景下,太空算力已经从一个科幻概念变成了顶级资本必须布局的对冲工具。

SpaceX完成600亿美元收购Cursor:巨头持仓披露,科技三巨头累计持仓近千亿

据路透社与雅虎财经 8 月 15 日报道,SpaceX 正式完成了对 AI 代码生成工具 Cursor 母公司 Anysphere 总价值 600 亿美元的收购。收购完成后,Cursor 的核心研发团队将整体并入 SpaceXAI 部门,共同推进 Grok 系列大模型的代码理解与硬科技工程设计能力。公开财报显示,Cursor 在被收购前的年化经常性收入(ARR)已快速突破 1 亿美元大关。

与此同步披露的监管文件揭示了硬科技巨头间交织的资本图谱:英伟达(Nvidia)在最新的 Q2 监管填报中披露其持有 SpaceX 股票价值达 210 亿美元;沙特主权财富基金(PIF)在第二季度单季度买入 250 亿美元;知名投资人木头姐(Cathie Wood)旗下的 ARK 基金增持了 4470 万美元。统计显示,英伟达、谷歌与 AMD 三家科技巨头目前在 SpaceX 的累计持仓金额已逼近 1000 亿美元大关。

编辑部指出,这一巨额并购案的落地,标志着顶级 AI 软件工具的终极竞逐不再是独立的 SaaS 订阅服务,而是与超级物理工程深度绑定。SpaceX 拿下的不仅是一个年营收 1 亿美金的代码编辑器,而是其数万名工程师研发星舰(Starship)与星链(Starlink)时的“AI 研发大脑”。巨头们用上千亿美元交叉持股 SpaceX,实际上是在为“AI 驱动超级硬件”的终极形态进行资本押注。

特朗普签发100%无人机关税令:国仪量子科创板破400亿,宇树科技下周敲钟

据 WhiteHouse 官方声明与 CNBC 8 月 15 日报道,美国总统特朗普已正式签署行政命令,对所有外国制造(重点涵盖中国与韩国)的 25 公斤以上国防与工业级无人机及其核心零部件(如自动对接充电站、多光谱传感器)征收最高 100% 的进口关税。受此关税保护政策刺激,美国本土防务与自动化标的 LightPath Technologies($LPTH)、UMAC 与 ONDS 等公司股价应声大涨。

而在中国资本市场,硬科技硬核上市潮正迎来爆发。源自中科大实验室的“量子精密测量第一股”国仪量子于 8 月 14 日正式登陆科创板,首日开盘市值即冲破 400 亿元人民币。与此同时,据 BlockBeats 与路透社确认,中国具身智能龙头宇树科技(Unitree)已完成上市前辅导,预计将于下周在上海证券交易所挂牌敲钟,作为人形机器人赛道的标杆企业,其 IPO 表现将直接重塑全球具身智能初创公司的估值体系。

编辑部认为,全球硬科技赛道正在经历剧烈的“分裂与重构”。一边的西方政策通过 100% 的极高关税壁垒强制回流本土供应链,另一边的中国资本市场则赋予了量子测量、具身智能等前沿硬科技极高的流动性溢价。无论是无人机、量子设备还是人形机器人,硬件的软硬一体化竞争已经超越了商业范畴,演变为地缘政治与资本效率的全面比拼。

伊朗局势致油价暴涨:中国电动重卡亚洲出口激增,全美处方药创60年最大跌幅

据路透社商业版(ReutersBiz)与 CNN 8 月 15 日报道,受到近期中东伊朗战争引发的全球柴油与航空燃料价格暴涨影响,亚洲多个国家的商用物流运输成本急剧上升。这一高油价压力直接催化了区域商用运输的电动化转型,今年前七个月,中国电动重卡(EV Trucks)对东南亚及中亚国家的出口量同比实现了翻倍增长,国内销量亦创下历史新高,吸引了大量 VC 资本涌入商用 EV 补能与电池更换基建。

在公共卫生与政策领域,美国白宫与 CDC 于 8 月 14 日联合发布数据,全美处方药平均价格在过去 12 个月中录得过去 60 年来的最大单幅跌幅,多款核心慢病药价格下降超 30%。然而公共卫生防线仍面临挑战:刚果(金)爆发出史上扩散速度最快的埃博拉疫情,平均每 30 分钟致死 1 人;美国 CDC 则报告 2026 年全美麻疹确诊病例已突破 2500 例。

绿洲编辑部总结道,地缘政治的阵痛往往是技术应用突破的加速器。伊朗局势带来的燃油高压,瞬间推倒了亚洲物流公司改用电动重卡的最后一道心理防线;而美国家庭在医疗支出上的成本回落,与全球公共卫生安全防线的频频告急形成了鲜明对比。这再次印证了一个规律:在宏观不确定性加剧的当下,能够真正落地、帮用户省钱或保命的技术,才具备最强韧的商业生命力。

以上是今日重要商业科技动态,下面和我一同走进今天的绿洲早知道时间。

绿洲早知道

今天的信息流里,有一组数据表面上看起来完全矛盾,但如果你把它们放在一起看,就会发现一个正在悄然发生的底层剧变。

一方面,AI 的计算与生成速度正在经历一场“暴泻”。OpenAI 的 GPT-5.6 Sol 极速模式把 API 生成速度直接飙到了每秒 750 个 token,提升了整整 14 倍;Hark Labs 推出的 Handoff 智能体把输入和输出成本一口气砍掉了 96% 和 92%;甚至像 Compute Exchange 这样的金融机构,都开始推出长达 6 个月的 Token 价格对冲期权合约。单看这些数字,你可能会觉得 AI 资源已经便宜到了像自来水一样的地步。

但另一方面,红杉资本的最新分析却显示:由于推理模型(Reasoning Models)在思考链条中消耗的 token 数量是普通模型的 8 倍以上,算力市场的“焦文斯悖论”(Jevons Paradox)被彻底激活了——因为单价便宜了,大家调用的频次和深度呈指数级暴增,导致 H100 显卡租赁价格反而从之前的低点反弹了 40%。更夸张的是,Peter Diamandis 今天抛出了一个非常有穿透力的判断:“记忆,而非算力,才是智能体(Agent)时代真正的速率限制器(Rate Limiter)。”

这就引出了今天我想和你聊的核心判断:大模型的上半场,是在比拼‘跑得有多快、算得有多便宜’;而智能体时代的下半场,物理瓶颈已经从‘算力规模’彻底转向了‘跨期记忆’与‘组织流程重构’。

为什么这么说?我们可以从技术、工具和组织三个层面来剖析这个转变。

第一,从技术层面看,当模型生成速度达到每秒 750 个 token 时,人类的阅读速度已经完全跟不上了。这就意味着未来的 AI 交互形态不再是“人向大模型发一条指令、大模型回一段话”,而是“几十个智能体之间以毫秒级速度进行大规模并发对话与协同决策”。这时候,决定整个系统成败的不再是模型回答得快不快,而是这 20 个智能体在经历了几百轮对话之后,能不能准确记住三个星期前的架构设计底线,能不能在跨会话(Cross-Session)的过程中不发生上下文漂移(Context Drift)。现在很多企业抱怨买了大模型却见不到效率提升,根本原因不是模型不够聪明,而是智能体处于一种“高度聪明但严重失忆”的状态。

第二,从工具层面看,这种“记忆瓶颈”正在快速淘汰过去两年的旧生产力范式。最近硅谷开发者圈子发生了一场非常有代表性的争论:曾经被无数技术人奉为神作的个人笔记软件 Obsidian,正在被越来越多的高级工程师抛弃。原因很简单,Obsidian 是为“人脑检索”设计的,它要求你手动打标签、建立双向链接。但在今天的开发环境中,一个工程师每天要调度十几个 Agent 帮他写代码、做测试、部署云服务。人类根本没有精力去手动维护几千篇 Markdown 笔记。现在的行业前沿正在快速转向像 AgentsView 这样的“多 Agent 跨期记忆中间件”。我们需要的是一个能够自动把不同智能体的运行日志、历史决策、代码变量沉淀为长期向量记忆的底层基础设施。没有这个基础设施,任何复杂的 Agent 工作流都是空中楼阁。

第三,从组织层面看,这也彻底击碎了过去一段时间被过度神化的“独立创客(Solo Hacker)”模式。很多人以为,只要有了 Copilot,有了便宜的 API,一个人就能凭一己之力取代一个 50 人的大厂团队。但波士顿咨询(BCG)在最新的技术采纳报告中给出了一个很残忍的真相:仅仅为员工购买 Copilot 账号,只能带来 5% 到 10% 的局部边际提升;只有对整个企业的业务流程进行彻底的“流程重构(Process Reshaping)”,才能兑现 AI 的颠覆性生产力。

那些停留在单打独斗模式下的独立开发者,很容易在月经常性收入(MRR)达到三四千美元时撞上天花板,因为个人的精力无法支撑后续客户服务与系统维护的复杂度。真正可怕的,是 Garry Tan 提到的那种“1 个人指挥 20 个具备持久记忆的 Agent”的新型超级小团队。这种团队不仅掌握了廉价的 Token 资源,更建构了一套让 20 个 Agent 能够无缝共享上下文、自主协作的流程架构。他们在几天内完成的产品迭代量,是传统大厂按照标准 Scrum 敏捷流程做三个月都赶不上的。

今天把这几件表面看似不相干的事串起来看,逻辑闭环非常清晰:DeepSeek 的分峰谷计费和 Token 期货合约,标志着算力已经完全演变成了像原油一样的标准化大宗商品;谷歌把 Sheets 变成微应用,意味着代码生成的门槛被彻底抹平;而 Obsidian 的落伍与记忆中间件的兴起,则标志着竞争焦点转向了数据的持久沉淀。

如果今天只能让你记住一件事,那就是:不要再花精力去琢磨哪家模型的 Prompt 怎么写了,也不要陷入单打独斗的工具幻想。未来的竞争,比拼的是谁能率先为自己的业务搭建起‘Agent 跨期记忆库’,并用多 Agent 重构你自己的生产流程。 在算力泛滥的时代,能把记忆留住、把流程缝合好的人,才是这场产业重塑里真正的赢家。

以上就是今天绿洲日报的全部内容,那我们明天再见。