2026-08-24 日报
前沿科技
1. 阿里配售股份募资 102 亿美元全部投 AI
阿里巴巴 8 月 23 日宣布配售新股筹集 800 亿港元(约 102 亿美元),资金全部投向人工智能。发行面向美国境外投资者,完成后将成为香港上市公司规模最大的一次后续发行,在 2026 年全球后续股票发行里排第三,前面只有 Alphabet 和英特尔。
最先感受到这笔钱的是阿里云和它的硬件供应链——服务器代工厂、内存厂、加速卡供应商。同一天英伟达已经通知服务器厂商,AI 芯片报价将上调约 17%,昨天写的 15%口径在一天内又抬高了两个百分点,推手是内存成本。
用配股而不是发债来承接这一轮资本开支,本身就是信号:摊薄股东权益的代价,被判断为比背上利息更划算。这意味着同样一份算力,今年买回来比三个月前贵一截,而买单的方式正在从利润表挪到资产负债表。对下游的传导也很直接——服务器涨价会顺着云厂商的定价往推理成本上走,最终由调用 API 的人分摊。
配售的定价与认购结果本周落地。更硬的验证点在周三:英伟达财报里的数据中心收入与下季度指引,是检验这类支出有没有被真实需求接住的最近一个数据点。 [#deepdive-candidate]
信源 4:法广 / The Information / Seeking Alpha / 吴说
2. Hugging Face 收到 130 亿美元并购提议
开源模型社区 Hugging Face 正在收到多份并购提议,潜在交易价值达到 130 亿美元(《商业内幕》报道)。它是开放权重生态事实上的默认分发口——模型托管、数据集、推理端点三件事都在一个入口里,谁买下它,谁就同时握住了这三样。也正因如此,一旦并入某家云厂或模型公司,中立性会立刻变成社区争议的第一议题。
3. 得州州长称数据中心自掘坟墓
得州州长阿博特在美国广播公司节目上说,数据中心公司"自掘坟墓",没能争取到社区支持,如今遭到的反弹是自找的。他本人曾是这轮热潮最积极的招商者之一。同一个方向调头的还有宾州州长夏皮罗,去年为亚马逊 200 亿美元的数据中心项目站台,本周出台了新的限制条件;纽约州长霍楚尔上月下令对超大规模数据中心停批一年。地方政治正在从算力扩张的助力变成阻力,而且是跨党派的。
4. Vitalik 新版以太坊路线图把量子安全提前
新版 Strawmap 与原路线图整体重合度仍高,变化集中在优先级:量子安全被提前,VDF 与部分 EVM 改进降级,Verkle 与状态过期被更优的构造替代。新增的重点包括隐私、后量子背景下的扩容、规范精简化、Blob 与 Gas 期货,以及原生 Rollup。往下的演进主线是 STARK、AI 辅助的形式化验证和专门化扩容机制。
学术研究
1.τ_0-VLA:用世界模型引导的测试时计算做分层机器人策略
核心:把高层子任务生成变成一个可以按难度追加算力的推理问题。
摘要:长程操作要求机器人既可靠执行单项技能,也能把技能连贯地串起来。多数分层视觉-语言-动作模型每步决策只做一次前向传播,遇到困难或后果重大的选择时没有机制多分配算力。τ_0-VLA 让高层策略借助执行记忆生成子任务,必要时先在若干备选之间搜索再定稿,低层策略跨多种机器人本体执行该子任务。训练用了 40115 小时的异构真实数据,配合多模态联合训练。
AI 摘要:一个分层视觉-语言-动作模型,通过世界模型引导的测试时搜索为高层子任务决策扩展算力,从而改善长程机器人操作。
评析:把测试时扩展从语言推理搬到机器人分层控制,切口选得准——长程任务的成败往往由少数几个分叉点决定,而不是每一帧都值得多想。摘要给出的证据链是子任务预测准确率提升并转化为闭环成功率提升,但没有报告搜索带来的延迟代价,而实机操作对这一项最敏感。40115 小时数据的构成也没有拆开——跨本体泛化里数据规模和测试时搜索各占多少功劳,这条归因链留了空白。
2.嵌入模型的两难:大模型更强,但贵多少
核心:十款大模型对二十六款嵌入模型的成本对齐比较,总分基本打平,价格差三个数量级。
摘要:比较覆盖六个家族的十款大模型和 118M 到 14B 参数的二十六款嵌入模型,在分类、语义文本相似度、聚类、配对分类、检索共 37 项任务上对齐评测。总分上两条路线打平,最好的大模型 Gemini 3.1 Pro 得 77.6,最好的嵌入模型 77.2。分工上有差异:大模型在需要推理的检索上领先,嵌入模型在分类上领先,其余三类持平。代价一侧,跑一遍基准大模型最高要 154 美元,同等质量的嵌入模型只要 0.11 美元,相差 1431 倍;受测的开源大模型在同一块 GPU 上处理 token 的速度慢 2.5 到 736 倍。推理 token 占大模型推理成本的 28%到 81%。
AI 摘要:大模型与专用嵌入模型在多任务上的总体表现几乎一致,但嵌入模型便宜得多也快得多,支持按任务类型分工。
评析:结论本身不意外,价值在于把"贵多少"钉到了 1431 倍这个量级,此前这类讨论多半停在定性。消融部分还给出一条能直接用的结果:调低推理预算对多数模型的检索质量没有损害甚至有改善,说明当前的默认推理开销是浪费的。局限在于任务全部来自那五类标准评测,长文档与领域私有语料上的差距摘要没有覆盖,而那恰恰是工业检索最常见的场景。
3.TinyCast:十四万参数的零样本概率预测器
核心:周期结构与其让模型学,不如直接算出来,省下的容量留给其余部分。
摘要:TinyCast 是一个无注意力的零样本预测器,从 146505 个参数里给出预测分布。零参数的谱检测器提供主导周期,上下文按其相位折叠,剩下的部分由空洞卷积编码器和分块自回归分位数解码器建模。它比 GIFT-Eval 榜上所有能确认参数量的零样本条目都小;在声明无测试集泄漏的零样本条目里,它是唯一一个参数量低于 1.4M 还能给出预测分布的。在 Chronos-ZS 和 fev-bench 上,排在它前面的每个神经模型参数量至少是它的 28 倍。因为混合路径只有卷积和矩阵乘法,它可以导出成静态 INT8,在嵌入式设备上端到端预测,无需逐信号拟合。
AI 摘要:TinyCast 是一个紧凑的无注意力零样本预测器,用谱周期检测和空洞卷积给出预测分布,参数极少且可在嵌入式设备上运行。
评析:分寸感很好的一篇——在十万量级参数下,把周期性交给确定性算法而非学习,是对容量预算的合理分配。可导出成静态 INT8,又不需要逐信号拟合,对边缘侧时序预测是实打实的门槛下移。摘要给的是尺寸-精度前沿上的相对位置,没有给与大参数量预测器的绝对精度差,所以"够用到什么程度"要看具体场景。
4.Chain-of-Experience:让模型在测试时从反馈里持续变好
核心:把测试时的迭代反馈组织成经验链,八个模型上平均提升 5.6%,同时推理成本降 19%。
摘要:常规评测忽略模型在推理时通过交互自我改进的能力。作者把这一设定称为 Chain-of-Experience:模型在与自身或环境的反复交互中积累经验轨迹,形成超出零样本推理的持续改进回路。反馈机制包括模型自反馈,以及正确性、公开编程测试通过率这类环境信号,在数学、编程、知识三类任务上用八个模型评测,含 GPT-5、Gemini-2.5 Pro、Claude-4.5 Sonnet。结果是利用迭代经验稳定优于无反馈基线,仅靠自反馈就有明显收益,整体提升 5.6%,API 成本降低 19%。互补反馈通道叠加还能再涨;基础能力越强的模型改进空间越大;在弱反馈或虚假反馈下模型仍然稳健,且多数收益出现在迭代早期。
AI 摘要:大模型通过被称为经验链的测试时迭代反馈回路持续改进,以更低成本和更高的单位 token 效率超过零样本基线。
评析:关键在"成本同时下降"这一条——多数测试时改进方法是拿算力换分数,这里的账反过来了。多数收益出现在迭代早期,意味着落地时不必设很深的循环。需要留意的是受测模型集中在 GPT-5、Gemini-2.5 Pro 这一档,摘要自己指出改进空间与基础能力正相关,弱模型上的复现结果很可能明显更差。经验轨迹能否跨任务复用——这决定了它是一次性技巧还是可积累的资产——摘要未置一词。
5.NARU:日语超长视频的叙事演进与文化理解基准
核心:1481 道题、155 段共 146.8 小时日语长视频,同时考叙事整合与文化推理。
摘要:长视频理解不止是检索孤立事件,还包括追踪演进中的叙事和解读未被言明的社会含义,而现有基准很少把两者放在一起评,在高语境的非英语媒介上尤其少。NARU 覆盖四个叙事维度和五个文化维度,用基于分层记忆的标注流水线把原始视频转成事件、叙事、文化三层结构化标注,再通过任务导向合成和迭代去捷径生成问题,构建过程含两轮共 68 名母语者核验。八种模型配置的评测显示,长程叙事整合与文化落地推理两项都存在明显欠缺。
AI 摘要:NARU 是一个日语长视频基准,通过分层标注流水线和大量母语者核验,评测叙事演进与文化推理。
评析:把文化维度和叙事维度分开评是必要的——前者考的是模型见没见过足够的语境,后者考的是长程状态维护,混在一起就看不出失败发生在哪一层。两轮母语者核验加上迭代去捷径,在这类基准里算扎实做法。摘要只说八种配置都有明显欠缺,没有给分维度分数,"差在哪"仍需回原文。单一语种也限制了结论往其他高语境语言的外推。
6.QuoteBench:匹配的分数如何掩盖命令通路上的失败
核心:同一条回复换一条执行通路重放,成功率能掉 55 到 73 个百分点。
摘要:大模型编程智能体通过接口发出 Bash 命令,而这些接口可能对模型输出做序列化、包装和再解析。仅看匹配后的执行分数,无法区分命令生成错误和生成之后由传输环节引入的失败。QuoteBench 用 56 个源自真实事故的一次性任务、覆盖 14 个事故家族,做最终状态的精确校验,并刻意加入一个不做转义的解析器作为边界。八种同窗口配置下,把同一条回复经由新增解析器重放,成功率下降 55.4 到 73.2 个百分点;披露该边界后,六种配置回收 30.4 到 60.7 个百分点,另外两种为零或略负。前沿模型的原始生成已接近饱和,真正拉开差距的是对边界的适应。GPT-5.6-sol 匹配后仅差 3.6 个百分点,掩盖的是 64.3 个百分点的损伤和 60.7 个百分点的补偿。
AI 摘要:QuoteBench 显示执行边界上的解析错误会显著降低大模型编程智能体的成功率,披露边界有助于恢复表现,说明评测必须考虑部署配置,而不能把匹配分数当作模型的内在属性。
评析:这篇指向的是评测方法学而非模型能力——同一个模型在不同部署通路下排序会反转,26 对可比配置里有一对明确反转、另有四对处在单任务的边缘。对做智能体基础设施的团队,可操作的结论是评测报告必须同时写清生成契约、执行通路、操作点和最终状态校验器。局限也在这里:事故家族只有 14 个、任务 56 项,规模偏小,能否覆盖真实部署里出现的转义情形,还悬着。
国际新闻
1. 伊朗称霍尔木兹海峡将保持关闭
海峡关闭从口头威慑变成了带条件的正式立场。伊朗最高国家安全委员会秘书雷扎伊表示,在华盛顿履行自身承诺之前,霍尔木兹海峡将保持关闭;如果经济战继续,霍尔木兹与波斯湾任何地方都不会出口一滴石油。
同时抬高的还有对第三方的门槛:伊朗方面称,任何参与或支持美国对伊朗经济战的国家,都将被视为敌人,相关行为等同于战争行为。这句话的对象是海湾邻国——它们既是美国制裁体系的执行环节,又直接暴露在海峡的射程内。美国财政部长贝森特将宣布新一轮对伊制裁,德黑兰在制裁生效前夕释放了上调国内燃油价格的信号,这通常是财政端提前收紧的动作。
信源 5:ChainCatcher / 半岛电视台 / 卫报 / 纽约时报 / CNBC
2. 加拿大 9 月 8 日起对美实施等额报复关税
此前只有"会反制"的表态,现在时间和清单都定了下来。加拿大总理卡尼宣布,针对美国对约 200 亿美元加拿大商品加征的 50%关税,等额报复性关税将于 9 月 8 日生效,覆盖美国钢铁、电子产品等品类。安大略、不列颠哥伦比亚、魁北克三省省长均表态支持,呼吁一致对外。
特朗普则指责加拿大多年来对美国农民征收关税,同时抨击加方"享受好处却又不愿成为美国的一部分"。加拿大驻美大使把谈判破裂归因于多项议题上的分歧,而非单一条款。两周的缓冲期意味着 9 月 8 日之前仍有回旋余地,但双方目前都把筹码押在对方先眨眼上。
信源 5:半岛电视台 / ChainCatcher / 卫报 / BBC / 纽约时报
3. 伊朗关联黑客攻击致英国一座电厂停机
英国政府认定,一起造成本国一座发电厂临时停机的网络攻击来自与伊朗有关联的黑客,涉事的是小型发电机组,停机约四天,整体电力系统没有受到威胁。政府已向能源行业公司的负责人作了简报。
报道把这次攻击定位为德黑兰的报复升级,起因是英国允许美国使用其境内基地。攻击选的是最小可承受的目标——小机组、可恢复、不触发集体防御条款,但足以证明进得去。这类"够到但不打满"的动作,通常是谈判桌上的姿态而非军事行动的前奏。
信源 3:卫报 / CNBC / Hacker News
4. 特朗普下令缩减美韩年度联合军演
美韩大幅收缩了年度联合军事演习,起因是特朗普下令削减规模,首尔方面事先并不知情。同期朝鲜在扩充核与导弹能力,并深化与俄罗斯的军事联系。与之并行的是兵力调度:美国正把一艘航空母舰及其他军事资源从印太调往中东。同一批资源不可能同时支撑两个战区,中东的优先级抬升,代价就落在亚洲的安全承诺上。
5. 财政部扩大长债回购未能平抑债市
财政部把长期国债回购规模至少翻倍的意外决定,一度压低了收益率,但大部分降幅很快回吐——投资者质疑的是这项干预能否压过通胀与财政两头的担忧。本质上,回购换的是流动性,而债市在意的是偿付能力,两者不在同一个账本上。
焦点因此挪到本周的杰克逊霍尔:沃什第一次以美联储主席身份讲话,市场想听的是联储怎么看财政部在债市里越来越主动的角色。这个问题的另一面是,货币政策要不要给财政政策的赤字规模背书。
信源 2:MarketWatch / Bloomberg
美股
1. 英伟达周三财报成 AI 叙事的方向盘
英伟达周三发布财报,同周还有 Marvell、Zoom、小鹏等公司。BitMine 董事长汤姆·李在 CNBC 节目上说,下周可能是股市的转折点:AI 股票交易已经陷入停滞,压制来自数据中心担忧和美国国内的政治反对情绪,关键在于停滞之后信心能否回来。标普 500 近期在 7678 点附近徘徊,本周累计下跌约 1.4%。
一句话:这周不是一家公司的财报,是整条 AI 资本开支链条的对账日。此外,接下来一系列美联储官员的公开露面构成另一条独立的信号线,与财报共同决定风险资产的短期方向。
信源 3:MarketWatch / Seeking Alpha / ChainCatcher
2. 宇树上市首日涨 460%并非中国打新特例
人形机器人公司宇树科技(Unitree)周三在上海上市,首日收涨 460%。上月长鑫存储(CXMT)首日涨 472%,量级相当。表面上,这两个数字既反映中国投资者对科技板块的热情,也印证了北京扶持本土冠军、降低对美技术依赖的策略见效。报道的落点是,这只是故事的一部分——首日涨幅不能简单读成市场对公司基本面的定价。
3. 美国买家以数十年最快速度收购欧洲资管公司
欧洲基金公司在规模化与全球化的竞赛中处境艰难,美国买家正以数十年来最快的节奏把它们买走。换个说法:资产管理这门生意的规模门槛已经抬到欧洲本土玩家单独扛不动,卖身成了扩表最快的路径。
4. 杠杆单股 ETF 在芯片股回调中获数十亿美元流入
芯片股抛售期间,杠杆型单股 ETF(放大单只股票日内涨跌的基金)在自身大幅下跌的同时,仍吸引到数十亿美元净流入。资金不是在避险,而是在用更高的杠杆去接下跌的那一段。
WEB3
1. 欧盟评估把 DeFi 借贷与金库纳入 MiCA
欧盟委员会正在评估是否将加密借贷(含 DeFi 金库)纳入《加密资产市场法规》(MiCA)。定向磋商 5 月 20 日启动,反馈截止 9 月 30 日。MiCA 原本把加密借贷排除在外,并部分排除完全去中心化的活动,布鲁塞尔现在要补的正是这两块空白。
难点在法律主体的认定。欧盟法律里没有"金库"这一类别,只能按功能而非标签界定;而金库把借贷的经济功能分散在智能合约与多个角色之间——Morpho Vault V2:所有者、策展人、分配者、哨兵各管一段,找不到单一的受监管主体。业内的担忧是把"DeFi 借贷"当成单一标签纳入,会让结构完全不同的产品被一刀切。
信源 2:ChainCatcher / 吴说
2. 波兰交易所两任负责人四年内相继失踪
波兰加密交易所 Zondacrypto (前身 BitBay)的创始人 Sylwester Suszek 于 2022 年 3 月失踪,失踪前给妹妹留下过一段绝望的语音留言,家人怀疑他已遇害。接手公司的律师 Przemyslaw Kral 目前也已失联四个月。
Kral 失联前曾录视频安慰客户,称公司持有价值超 3.3 亿美元的比特币——但唯一掌握解锁密钥的人,正是已经失踪的 Suszek。网站在 4 月前后关闭,两个月后的 6 月 29 日,爱沙尼亚金融情报单位吊销了其母公司的许可证。托管型交易所的单点故障风险,在这个案子里被推到了极端:密钥集中在一个人手里,人不见了,牌照和资产一起悬空。
信源 3:纽约时报 / ChainCatcher / 吴说
3. 美国银行业游说把稳定币二级市场纳入身份识别
代表摩根大通、美国银行、富国银行与花旗的银行政策研究所(BPI),联同清算所协会向财政部金融犯罪执法网络(FinCEN)提交意见函,建议把客户身份识别计划扩大到稳定币二级市场,覆盖直接与散户建立账户关系的交易所和其他平台。BPI 的理由是,支付型稳定币生态里大量买卖发生在这些平台上,非法活动也多数发生于此。
若提议被写进规则,相关平台须依据《银行保密法》收集客户信息,去中心化交易所也可能被纳入监管范围。FinCEN 的拟议规则本身承认了执行难点:链上二级市场交易普遍使用匿名或假名身份,不存在集中收集身份信息的节点,发行方能拿到的二级市场客户资料有限。翻译一下:银行想让稳定币的入口按银行的规矩办,而链上恰恰没有那个可以设卡的入口。BPI 此前也曾反对现行版本的《数字资产市场清晰法案》。
信源 2:ChainCatcher / 吴说
4. Bybit 就 15 亿美元被盗案在美起诉朝鲜
Bybit 就 15 亿美元 ETH 被盗一案在美国起诉朝鲜、朝鲜侦察总局和 Lazarus Group,同时列入 20 名匿名被告("John Doe")。后面这一步才是重点——匿名被告位可以用来锁定持有可追踪赃款的钱包,以及这些钱包所在的交易所与托管机构。主权豁免、执行难度和链上洗钱路径决定了全额追回几乎不现实,但民事诉讼能拿到法院禁令、加速证据开示、推动资产冻结,并形成一份官方的责任认定。对涉币追赃而言,可借鉴的是时间窗口极短,民事保全和刑事追查应当尽早并行。
5. Term Finance 治理攻击损失 850 万美元
去中心化固定利率借贷协议 Term Finance 的开发团队 Term Labs 确认,一起治理漏洞攻击影响了 Term Vaults,目前仍在调查。CertiK 估算损失约 850 万美元,攻击者地址持有 2843 枚 ETH(约 710 万美元)以及约 160 万枚 DAI。
值得拆开看的是防线为什么没起作用:Term 的金库提案设有七天延迟,流动性提供者还可以否决,这两道控制在设计上足以挡住常规的治理提案攻击,实际却没有拦住。时间锁的价值取决于有没有人在这七天里真的盯着提案。
信源 3:The Block / ChainCatcher / 吴说
其他重大新闻
1. Shein 香港 IPO 拟募资至多 18 亿美元
Shein 在香港首次公开发行中寻求募资至多 139 亿港元(18 亿美元),这场漫长的上市长跑进入最后一段。
2. 特朗普 6 月完成逾 1000 笔证券交易
美国政府道德办公室周六公布的财务披露显示,特朗普 6 月进行了逾 1000 笔证券交易,总额介于 7810 万至 2.631 亿美元,买入标的包括伯克希尔哈撒韦、Visa、万事达卡和 Cintas。最大一笔是 6 月 22 日出售价值 500 万至 2500 万美元的先锋领航 ETF。Palantir 上有一组来回操作:6 月 3 日买入 1001 至 15000 美元,16 日和 18 日分两笔卖出,23 日和 24 日又买回。其他标的还有 Coinbase、Meta 和家得宝。2025 年全年的交易笔数超过 21000 笔,总值 6 亿至 18.6 亿美元。
白宫的说法是这些账户由独立机构管理、以计算机模型组合复制股指,不存在利益冲突;其子埃里克表示资产已置于保密信托。争议点不在单笔交易本身,而在于总统同时是关税、监管和货币政策的决策者。
信源 4:华尔街日报 / ChainCatcher / 吴说 / Seeking Alpha
3. 民调公司承认伪造两场选战调查结果
一家此前几乎没有公开记录的民调机构 Median Strategies 本周承认,它伪造了两场重头选战的调查结果,随后又称整场操作是一次关于错误信息的"短期社会实验"。其中一份假民调显示民主社会主义者洪(Francesca Hong)在威斯康星州民主党州长初选中领先,数据很快被政治讨论吸收进去。
民调之所以能被伪造并流通,是因为它同时具备两个特征:数据形态自带可信度,而生产成本几乎为零。当合成内容的产能远高于核验产能时,被污染的不只是某一场选举的判断,而是人们据以理解政治、商业和文化的信号本身。
4. Moderna 个性化癌症疫苗预期跑在数据前面
个性化 mRNA 疫苗的适用范围和赚钱能力,可能都不如市场此前预期的那样宽、那样厚。
5. Paramount 与加州总检察长周一谈和解
Paramount 与加州总检察长办公室定于周一会面,讨论就 Paramount 收购华纳兄弟探索(Warner Bros. Discovery)一案的反垄断诉讼达成和解。
跨资产快照(2026-08-24)
- VIX 15.13(-5.5%单日 / +6.2%本周)— 周末休市,读数停在上周五收盘,恐慌指数仍在本月区间下沿
- 美元指数 98.84(+0.1%单日 / -0.8%本周)— 全周小幅走弱,关税消息没能把美元拉起来
- 10 年期美债收益率 4.74%(+4bp 单日 / +4bp 本周)— 停在本月高位,回购扩容没能把它压下去
- 2 年期美债收益率 4.19%(0bp 单日 / +4bp 本周)— 数据截至 8 月 20 日,短期与长期利率本周同步走高
- 黄金 4681 美元(+2.0%单日 / +5.5%本周)— 单日再上一台阶,位于近十日区间上沿,与利率同步走高的组合不常见
- 西德克萨斯中质原油 87.06 美元(+0.7%单日 / +5.7%本周)— 连涨的定价对象是海峡封锁风险,而非实际断供
- 加密恐贪指数 66(贪婪)(-5 单日 / +32 本周)— 一周内从恐惧穿到贪婪,情绪切换快过价格
- 下次 FOMC(9 月 15 日) 隐含利率 3.72% — 会前 3.63%,市场押注的方向仍是小幅加息