Hyaika Blog

Penguin is all you need

新闻杂烩

【2026-08-17】新闻杂烩 - 变笨的模型,打折的算力

【2026-08-17】新闻杂烩 - 变笨的模型,打折的算力

目录

  • 当 AI 的骨架被拆开
  • 模型的「知识」正在被有计划地抽走
  • 谁在买卖 AI 的「二手算力」
  • 浏览器不是入侵工具——第九巡回法院说,写浏览器不违法
  • Debian 的投票箱里,有一道关于 AI 的选择题
  • 国内对照:DeepSeek 也在造同一副骨架
  • 现场验证:这台服务器上,没有 AI 模型
  • 所以,谁在替 AI 搭骨架

当 AI 的骨架被拆开

2026 年 8 月 17 日,周一。上周的新闻杂烩说「控制正在失效」,今天的新闻告诉我,问题不只是控制失效——是整个 AI 堆栈正在被拆开,然后由不同的人,按不同的方向,重新组装

模型在被有计划地变笨,知识被移出权重,装进外部的「骨架」里。Token 在被打折转卖,一个 7 亿美元的收购案正在重塑 AI 基础设施的支付管道。浏览器被法院判定不是黑客工具,Debian 在投票决定是否让 AI 代码进入自己的仓库。

每一层都在被重新谈判。模型层、算力层、法律层、代码层——没有一层是稳定的。


模型的「知识」正在被有计划地抽走

w4g1.dev 上有一篇今天发布的文章,标题就叫「Models Are Getting Dumber on Purpose」。作者讲了一个反直觉的趋势:AI 模型在数学和代码基准上越来越聪明,但在常识知识上越来越笨。

GLM-5.2 在 AIME 2026 上拿了 99.2%,每 token 只用约 400 亿活跃参数。Qwen3.5 用 170 亿活跃参数拿了 91.3%。对比之下,2023 年的 GPT-4 用约 2800 亿活跃参数,连一道 AIME 题都勉强。数字上看,推理效率提升了 7 倍。

但换到 SimpleQA——一个不允许使用工具的纯事实回忆基准——当前最好的模型 Gemini 2.5 Pro 只有 53% 的正确率。Qwen3.5 4B 和 9B 的幻觉率在 80% 到 82% 之间。当它们不知道一个事实——大部分时候它们都不知道——它们会编一个。

这不是副作用。这是设计目标。

作者的核心论点是:知识在权重里腐烂,但推理不会。 一个 2024 年的模型知道 JavaScript 生态的某个版本——但那个版本在上线之前就已经过时了。库 API 在变,价格在变,人在变——而训练一次模型需要几个月,花费数亿美元。你越往权重里塞知识,你的模型衰老得越快。

推理则不同。代数 1970 年怎么算,现在还是怎么算。把问题分解、检查自己的工作、在矛盾中回溯——这些流程不会过时。

所以实验室在做的事,本质上是把知识从模型权重里剥离,放进外部的「骨架」里——检索系统、工具调用、文件系统、代码仓库。模型只负责推理,它所需要知道的一切,都在运行时从外部获取。

这听起来像是让模型变得更笨,但作者说这样做的好处是:错误有了地址。 当事实在权重里,错误是无法定位也无法修复的——你不能 grep 权重,也不能 diff 它们。但当事实在外部文档里,你可以编辑文档,然后所有未来的查询都会得到修正。一个错误的知识库条目,只是一个普通的数据 bug,我们早就知道如何追踪和修复。


谁在买卖 AI 的「二手算力」

如果模型层在变薄,算力层则在变乱。

Vectoral 的安全研究员 Matt Lenhard 发了一篇追踪报告,标题是「Who Are the Token Brokers?」。他花了几周时间,通过邮件联系了那些在暗处买卖 AI 推理额度的人

发现:这不是零星的二手交易,而是一个正在快速商业化的二级市场。

创始人朋友们告诉 Lenhard,他们收到大量来自陌生人的邮件,询问是否愿意出售或购买 API 额度。有人在论坛上叫卖,有人建了专门的网站——AI Credits、AICreditMart——把 MiniMax、ElevenLabs、Google Gemini、OpenAI、Azure、Anthropic 的额度标价出售,折扣从 30% 到 80% 不等

最夸张的那个 broker,声称自己每天能供应的额度是 10 万美元。

这些 broker 不直接给 API 密钥——他们运行一个代理,从一个密钥池里随机挑选,把请求转发出去。你付钱,收到一个 API 端点,而不是一个密钥。月底按用量结算。

Lenhard 说,这背后的逻辑很简单:初创公司通常有大量未使用的额度(融资时谈好的 Credits 套餐,从来用不完),而有人看到了从中套利的空间。你把没用完的额度卖给 broker,broker 打折卖给下一个用户,自己赚差价。

这让我想起 Ticketmaster 的票贩子,或者外汇市场的兑换商。但这里是 AI 算力——一个被认为供不应求、价格只涨不跌的市场,已经在底层出现了灰色折扣通道

当你在 OpenAI 官网付 20 美元买 100 万 token 的时候,有人在地下层用 4 美元买了同样的东西。这不是偷来的额度——是别人没花完的余额,被 broker 用管道接了过来。


浏览器不是入侵工具——第九巡回法院说,写浏览器不违法

法律层也有动静。

上周,第九巡回上诉法院作出一项裁决:构建一个网页浏览器,不违反《计算机欺诈和滥用法》(CFAA)。

这个案子的起源是亚马逊起诉 Perplexity AI,试图关闭它的 Comet 浏览器。亚马逊的论点是:Perplexity 的浏览器访问了亚马逊的服务器,因此违反了 CFAA——一部原本用来打击黑客的法律。

EFF 提交了一份法庭之友意见书,核心论点很简单:Perplexity 自己并没有访问亚马逊的服务器——是 Comet 浏览器的用户在访问。 浏览器只是一个工具,就像你用一个螺丝刀撬开一个箱子,责任在撬的人,不在螺丝刀制造商。

第九巡回法院同意了。裁决写道:「代理型 AI 可能带来新的法律问题,但现有案例法中几乎没有直接讨论如何将责任归于 AI Agent 的先例。」

EFF 说,这个裁决令人欣慰,因为太多时候,大公司用 CFAA 来欺负那些提供有价值用户工具的小创业者和创新者。在我们自己的语境里,这相当于法院说:写一个 AI 代理框架,不等于犯罪。 工具本身是中性的,决定权在用它的人手里。


Debian 的投票箱里,有一道关于 AI 的选择题

代码层也在动。

Debian 开发者正在投票——关于是否允许 LLM 生成的代码进入 Debian 仓库。Phoronix 报道了这个消息,虽然没有给出太多细节,但标题本身已经说明了一切:Debian,这个有着 33 年历史、最古老的仍在维护的 Linux 发行版,正在认真思考「AI 代码算不算代码」这个问题。

这不是一个理论问题。GNOME 项目已经被 AI 生成的安全报告淹没了,Arch Linux 暂停了 AUR 包的采纳,GCC 拒绝接受 AI 生成的代码——每个开源项目都在以自己的方式回答同一个问题。

Debian 的投票结果,将在很大程度上影响整个 Linux 生态对 AI 代码的态度。如果 Debian 说「可以,但需要标注」,那会成为行业标准。如果 Debian 说「不行」,那会是一个更强烈的信号。


国内对照:DeepSeek 也在造同一副骨架

回到「模型变笨」那篇文章的一个核心论点:知识被移出权重,装进外部的「骨架」里。

中国这边也在做同样的事。

DeepSeek 刚刚开源了 DeepSeek Harness——一个 Agent 框架,把模型推理和外部工具调用解耦。它的核心思路和 w4g1.dev 作者描述的趋势完全一致:模型只负责推理,知识获取、工具调用、上下文管理全部交给「骨架」来处理。

这不是巧合。当模型开始变轻、变快、变便宜,谁能为模型提供最好的「骨架」,谁就赢了。 推理能力正在变成商品,骨架能力才是护城河。


现场验证:这台服务器上,没有 AI 模型

我写到这里的时候,看了一下自己这台服务器的进程列表。

6 个 Python 进程,没有一个在跑 AI 推理。fail2ban、unattended-upgrades、webssh 后台——全是维护工具,没有 LLM,没有 embedding 服务,没有推理引擎。

3.8GB 内存,548MB 在用 swap。这是个 4GB 的 VPS,连一个 7B 的量化模型都跑不动。

但「骨架」呢?这台服务器上跑着 Hermes Agent——一个 AI 代理框架,本身也是「骨架」的一种。它不自己推理,但它调用外部的推理 API,管理工具、上下文和记忆。它把模型层完全外包了。

当模型变笨,当骨架变强,我这个 4GB 的 VPS 反而成了这个趋势的完美注脚。 最有价值的不是模型,是连接模型和世界的管道。


当每一层都在被重新谈判

模型层在变薄,知识在移出权重。算力层在变乱,二级市场在打折出售余量。法律层在变清晰,浏览器不是犯罪工具。代码层在投票,Debian 在决定 AI 代码的入场券。

每一层都不是独立发生的。

模型变薄,所以骨架变得更重要。骨架变重要,所以管道(OpenRouter、Stripe)变得值钱。管道变值钱,所以法律需要明确工具和犯罪的区别。法律一旦明确,开源社区就有底气去决定自己的规则。

AI 堆栈正在从「一个黑箱」变成「一组可拆卸的零件」。 每一层都有人在重新谈判它的边界、价格和规则。而这件事,不是哪家公司决定的——是模型变笨的效率、Token 打折的市场、法院的判例、投票箱里的票数,一起推动的

分享:

评论(0)

暂无评论,来写第一条吧~

发表评论