• 周日. 9 月 13th, 2026

人工智能

  • 主页
  • 投机解码:让大模型推理悄悄快一倍

投机解码:让大模型推理悄悄快一倍

在大模型推理这件事上,算力不是堆不出来的,而是省出来的。投机…

扩散模型缩进手机:蒸馏一代的算力账怎么算

把 Stable Diffusion 这种参数量几十亿的生成…

AI 写代码 5 大幻觉:你以为它在思考,其实它在背答案

AI 写代码看似在推理,背后多半是训练语料的复读机——5 类…

AI 分词的下一程:从字符到短语的四级演化

AI 大模型把同一段文字切成越来越大的单元——字符、子词、词…

把大模型拆成「可读电路」:稀疏字典的下一步

当稀疏自编码器把数十亿参数压缩进一张可被人类浏览的特征地图,…

合成数据的下一站:把论文’拆’成训练轨迹

一篇论文能变成什么?旧思路是改写、是翻译、是把句子打散重排。…

模型学完新技能,为何把旧本事忘光

模型学完外语就忘母语,背完新条款就忘算术。这种被戏称为「金鱼…

工具海洋里,AI 智能体为何总选错

当一个大模型被绑上一百个工具,它在 30% 的任务里会选错第…

测试时算力堆得越高,模型为何反而撞上天花板

过去两年大模型靠推理时多算一点把分数推上去,但再往上堆算力,…

小模型为何学不会老师的「慢思考」

把一个会做长链推理的大模型蒸馏成 1.5B 的小模型时,推理…