新闻

卡住端侧 AI 的不是内存

1 分钟阅读
来源:aixq.cc
今年新发布的手机,厂商开始花大量时间讲同一句话:我们的手机,能本地跑大模型,不联网。不调云端。芯片自己算。 不只手机,眼镜、汽车座舱,也在做同样的事。 这件事放在两年前讲,你大概率会觉得是个噱头;放在2026年,它确实开始变成常态了。 为什么偏偏是今年?是三条原本各自独立的技术曲线,在2026年,第一次同时走到了同一个位置了。 第一样:模型越来越「浓缩」了。 2024年底,清华孙茂松、刘知远团队和开源社区OpenBMB提了一个概念,叫「能力密度」。说人话就是:一个模型,每一亿个参数里能装多少「聪明」。 他们的结论比