AI NEWS

告别云端依赖,本地AI悄然升温

约2分钟读完 MARS STATION编辑部 · 文:特派员 勇气

导读: 让AI大模型在自己电脑上运行的技术,最近成了开发者圈子里的热门话题。把Gemma 4塞进2GB内存运行的方案,以及Kimi K3开放自行部署的消息,都引发了不少关注。

8GB内存的MacBook Air也能跑260亿参数模型

开发者论坛Hacker News上最近热议的是一款名叫“TurboFieldfare”(涡轮田鸫)的推理引擎。它能让谷歌发布的Gemma 4系列中、拥有260亿参数(这里的“参数”是衡量模型规模的数字,通常越多性能越强,但同时占用的内存也越大)的版本,在搭载苹果自研芯片的Mac电脑上,仅用约2GB内存就能运行。据报道,这套方案在内存只有8GB的入门款MacBook Air(M2芯片)上也已经过实测验证。

之所以能做到这一点,是因为Gemma 4 26B采用了“MoE(混合专家)”架构。这类模型虽然总参数量高达260亿,但实际生成一次回答时,真正被调用的部分只占一小块(这个模型约合38.8亿参数)。TurboFieldfare的做法是,只把始终会用到的公共部分(比如嵌入层和注意力机制,加起来约1.35GB)常驻内存,其余部分则按需从硬盘读取,从而大幅压低了内存占用。处理速度约为每秒5到6个词,虽说不适合实时对话,但据报道用来读文档摘要或做代码审查已经绰绰有余。

2.8万亿参数的Kimi K3也开放自行部署

另一个引发热议的是中国Moonshot AI公司开发的“Kimi K3”。它7月16日先以云端付费服务的形式亮相,到7月26日,模型本体(权重)被正式公开,企业和个人由此可以在自己的服务器上“自行部署”运行。它的参数量高达2.8万亿,是迄今公开发布过的模型中规模最大的之一。能处理长达100万个token(衡量文本长度的单位)的超长上下文、具备图像理解能力,还能完成长时间、较为复杂的工具调用,都是它被关注的重点。

不过,想靠一台个人电脑来运行它并不现实。据报道,要以完整规模运行,至少需要8块高性能GPU“H100”打底,而发布后的最初几天里,能在不明显损失性能的前提下大幅压缩体积的量化版本(GGUF格式)也还未见踪影。如果手头设备不够用,比较现实的选择包括通过OpenRouter、Together AI、Fireworks AI等云端托管服务调用,或者改用体积更轻的“Kimi K2.7 Code”自行部署。

“不依赖大厂云端”的AI越来越受关注

这些案例的共同点,是开发者社区越来越希望把AI的计算过程留在自己手边,而不是完全交给大型IT企业的云端服务。在Hacker News、Reddit等开发者社区里,围绕本地部署的实测数据和调优方法的讨论明显增多,大家热衷于比较性能、速度和内存占用之间的取舍。

促成这股潮流的原因是多方面的:云端AI服务的使用费用、把数据发送到外部引发的顾虑,也有单纯“想亲手试试看”的技术好奇心。在大型企业争相比拼模型性能的同时,另一股名为“本地AI”的潮流,也正围绕着开发者群体悄然扩散开来。

AI NEWS

自己的电脑也能跑大AI

只有8GB内存的普通电脑,也能跑大模型了;中国的巨型AI「Kimi K3」也能自己搭建运行。

约1分钟读完 MARS STATION编辑部 · 文:特派员 勇气

💡 一句话总结

  • 只有8GB内存的普通Mac电脑,也能运行大型AI「Gemma 4」了
  • 中国的巨型AI「Kimi K3」,现在也能在自己的服务器上运行
  • 越来越多人不想什么都依赖大公司的云端,想自己动手跑AI

小电脑也能跑大AI

一款叫“TurboFieldfare”的新软件,最近在开发者圈子里很火。它能让谷歌做的大型AI「Gemma 4」(有260亿个参数,参数是衡量AI规模的数字,一般越多越聪明),在内存只有8GB的便宜MacBook Air上也能运行。

秘诀在于一种叫“MoE(混合专家)”的设计:AI虽然很大,但每次真正用到的只是其中一小部分。软件只把常用的部分放进内存,其余的用到时才从硬盘读,这样就省了很多内存。速度不算快,但用来读文档、看代码已经够用了。

巨型AI「Kimi K3」也能自己搭建

中国Moonshot AI公司做的「Kimi K3」(有2.8万亿个参数,是目前公开过的最大模型之一)也在7月26日公开了模型本体,可以在自己的服务器上运行。不过要完整运行它,至少得配8块高性能显卡,普通一台电脑很难做到。

不想什么都靠云端的人们

大家这么关注本地运行AI,原因有云端使用费、担心数据被发到外部,也有单纯想自己动手试试的好奇心。大公司比拼AI性能的同时,“自己动手跑AI”的风潮也在开发者中悄悄流行起来。

AI NEWS

小小电脑也能装下大AI

只有8GB的小电脑,现在也能跑很大很大的AI啦。

约1分钟读完 MARS STATION编辑部 · 文:特派员 勇气

发生了什么?

“Gemma 4”是一个很聪明的大电脑脑袋。它平时要住很大的房子。但现在,它能挤进一个很小的房子了。这个房子只有8GB,是最便宜的那种小电脑。为什么可以呢?因为它每次只拿出要用的那一点点。就像去公园玩🎒。你不用把所有玩具都带去。只带今天要玩的那几个就够了。

这是什么意思?

中国还有一个更大的AI,叫“Kimi K3”。它也可以搬到自己家里住了。不过它太大太大了。一台普通小电脑,还装不下它。很多人现在都想:AI不要总住在别人家(云端)。想让AI搬到自己家里来。这样更放心呀。