🤖 AI

告别云端依赖,本地AI悄然升温

约2分钟读完 MARS STATION编辑部 · 文:特派员 勇气

导读: 让AI大模型在自己电脑上运行的技术,最近成了开发者圈子里的热门话题。把Gemma 4塞进2GB内存运行的方案,以及Kimi K3开放自行部署的消息,都引发了不少关注。

8GB内存的MacBook Air也能跑260亿参数模型

开发者论坛Hacker News上最近热议的是一款名叫“TurboFieldfare”(涡轮田鸫)的推理引擎。它能让谷歌发布的Gemma 4系列中、拥有260亿参数(这里的“参数”是衡量模型规模的数字,通常越多性能越强,但同时占用的内存也越大)的版本,在搭载苹果自研芯片的Mac电脑上,仅用约2GB内存就能运行。据报道,这套方案在内存只有8GB的入门款MacBook Air(M2芯片)上也已经过实测验证。

之所以能做到这一点,是因为Gemma 4 26B采用了“MoE(混合专家)”架构。这类模型虽然总参数量高达260亿,但实际生成一次回答时,真正被调用的部分只占一小块(这个模型约合38.8亿参数)。TurboFieldfare的做法是,只把始终会用到的公共部分(比如嵌入层和注意力机制,加起来约1.35GB)常驻内存,其余部分则按需从硬盘读取,从而大幅压低了内存占用。处理速度约为每秒5到6个词,虽说不适合实时对话,但据报道用来读文档摘要或做代码审查已经绰绰有余。

2.8万亿参数的Kimi K3也开放自行部署

另一个引发热议的是中国Moonshot AI公司开发的“Kimi K3”。它7月16日先以云端付费服务的形式亮相,到7月26日,模型本体(权重)被正式公开,企业和个人由此可以在自己的服务器上“自行部署”运行。它的参数量高达2.8万亿,是迄今公开发布过的模型中规模最大的之一。能处理长达100万个token(衡量文本长度的单位)的超长上下文、具备图像理解能力,还能完成长时间、较为复杂的工具调用,都是它被关注的重点。

不过,想靠一台个人电脑来运行它并不现实。据报道,要以完整规模运行,至少需要8块高性能GPU“H100”打底,而发布后的最初几天里,能在不明显损失性能的前提下大幅压缩体积的量化版本(GGUF格式)也还未见踪影。如果手头设备不够用,比较现实的选择包括通过OpenRouter、Together AI、Fireworks AI等云端托管服务调用,或者改用体积更轻的“Kimi K2.7 Code”自行部署。

“不依赖大厂云端”的AI越来越受关注

这些案例的共同点,是开发者社区越来越希望把AI的计算过程留在自己手边,而不是完全交给大型IT企业的云端服务。在Hacker News、Reddit等开发者社区里,围绕本地部署的实测数据和调优方法的讨论明显增多,大家热衷于比较性能、速度和内存占用之间的取舍。

促成这股潮流的原因是多方面的:云端AI服务的使用费用、把数据发送到外部引发的顾虑,也有单纯“想亲手试试看”的技术好奇心。在大型企业争相比拼模型性能的同时,另一股名为“本地AI”的潮流,也正围绕着开发者群体悄然扩散开来。

🤖 AI

自己电脑跑AI,成开发者新热潮

📰 完整报道: 告别云端依赖,本地AI悄然升温

8GB内存的普通Mac也能跑大型AI了。中国的Kimi K3现在也能自己搭建运行。

约1分钟读完 MARS STATION编辑部 · 文:特派员 勇气

💡 一句话总结

  • 一款叫TurboFieldfare的工具,让大型AI「Gemma 4」能在8GB内存的Mac上运行
  • 中国的巨型AI「Kimi K3」现在也能在自己的服务器上运行了
  • 越来越多开发者想自己运行AI,而不是全靠大公司的云端

为什么小小的Mac也能跑大AI

一款名叫TurboFieldfare的新工具,最近在开发者中很受关注。它能让谷歌的大型AI「Gemma 4」,在内存只有8GB的入门款MacBook Air上运行。秘密在于一种叫“混合专家”的设计。整个AI模型中,真正被用到的部分其实只是一小块。于是TurboFieldfare只把常用的那一小块留在内存里。其余部分需要时才从硬盘读取,这样就大大省下了内存。回复速度比较慢,但据报道,用来整理文档已经够用了。

巨型AI「Kimi K3」也能自己搭建

中国Moonshot AI公司7月26日公开了旗下巨型AI「Kimi K3」的模型本体。这意味着企业和个人都能在自己的服务器上运行它,不用再依赖云端服务。不过,要以完整规模运行,至少需要8块高性能GPU,普通家用电脑一台还远远不够。

为什么不想全靠云端

开发者说,云端AI服务的费用,以及把数据发给外部服务器的担心,是这股潮流的两大原因。单纯的好奇心也是原因之一。大公司争相打造更大的AI模型的同时,一股安静的潮流也在悄悄壮大:在自己拥有的设备上运行AI。

🤖 AI

小小电脑也能装下大AI

📰 完整报道: 告别云端依赖,本地AI悄然升温

只有8GB的小电脑,现在也能跑很大很大的AI啦。

约1分钟读完 MARS STATION编辑部 · 文:特派员 勇气

发生了什么?

“Gemma 4”是一个很聪明的大电脑脑袋。它平时要住很大的房子。但现在,它能挤进一个很小的房子了。这个房子只有8GB,是最便宜的那种小电脑。为什么可以呢?因为它每次只拿出要用的那一点点。就像去公园玩🎒。你不用把所有玩具都带去。只带今天要玩的那几个就够了。

这是什么意思?

中国还有一个更大的AI,叫“Kimi K3”。它也可以搬到自己家里住了。不过它太大太大了。一台普通小电脑,还装不下它。很多人现在都想:AI不要总住在别人家(云端)。想让AI搬到自己家里来。这样更放心呀。

来源