← 返回文章列表

2100元主机稳定运行谷歌Gemma3-27B大模型,一体机厂家要哭了!

2100元主机稳定运行谷歌Gemma327B大模型,一体机厂家要哭了! 大家好,我就是九歌AI。一个会写代码的产品经理。 今天我又手痒了,看到一条消息,谷歌直接把Gemma3全家桶都开源了! 在巴黎开

AI编程商业
2100元主机稳定运行谷歌Gemma3-27B大模型,一体机厂家要哭了!

2100元主机稳定运行谷歌Gemma3-27B大模型,一体机厂家要哭了!

大家好,我就是九歌AI。一个会写代码的产品经理。

今天我又手痒了,看到一条消息,谷歌直接把Gemma3全家桶都开源了!

在巴黎开发者日上,开源Gemma系模型正式迭代到第三代,原生支持多模态,128k上下文。支持多模态呀!

Gemma 3一共开源了四种参数,1B、4B、12B和27B。最最最关键的是,一块GPU/TPU就能跑模型!!

图片展示的是Gemma 3的标志。标志左侧是一个由线条构成的几何图形,右侧是“Gemma 3”字样,字体为蓝色。该图片位于文档中主机装上Gemma3相关介绍的开头部分,与上下文紧密相关,上下文提到作者打开ollama官网搜Gemma3,光速上线,此图片直观呈现了Gemma 3这一大模型的标识,为后续介绍其在主机上的运行情况做铺垫。

前几天手痒刚用我的2000元洋垃圾主机装了通义千问QwQ 32B,竟然跑起来了,虽然跟老太太一样慢吞吞的,但是能干活呀!

再让我这个主机装上Gemma3 ,会有啥不一样呢(心里的算盘在敲打…)?

主机成本明细如下:

2680V4 CPU 80元 x99主板 200元 三线内存条32G 300元 二线固态硬盘500G 260元 不知名机箱 110元 1060显卡 540元 二线电源 360元 散热器 60元 总计:1910元

激动的心,颤抖的手,百闻不如一一试,我打开ollama官网一搜,竟然光速上线了Gemma3!

图片展示的是ollama官网中Gemma3模型的相关信息。上方显示Gemma3是当前单GPU上最强的模型,有1b、4b、12b、27b四个版本,其中4b版本被选中,显示为3.3GB。下方有7,283次Pulls,更新时间为2小时前。右侧有“ollama run gemma3”命令及模型参数等信息。图片与上下文紧密相关,直观呈现了文档中提到的Gemma3模型在ollama官网的展示情况,为读者提供了具体的数据和版本选择参考。

要啥自行车,直接搞起!下载速度非常快,不到10分钟就下载好了!

ollama run gemma3 

图片展示的是Windows PowerShell界面,显示“管理员: Windows PowerShell”字样,版权信息为“版权所有 (C) Microsoft Corporation. 保留所有权利。”界面中输入了“ollama run gemma3_”命令。该图片与文档中主机运行谷歌Gemma3 - 27B大模型的内容相关,可能是作者在尝试运行大模型时在命令行界面的操作记录,但因未运行起来,导致后续无法进行相关测试。

竟然没运行起来!!提示版本不对!原来ollama要先升级吗?

升级结束。

等等!我下载的好像是4B版本!

那我们先试试4B版本的推理速度吧!竟然高达58token/s,那如果装27B版本,是不是能跑8token/s 😄!

图片展示的是Windows PowerShell界面及系统性能监控窗口。界面中显示命令“ollama run --verbose gemma_”执行中,下方有“公众号#九章AI大模型”字样。右侧是系统性能监控窗口,显示CPU使用率为1%,内存使用率为20%,磁盘C使用率为0%,以太网速度为0 Kbps,GPU 0使用率为1%。该图片与文档中测试大模型推理速度及系统性能监控的内容相关,直观呈现了相关操作及系统状态。

看来太激动了也不好,重新下载27B版本吧,ollama再看看需不需要更新!

经过 4 小时漫长的等待,终于下载完成了。输入提示词!

等了一会没反应!再仔细看,死机了!😂

图片展示了Windows系统中PowerShell窗口及任务管理器界面。PowerShell窗口显示命令“ollama run --model gemma3-27b”,其执行进度为100%,已使用17.08GB内存,CPU使用率2.86GHz,GPU使用率52%。任务管理器中,CPU使用率为1%,内存使用率1.9%,GPU使用率为0.1%。该图片与文档中测试27B版本大模型推理速度时出现死机问题的上下文相关,直观呈现了系统运行状态。

内存条已经满了,32G 太小了!怎么办?就这么放弃了吗?

直接买内存条好像来不及,那样热乎劲就过去了。

我小脑袋一转,一拍大腿,不是还有万能的 xx 吗?为啥不租个差不多配置的洋垃圾,这个搞虚拟机多开的,到处都是!

先是问了已经销量高的,开开心心付完钱,让我实名认证,还要露脸拍视频!我一想,这好家伙,我就租一天电脑,我啥信息也卖了呀!果断拜拜,申请退款 。

图片展示了一段聊天记录。用户询问“安全吗”,对方回复“安全的 我们客户都是实名了的”,并提到有几千客户。下方有安全提醒,称切勿使用第三方工具进行交易,需加强甄别、谨慎使用。用户最后表示“还是有顾虑 算了”,并回复“好吧”。这张图片与上下文的关系是,用户在支付前对安全有所顾虑,通过聊天记录了解到对方是实名制客户,但最终因顾虑未继续操作。

深夜 11 点,终于勾搭上一个老板,太敬业了,我都被他感动了。

图片展示了一段聊天记录。开始是打招呼内容,随后出现“稍等我去开机”的消息。接着,对方表示“好的 以后长合作 我是做模型测评的”,并询问是否需要实名,还提到要拍露脸视频,对方因觉得不安全而放弃。最后显示了远程账号到期时间,为2025年3月13日23:15:01。该图片与上下文紧密相关,呈现了与老板沟通及账号信息相关的内容。

支付一顿排骨米饭后,我如愿获得了一台跟我配置基本相同,但是内存加到了 64G!

下面的就比较顺利了。下载大模型还是慢,不过可以挂机载,先去睡觉😪。

早晨起床后一看,没运行成功,还是需要升级。这次升级直接重启 ollama 就行。

输入下面熟悉的命令,成功了!速度高达1.85token …

图片展示的是Windows任务管理器中GPU相关信息界面。上方显示GPU型号为NVIDIA GeForce GTX 1060 6GB,占用率4%。下方图表呈现了3D、Copy、Video Encode、Video Decode等不同操作的GPU使用情况,其中Video Decode占用率最高。画面底部有“Send a message”按钮。该图与文档中“输入下面熟悉的命令,成功了!速度高达1.85token...”的内容相关,直观呈现了GPU运行状态及使用情况,辅助说明了大模型运行速度。

录了个小视频,大家实际感受下这个速度有多稳定!