来源:互联网 更新时间:2026-07-31 13:17
先说几个核心判断:本地运行大模型这事,门槛比想象中低不少。这篇虽然自称是随手笔记,但把从零搭建Ollama环境、拉取谷歌Gemma模型,再到配上Web UI的过程都串了一遍——截图不少,偶尔漏掉细节也正常,后续遇到问题可以在评论区交流。模型下载方面,如果网络环境受限,可以找我拿提前打包好的现成版本,省去拉模型的等待时间。

直接去Ollama官网,点击
目前支持的常见模型包括:llama2、谷歌的 gemma、通义千问 qwen 等。默认情况下Ollama已加入系统环境变量,直接在命令行里就能调用相关指令,比如查看版本、启动服务、下载和运行模型。
ollama --version # 查看ollama版本
ollama server # 启动后台服务
ollama list # 列出当前已下载的模型
ollama run gemma:7b # 运行gemma 7b模型(本地没有时会自动下载)
模型支持的大致清单如下图:

Gemma是谷歌推出的一组轻量级开源生成式AI模型,基于Gemini技术,适合在移动设备、桌面甚至硬件上直接跑。你可以对它们进行微调,用在特定任务上,比如文本生成、问答等。
具体安装步骤:在Ollama官网右侧点击
ollama run gemma:7b。然后打开命令行(建议在Ollama安装目录下运行),粘贴并执行这条命令,模型大小约5GB+,下载时间取决于网速。完成后,Gemma 7b模型就装好了。
在命令行里直接进入交互模式:
ollama run gemma:7b
然后就可以提问了,比如用中文问“如何学习好英语,看电影美剧有帮助吗?”这里展示下它的回答(保留了原文的完整输出):
学习英语,看电影美剧可以帮助提高英语水平,但不是唯一方法。以下方法可以帮助你学习英语:
看电影美剧可以帮助提高英语水平,但不是唯一方法。电影中使用的语言可能与实际生活中的语言略有不同,但可以帮助你学习新的词汇和语法,以及提高你的听力和语速能力。
回答得相当规整,对中文支持也流畅。当然,小模型(7b)偶尔也会抽风,输出不靠谱的内容。
关于硬件需求:7b模型至少需要一张8GB显存的N卡。实测8GB显卡在提问时显存几乎跑满。如果显卡容量不够,可以考虑更小体积的模型(比如2b版本)。另外有说法指出主要瓶颈是内存而非显存,这个说法目前还没有完全验证,大家可以自己再试试。
纯命令行交互毕竟不够直观,想要一个类似ChatGPT的Web界面,常用的方法是借助Docker拉取
去Pinokio官网下载Windows版本(Download → Windows版),解压运行。首次进入后点击
127.0.0.1:8000。
首次访问需要注册一个本地账号(随便写,不会上传远端)。登录后,在模型下拉列表里选中
另外,Web UI还支持上传PDF文件并进行分析(这里没演示细节,值得自行探索)。
这个是多模态模型(能看图理解),还没完全研究透,先留个记录:使用 ollama run lla va:7b 下载并运行。目前跳过,不展开。
默认情况下模型存放在用户目录下的 .ollama 文件夹里,一个模型动辄几个G甚至十几G,很占C盘空间。可以通过设置环境变量
H:ollama_models,然后重启Ollama服务。但如果之前已经下载过模型,需要手动把原目录下的模型文件整体复制到新路径,否则新位置下会找不到已有模型,只能重新下载。
摩托车活塞环性能如何
ThinkBook系列最新价格全解析:2026年选购避坑与实时询价指南
Ondo将于今日上线股票永续合约
暗黑4S14野蛮人终局BD攻略
区块链OTC交易所有哪几家比较正规?
Binance新增15种bStocks代币化证券为杠杆抵押资产
货拉拉如何查看历史订单 货拉拉往期行程轨迹查询【功能教学】
Meme币DOGS今晚上线!开局就解锁91%代币是否带来风险?
晶核艾尔莎角色盘点 晶核艾尔莎强度分析与实战表现
剑侠世界3雪峰论剑怎么打-剑侠世界3雪峰论剑打法介绍
五千元以下的笔记本几乎消失!经销商:至少一年看不到涨价尽头
Intel喜讯连连:18A工艺良率提升到85%、CPU将涨价15%
今日小鸡庄园答案2026.7.2
美债股纳斯达克首盘暴跌38%且加密代理交易解体,AVAX价格何去何从?
男生头像配网名可爱(精选100个)
赵云与阿斗神兵符使用教程 神兵符怎么使用
国家养老服务消费补贴上线京东
余姚的路虎4s店在哪个位置
英伟达机器人团队在京沪深招人,聚焦具身智能等四大领域
一站式PDF转Markdown解决方案PDF3MD
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc