ollama离线部署加载Qwen3-0.6b模型

Ollama部署

ollama是一个开源工具( ollama.ai),允许用户在 本地设备(无需联网)运行 LLM。终端用户通过ollama低成本体验大模型能力
支持模型
  • llama2(7B/13B/70B 参数)
  • mistral(7B 高效模型)
  • codellama(代码生成专用)
  • phi(微软轻量模型)
典型使用场景
  • 离线环境使用 LLM
  • 数据敏感场景(避免云端传输)
  • 开发者快速测试模型
Github下载
根据所需环境下载,本文在linux下采用二进制文件直接部署,因此下载ollama-linux-amd64.tgz版本,解压后直接可运行;
# 官方提供的安装脚本
# curl -fsSL https://ollama.com/install.sh | sh

#下载后解压
tar -zxvf ollama-linux-amd64.tgz
#移动并重命名
mv ollama-linux-amd64 ollama

启动Ollama服务

进入ollama本地bin目录下,通过命令ollama serve启动服务后。
设置ollama服务api其它主机可访问,默认为localhost只能本机访问api,设置OLLAMA_HOST环境变量:export OLLAMA_HOST=0.0.0.0,此为临时性环境变量配置(生产使用需配置到系统文件中),或在启动命令前加上变量参数:OLLAMA_HOST=0.0.0.0 ./ollama serve
执行结果
[root@centos72 bin]# OLLAMA_HOST=0.0.0.0 ./ollama serve
time=2025-08-25T20:11:28.551+08:00 level=INFO source=routes.go:1318 msg="server config" env="map[CUDA_VISIBLE_DEVICES: GPU_DEVICE_ORDINAL: HIP_VISIBLE_DEVICES: HSA_OVERRID
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值