DeepSeek 8B,14B,32B,70B在ubuntu,mac上的性能测试结果

ubuntu安装deepseek 2、安装 deepseek,选择合适大小的,因为显存大。如果涉及到docker删除,然后再启动容器。3、设置ollama监听端口。4、安装open-webui。1、安装ollama 阅读详情

分别基于Ubuntu22.04, Macbook Pro M芯片模型测试:

ubuntu配置:Macbook Pro

CPU: 13th Gen Intel(R) Core(TM) i7-13700KF

显卡: NVIDIA GeForce RTX 4070 Ti 12GB

内存:80G

系统版本:Window11 WSL Ubuntu 22.04.5 LTS

CPU:  Apple M1 Max

显卡:Apple M1 Max Metal 3

内存:32G

系统版本:14.6.1

Macbook Pro M芯片性能测试:

DeepSeek-R1-Distill-Qwen-8B-GGUF 测试结果:

modelsizeparamsbackendthreadstestt/s
llama 8B Q2_K - Medium3.07 GiB8.03 BMetal,BLAS8pp512487.43 ± 0.24
llama 8B Q2_K - Medium3.07 GiB8.03 BMetal,BLAS8tg12849.33 ± 0.09

DeepSeek-R1-Distill-Qwen-14B-GGUF 测试结果:

modelsizeparamsbackendthreadstestt/s
qwen2 14B Q2_K - Medium5.37 GiB14.77 BMetal,BLAS8pp512257.18 ± 0.12
qwen2 14B Q2_K - Medium5.37 GiB14.77 BMetal,BLAS8tg12827.45 ± 0.10

DeepSeek-R1-Distill-Qwen-32B-GGUF 测试结果:

modelsizeparamsbackendthreadstestt/s
qwen2 32B IQ2_XXS - 2.0625 bpw8.40 GiB32.76 BMetal,BLAS8pp51299.51 ± 0.15
qwen2 32B IQ2_XXS - 2.0625 bpw8.40 GiB32.76 BMetal,BLAS8tg12813.58 ± 0.01

DeepSeek-R1-Distill-Qwen-70B-GGUF 测试结果:

ModelSizeParamsBackendThreadsTestt/s
LLaMA 70B Q2_K - Medium24.79 GiB70.55 BMetal,BLAS8pp5126.3 ± 0.08
LLaMA 70B Q2_K - Medium24.79 GiB70.55 BMetal,BLAS8tg12800.00 ± 0.00

Ubuntu 22.04 性能测试:

DeepSeek-R1-Distill-Qwen-8B-GGUF 测试结果:

ModelSizeParamsBackendNGLTestT/s
llama 8B Q2_K - Medium3.07 GiB8.03 BCUDA99pp5124371.47 ± 8.21
llama 8B Q2_K - Medium3.07 GiB8.03 BCUDA99tg128122.44 ± 0.09

DeepSeek-R1-Distill-Qwen-14B-GGUF 测试结果:

ModelSizeParamsBackendNGLTestT/s
qwen2 14B Q2_K - Medium5.37 GiB14.77 BCUDA99pp5122411.33 ± 6.56
qwen2 14B Q2_K - Medium5.37 GiB14.77 BCUDA99tg12867.53 ± 0.15

DeepSeek-R1-Distill-Qwen-32B-GGUF 测试结果: 

ModelSizeParamsBackendNGLTestT/s
qwen2 32B IQ2_XXS - 2.0625 bpw8.40 GiB32.76 BCUDA99pp5121204.93 ± 83.32
qwen2 32B IQ2_XXS - 2.0625 bpw8.40 GiB32.76 BCUDA99tg12841.92 ± 0.17

DeepSeek-R1-Distill-Qwen-70B-GGUF 测试结果:

ModelSizeParamsBackendNGLTestT/s
llama 70B Q2_K - Medium24.79 GiB70.55 BCUDA99pp51237.18 ± 0.16
llama 70B Q2_K - Medium24.79 GiB70.55 BCUDA99tg1281.31 ± 0.00

参数解释:

标题解释
模型 (Model)使用的模型名称和版本
大小 (Size)模型的内存占用,单位是GiB (Gibibytes)
参数 (Params)模型的参数数量,单位是B (Billion)
后端 (Backend)模型运行所使用的计算后端 (例如Metal, BLAS)
线程 (Threads)使用的线程数量
GPU数量(NGL)Number of GPU Layer,分给GPU的层数用来计算
测试 (Test)

运行测试的类型,例如pp512 (测试512 token)或tg128 (测试128 token)

pp512: Prompt Processing 处理512 token提示词

tg128: Text Generation 生成长度为128 token文本

每秒处理标记数 (t/s)每秒处理的token数量 (tokens per second)

测试结果:

在两台机器上,DeepSeek-R1-Distill-Qwen-8B,14B, 32B 都可以正常使用,通过 T/s  结果可以看出来,只有70B 在两台机器上虽然可以运行,但根本无法使用。大家根据自己的机器配置,选择合适的模型。

模型资源下载地址:

DeepSeek-R1-Distill-Llama-8B

DeepSeek-R1-Distill-Qwen-14B

DeepSeek-R1-Distill-Qwen-32B

DeepSeek-R1-Distill-Llama-70B

测试项目llama.cpp

ubuntu 部署deepseek 升级 apt update升级 apt upgrade格式化硬盘 mkfs.ext4 /dev/sdb。 阅读详情

相关推荐

2026年MacBook替代指南:五款Windows笔记本与开发环境迁移实战

最近在技术社区和开发者群里,经常看到有朋友在讨论一个话题:手上的老款 Intel MacBook 还能再战几年?或者,当苹果全面转向自研芯片后,如果工作流严重依赖 Windows 生态,下一台笔记本该怎么选?这确实是个很现实的问题。无论是为了运行特定的企业级软件、进行某些游戏开发或测试,还是单纯习惯了 Windows 的操作逻辑,从 macOS 切换到 Windows 平台,或者寻找一个能兼顾两者的方案,都需要仔细考量。 本文将从实际开发者和技术用户的角度出发,为你梳理在 2026 年的当下,如果你正在考虑

cnracht8153的博客 919

Ubuntu】本地部署Deep Seek(深度求索)大模型的保姆级教程 | 详细教程

本地部署Deep Seek(深度求索)大模型的详细教程

静谧、淡雅 1万+

基于FPGA的TDC延迟链优化与码密度校准方法(1)——原理与实现

本文深入探讨了基于FPGA的时间数字转换器(TDC)延迟链非均匀性问题及其码密度校准方法。通过分析工艺偏差、温度电压影响等根源,详细介绍了码密度测试原理、逐位校准技术及气泡消除算法,并分享了自适应校准策略与多场景应用实践,有效提升TDC测量精度至皮秒级。

kiwi8的博客 432

基于Ollama部署Deepseek-r1模型

基于ollama部署deepseek-r1模型

提子同学是我 1万+

使用OllamaUbuntu运行deepseek大模型:以deepseek-r1为例

deepseek大模型上热搜啦!咱们来亲身感受下DeepSeek模型的魅力吧!整个操作流程非常简单方便,只需要2步,先安装Ollama,然后执行大模型即可。

skywalk8163的专栏 4951

Deepseek本地化部署指南:在Linux环境下部署,windows远程web-ui访问(Ubuntu环境+window环境)

Deepseek本地化部署指南:在Linux环境下部署,windows远程web-ui访问(Ubuntu环境+window环境)

u013486597的博客 9887

Ubuntu Linux部署DeepSeek

本文介绍了通过OllamaUbuntu Linux平台上部署DeepSeek本地大模型的方法,并且可以使用ChatBox调用本地Ollama API进行本地对话或者是远程对话。 技术背景DeepSeek是这段时间最热门的话题之一,其蒸馏模型可以实现低成本而高质量的推理,使得我们现在可以在本地小型化...

cnzzs的博客 2336

DeepSeek-VL2部署指南

DeepSeek-VL2是一款力图学习和实现深度学习和视觉语言结合的工具包。本文将介绍如何在本地环境中安装和部署DeepSeek-VL2。

haibo2144的博客 3万+

使用OllamaUbuntu运行deepseek大模型:以DeepSeek-coder为例

DeepSeek大模型这几天冲上热搜啦!咱们来亲身感受下DeepSeek模型的魅力吧!整个操作流程非常简单方便,只需要2步,先安装Ollama,然后执行大模型即可。

skywalk8163的专栏 4198

【AI】在Ubuntu中使用docker对DeepSeek的部署与使用

DeepSeek 工具搭建和使用

Freesia_2350的博客 5284

ubuntu系统vllm部署deepseek-70B(DeepSeek-R1-Distill-Llama-70B)

假设下载到 ~/Downloads/cudnn-linux-x86_64-8.9.7.29_cuda12-archive.tar.xz。--served-model-name deepseek-70b # API中的模型名称。--gpu-memory-utilization 0.85 \ # 显存利用率。--trust-remote-code \ # 如果模型需要自定义代码。# 例如DeepSeek-R1-Distill-Llama-70B模型。# 例如deepseek-r1-awq量化模型。

qq_38988216的博客 7603

基于Ubuntu+vLLM+NVIDIA T4高效部署DeepSeek大模型实战指南

面对原始DeepSeek-R1-32B模型在T4显卡上出现的显存溢出问题,我们采取了一系列创新性的技术措施:知识蒸馏:通过将原本庞大的32B模型压缩至更小巧但依然高效的14B规模,确保了至少95%的原始性能得以保留。混合量化:应用GPTQ 4-bit量化技术,成功地将显存需求从32GB大幅减少到9.8GB,显著提升了模型在T4上的运行效率5。动态卸载:利用vLLM特有的PagedAttention机制,实现了显存与内存之间的智能调度,进一步缓解了显存压力。

weixin_45631123的博客 6690

Ubuntu22.04部署deepseek大模型

可能由于工作或者是下班了,我们不小心关闭命令行窗口后,还想打开命令提示符窗口,只需要再次在命令符提示窗口中输入上面复制的指令即可。以上是在Ubuntu虚拟机中用CPU跑的性能视图,CPU基本上占用很高。如果有高端的GPU显卡,可以运行的更好。当然Ollama不只是可以启动deepseek模型,也可以启动其他的模型。● 确保你的网络连接正常,尤其是访问目标服务器时没有防火墙或代理的限制。Ollama 官方版: https://ollama.com/若你的显卡是在Linux上面 可以使用如下命令安装。

qq_44534541的博客 2972

Ubuntu 24.04.1 LTS 本地部署 DeepSeek & 私有化知识库

Ubuntu 24.04.1 LTS 本地部署 DeepSeek & 私有化知识库

Z 7636

Ubuntu22.04 Deepseek-R1本地容器化部署/内网穿透/OPENWEBUI,打造个人AI助手!

本地部署DeepSeek并实现内网穿透,为家庭成员提供强大的AI支持。通过使用Ollama、Docker、OpenWebUI和Nginx,内网穿透,我们可以轻松实现快速响应和实时搜索功能

USTB人海的博客 3986

DeepSeek本地部署之deepseek-r1-distill-llama-70b 本地部署与 AI 应用实践

已更新实测有效的硬件配置方案。近年来,大型语言模型(LLM)的快速发展为企业数字化带来了前所未有的机遇。然而,中小企业在使用诸如 GPT-4 这类云端大模型服务时,往往面临数据隐私、使用成本和网络依赖等方面的挑战。本地化部署大型模型成为一种趋势:将模型部署在企业自己的服务器上,数据不出内网,既保证了敏感信息的安全,又能根据企业需求对模型进行定制优化。是一款备受关注的开源大语言模型,参数规模高达 700 亿。作为 DeepSeek 系列的高性能版本,它在多个基准测试中表现出色。

m0_60674045的博客 1万+

小白都能看懂,deepseek本地部署教程

日志查看端口冲突OLLAMA_HOST=0.0.0.0:11435 ollama serve # 指定新端口。

python123456_的博客 3万+

Ubuntu环境通过Ollama部署DeepSeek-R1模型教程

Ubuntu环境通过Ollama部署DeepSeek-R1模型教程

m0_37825219的博客 5689

ubuntu本地部署deepseek r1

本指南详细介绍了如何在本地通过 Ollama 部署 DeepSeek-R1 模型,并集成 Open WebUI 进行交互。首先,确保硬件(如 GPU、内存)和软件(如操作系统、依赖项)满足要求。接着,安装 Ollama 并部署 DeepSeek-R1 模型,随后安装 Open WebUI 并配置与 Ollama 的连接。最后,提供了优化显存和网络加速的建议,帮助用户更好地使用和调试系统。

haimin0371的专栏 2079

vmware vsphere 证书过期告警处理方法

vSphere Clinet 管理页面出现“证书告警” ,检查证书未发现现有证书有过期现象

m0_51902127的博客 3559

深度学习短期电价预测[代码]

本文提出了一种基于深度学习的短期电价预测方法,结合了双向LSTM和三维时序卷积网络(CTLSTM)的优势。文章首先介绍了电价预测的背景与意义,指出电价数据具有波动性强和非线性特征明显的特点,传统方法预测效果有限。研究选取了澳大利亚某地区2010年下半年的电价、气象和负荷数据,通过皮尔逊相关系数、互信息和随机森林等方法进行特征筛选,最终确定了电力负荷、湿度、hour_sin和hour_cos四项核心输入特征。模型设计方面,CTLSTM结合了三维卷积、时序卷积网络和双向LSTM的优势,能够有效捕捉电价数据的时空依赖和复杂动态波动。实验结果表明,CTLSTM模型在测试集上的RMSE为17.17,相比单层LSTM和CNN-LSTM模型降低了约42%-43%,表现显著优于对比模型。文章最后总结了模型的优势,并提供了相关代码实现。

下一篇: Windows11搭建DeepSeek教程(ubuntu+llama.cpp+硬件加速)
DevSeek
博客等级 码龄2年 27粉丝 4原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值