DeepSeek-OCR本地部署(上):CUDA 升级12.9,vLLM升级至最新稳定版

DeepSeek-OCR 官方项目 README:https://github.com/deepseek-ai/DeepSeek-OCR中有关于 vllm 0.8.5+cu118+transformers>=4.51.1 下进行离线推理的详细步骤,但是教程中在线推理部分 vLLM 还是 nightly 版本。我看网上大家根据官方文档进行部署,问题多多。正好,[vLLM 最新版来了,V0.11.2 稳定版原生支持 DeepSeek-OCR,使用 OpenAI API 兼容格式的在线推理,方便多了]。

但是,vLLM 自 0.11.1 之后默认 CUDA 更新到了 12.9,我的 Linux 算力测试机还是 12.4,本文就介绍一下不重启情况下,如何升级 CUDA 和 vLLM@0.11.2,后面一篇文章再详细介绍 DeepSeek-OCR 的部署和 API 使用。

CUDA 升级

第一步:下载 CUDA Toolkit runfile

目前 CUDA Toolkit 的最新版是 13.0,作为等等派,我还是先装 12.9.1 吧

下载地址:https://developer.nvidia.com/cuda-12-9-1-download-archive?target_os=Linux&target_arch=x86_64&Distribution=RHEL&target_version=8&target_type=runfile_local

注意选择符合自己操作系统、架构、版本的安装包,最后一项建议选 runfile(local)

CUDA Toolkit 的历史版本,可以在这里找到:https://developer.nvidia.com/cuda-toolkit-archive

如果你的服务器是离线的,把下载好的 runfile 传进去即可

第二步:卸载旧版 CUDA

可以通过whereis nvcc查看自己 CUDA 的安装位置,一般都是在/usr/local/目录下

然后进入到/usr/local/cuda-12.4/bin下,找到 cuda-uninstaller

直接运行cuda-uninstaller,把下面三项选中后,光标移至 Done 后按 Enter 进行卸载

一般很快就 OK 了

第三步:安装 CUDA Toolkit 12.9

进入到第一步下载好的 runfile 目录下

运行sudo sh cuda_12.9.1_575.57.08_linux.run

然后选中以下几项,选中 Install 后 Enter

然后输入 accept 后 Enter

无比顺利情况下你会看到这个界面,这就约等于大功告成了

但是!不出意外的话,肯定会出意外了

问题 1:nvidia-uvm

你的服务器如果还有大模型在跑或别的任何服务在使用算力,极有可能会收到安装失败的 erro

查看日志发现有一个叫 nvidia-uvm 的内核正在使用

运行fuser -v /dev/nvidia-uvm确实是我之前 Docker 启动的 xinfer、vllm 等在运行模型

这里情况也能不一样,就我这个,测试发现要完全停掉 docker 仅此命令还不够sudo systemctl stop docker

要彻底停止 Docker,需要同时停止服务和套接字

sudo systemctl stop docker.service docker.socket

然后停掉自启

sudo systemctl disable docker.service docker.socket

完成升级后记得要 enable 一下

sudo systemctl enable docker.service docker.socket

问题 2:nvidia-drm

再次升级 CUDA,又失败了,日志提示nvidia-drm already loaded

这里需要切换到纯文本模式(关闭图形界面)

执行:sudo systemctl isolate multi-user.target

执行后,等待几秒钟,让图形服务完全关闭。

然后再再次升级 CUDA,就 OK 了

执行nvidia-smi发现 Driver 和 CUDA Version 都是新的了

执行 nvcc -V 发现报错,这是因为环境变量还没修改

执行vi ~/.bashrc把之前的 12.4 全部修改为 12.9

然后source ~/.bashrc使其生效

再次执行nvcc -V发现已经 OK

vLLM 升级

有网环境可以 pip upgrade,不过我这是内网服务器

所以用了 vLLM 的官方 Docker 镜像

https://hub.docker.com/r/vllm/vllm-openai/tags

很简单,直接docker pull vllm/vllm-openai:v0.11.2拉取镜像

然后docker save -o vllm012.tar vllm/vllm-openai:v0.11.2

把镜像保存到本地后传入内网服务器即可

至此 vLLM 升级完成

部署 DeepSeek-OCR

后面就是用 VLLM 的 Docker 拉起 DeepSeek-OCR 了

测试很 OK,单卡 4090 很顺畅,具体步骤就要下文了

如何学习AI大模型?

如果你对AI大模型入门感兴趣,那么你需要的话可以点击这里大模型重磅福利:入门进阶全套104G学习资源包免费分享!

这份完整版的大模型 AI 学习和面试资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

这是一份大模型从零基础到进阶的学习路线大纲全览,小伙伴们记得点个收藏!


第一阶段:从大模型系统设计入手,讲解大模型的主要方法;

第二阶段:在通过大模型提示词工程从Prompts角度入手更好发挥模型的作用;

第三阶段:大模型平台应用开发借助阿里云PAI平台构建电商领域虚拟试衣系统;

第四阶段:大模型知识库应用开发以LangChain框架为例,构建物流行业咨询智能问答系统;

第五阶段:大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型;

第六阶段:以SD多模态大模型为主,搭建了文生图小程序案例;

第七阶段:以大模型平台应用与开发为主,通过星火大模型,文心大模型等成熟大模型构建大模型行业应用。

100套AI大模型商业化落地方案

大模型全套视频教程

200本大模型PDF书籍

👉学会后的收获:👈

• 基于大模型全栈工程实现(前端、后端、产品经理、设计、数据分析等),通过这门课可获得不同能力;

• 能够利用大模型解决相关实际项目需求: 大数据时代,越来越多的企业和机构需要处理海量数据,利用大模型技术可以更好地处理这些数据,提高数据分析和决策的准确性。因此,掌握大模型应用开发技能,可以让程序员更好地应对实际项目需求;

• 基于大模型和企业数据AI应用开发,实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能, 学会Fine-tuning垂直训练大模型(数据准备、数据蒸馏、大模型部署)一站式掌握;

• 能够完成时下热门大模型垂直领域模型训练能力,提高程序员的编码能力: 大模型应用开发需要掌握机器学习算法、深度学习框架等技术,这些技术的掌握可以提高程序员的编码能力和分析能力,让程序员更加熟练地编写高质量的代码。

LLM面试题合集

大模型产品经理资源合集

大模型项目实战合集

👉获取方式:
😝有需要的小伙伴,可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/1120192.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

LLM幻觉有救了?清华大学研究一招让8B小模型避免幻觉产生

❝ 一句话概括:解决大模型“一本正经胡说八道”又有新思路,FaithLens 独创“解释质量奖励”机制,逼着小模型把推理逻辑讲清楚,结果检测准确率直接干翻了 o3 和 GPT-4。(原论文题目见文末,点击阅读原文可直接…

学术综述不用愁:paperzz 文献综述功能,如何让硕士论文 “文献部分” 更专业?

Paperzz-AI官网免费论文查重复率AIGC检测/开题报告/文献综述/论文初稿 paperzz - 文献综述https://www.paperzz.cc/journalsReviewed 文献综述是学术论文的 “地基”—— 既要梳理领域研究脉络,又要提炼现有研究的分歧与空白,还要匹配学历层次的深度要…

DMDRS数据库同步用户最小权限脚本示例

1、DM8源数据库同步用户最小权限脚本示例-- ## 基础权限 -- 插入、删除、更新数据时,需要数据操作权限 GRANT PUBLIC TO DMDRS; -- 需要系统表、系统字典和动态视图的查询权限 GRANT SOI,VTI TO DMDRS; -- 需要创建会话权限 GRANT CREATE SESSION TO DMDRS; -- ## 装…

大数据领域数据清洗的全面指南

大数据领域数据清洗的全面指南 关键词:数据清洗、缺失值处理、异常值检测、数据质量、大数据预处理 摘要:在大数据时代,“垃圾进,垃圾出”(Garbage In, Garbage Out)是数据分析的铁律。数据清洗作为大数据预…

基于微信小程序的中小学生个性化阅读平台的设计与实现(源代码+文档+PPT+调试+讲解)

课题摘要基于微信小程序的中小学生个性化阅读平台,聚焦中小学阅读 “内容分级化、阅读个性化、效果可视化” 的核心需求,针对传统阅读 “资源适配性差、打卡形式化、家长监督缺失” 的痛点,构建覆盖学生、家长、教师、平台管理员的全流程阅读…

吐血推荐9个AI论文工具,专科生轻松搞定毕业论文!

吐血推荐9个AI论文工具,专科生轻松搞定毕业论文! AI工具助力论文写作,专科生也能轻松应对 在当前的学术环境中,AI工具已经成为许多学生不可或缺的助手。尤其是对于专科生来说,面对毕业论文的压力,如何高效、…

达梦DMDRS数据库同步用户最小权限

DMDRS服务运行过程中,使用的数据库同步用户需要一定的权限访问数据库数据,如果不能赋予DMDRS同步用户DBA权限,为确保同步的正确性,数据库管理员可根据应用场景配置数据库同步用户的最小权限。 1、源数据库同步用户最小权限 赋予…

全自动云像仪:专为全天候、高精度监测天空云况设计

全自动云像仪是山东天合环境科技有限公司自主研发的新一代气象观测设备,专为全天候、高精度监测天空云况设计,广泛应用于气象预报、航空安全、农业气象、环境监测及光伏电站运维等领域。该设备采用220超大可视角度鱼眼镜头,搭配500万像素高品…

考虑储能电池参与一次调频技术经济模型的容量配置方法Matlab代码

✅作者简介:热爱科研的Matlab仿真开发者,擅长数据处理、建模仿真、程序设计、完整代码获取、论文复现及科研仿真。 🍎 往期回顾关注个人主页:Matlab科研工作室 👇 关注我领取海量matlab电子书和数学建模资料 &#x1…

大模型是否值得转行?从技术壁垒到就业前景全方位解析,字节跳动2025届薪资揭秘,大模型与算法岗位薪酬丰厚

大模型开发分为算法工程师(门槛极高)和应用工程师(门槛较低)。若已有业务或技术壁垒的工作,不建议贸然转行。转行前应先业余时间尝试,确认兴趣和能力。大模型应用虽是当前热点,但未来趋势难预测,需谨慎评估个人优势与行业发展。选…

TCS3430 XYZ三刺激真彩传感器原理图设计,已量产(光线传感器)

目录 1、TCS3430:“贴合人眼” 的光色检测核心 2、电源供给:稳定 1.8V 的 LDO 设计 3、TCS3430 核心电路 4、I2C 电平转换:低成本的 MOS 管方案 5、设计与调试的几个注意点 最近在做一款智能显示终端的环境适配模块,核心需求是让设备能根据环境光自动调屏幕亮度,同时…

基于 GARCH -LSTM 模型的混合方法进行时间序列预测研究附Python代码

✅作者简介:热爱科研的Matlab仿真开发者,擅长数据处理、建模仿真、程序设计、完整代码获取、论文复现及科研仿真。🍎 往期回顾关注个人主页:Matlab科研工作室🍊个人信条:格物致知,完整Matlab代码及仿真咨询…

基于微信小程序的自习室预约小程序的设计与实现(源代码+文档+PPT+调试+讲解)

课题摘要基于微信小程序的自习室预约系统,聚焦自习室运营 “座位精细化管控、预约便捷化、数据可视化” 的核心需求,针对传统自习室 “座位抢占、人工登记繁琐、时段利用率低” 的痛点,构建覆盖预约用户、自习室管理员的全流程预约管理生态。…

一站式讲清IO多路复用(轻松愉悦版)

文章目录引言Select:早期的探索Poll:Select 的链表版Epoll:Linux 的杀手锏Java和Go有什么需要了解的小知识?总结引言 作为一个 Java 和 Go 后端开发者,深刻理解 IO 多路复用是掌握高性能网络编程(如 Netty…

基于微信小程序的体育场馆预约平台设计与实现(源代码+文档+PPT+调试+讲解)

课题摘要基于微信小程序的体育场馆预约平台,聚焦体育场馆运营 “预约便捷化、时段精细化、数据可视化” 的核心需求,针对传统场馆预约 “电话沟通低效、时段冲突多、利用率不均” 的痛点,构建覆盖预约用户、场馆管理员、平台运营者的全流程预…

基于 MATLAB 的电力系统动态分析研究【IEEE9、IEEE68系节点】​附Matlab代码

✅作者简介:热爱科研的Matlab仿真开发者,擅长数据处理、建模仿真、程序设计、完整代码获取、论文复现及科研仿真。🍎 往期回顾关注个人主页:Matlab科研工作室🍊个人信条:格物致知,完整Matlab代码及仿真咨询…

Pharos STEM 台式场发射电镜在外泌体形貌与粒径分析中的应用

外泌体(Exosomes)是一类由细胞主动分泌的纳米级细胞外囊泡,近年来在生命科学与医学研究中受到广泛关注。作为细胞间信息传递的重要载体,外泌体在疾病诊断、作用机制研究以及药物递送等方向均显示出重要研究价值。在外泌体研究中&a…

一些常见的英文期刊库(爱思唯尔、MDPI、施普林格等)

一、爱思唯尔(Elsevier)ScienceDirect 网址:https://www.sciencedirect.com/ 二、MDPI 官网:https://www.mdpi.com/ 三、施普林格 网址:https://link.springer.com/ 四、arXiv(预印本) 网址…

Pharos STEM 台式场发射电镜在外泌体形貌与粒径分析中的应用

外泌体(Exosomes)是一类由细胞主动分泌的纳米级细胞外囊泡,近年来在生命科学与医学研究中受到广泛关注。作为细胞间信息传递的重要载体,外泌体在疾病诊断、作用机制研究以及药物递送等方向均显示出重要研究价值。在外泌体研究中&a…

python网络流量分析与入侵检测-计算机毕业设计源码+LW文档

网络流量分析与入侵检测 摘 要 在当今数字化时代,互联网技术蓬勃发展,网络攻击手段也随之呈现出复杂多样的态势。SQL注入、XSS跨站脚本、DDoS攻击等恶意行为频繁发生,给企业和个人的信息安全带来了巨大威胁。传统基于规则库的网络入侵检测…