背景:准备使用PaddleOCR-VL进行大批量的图像文本识别。PaddleOCR作为轻量模型,识别效果一直很不错。之前一直走官方API调用,每天有3000张图片的免费次数。(20000是包括网页版的额度) 之前发送请求,排队最多一分钟1张图,这两天突发恶疾,一张图重试很多次都排不上队。 实在受不了,搬出dsv4.1f进行本地部署。贴了官方教程过去后部署很顺利,但是自己老电脑上的2060S算力低,走不了vLLM加速,推理实在太慢,一张图平均2、3分钟,200页的书能识别10个小时 走投无路之际,偶然间想到之前有所耳闻的云算力显卡租赁。l站里一搜,顺藤摸瓜找到Modal,绑定信用卡就有30刀免费额度。于是赶紧又让deepseek读官方文档开始调用。 不过中间折腾了大半天,deepseek可能是忘了上下文 在Modal云端部署PaddleOCR的时候凭印象写依赖组件,我也没看,结果装好后反复调试出错,这货还每次搜源码修改,浪费了不少GPU时间。最后我强制让他重读PaddleOCR官方教程后他才意识到错误,成功改正。 我调用的还不是最高端的B300,仅仅是中低端的L40S,但是速度已经飞快,平均就1、2s一张图,全部250页,5分钟就跑完了: 只能说显卡等级还是太森严了,老黄的刀法也是名不虚传,一分钱一分货,这“中低端”的L40S已经是普通个人根本买不起的玩意儿了 1 个帖子 - 1 位参与者 阅读完整话题


  • 情报分类:硬件与数码
  • 分类依据:内容涉及硬件、数码产品或通信卡
  • 信息来源:服务器 / LINUX DO - 最新话题
  • 发布时间:2026/9/16 18:47:06