当前位置: 首页 > news >正文

汽车网站制作视频上传网站如何做

汽车网站制作,视频上传网站如何做,想百度搜到网站新域名怎么做,安庆网站建设公司参考文献:https://blog.csdn.net/qq363685855/article/details/148512248 之前分享过LLM之RAG实战(五十五)| 阿里开源新模型,Qwen3-Embedding与Qwen3 Reranker强势来袭!。本文将分享如何使用ollama来部署这些模型。 一…

参考文献:https://blog.csdn.net/qq363685855/article/details/148512248

之前分享过LLM之RAG实战(五十五)| 阿里开源新模型,Qwen3-Embedding与Qwen3 Reranker强势来袭!。本文将分享如何使用ollama来部署这些模型。

一、首先,需要安装Ollama

打开官网下载:https://ollama.com/download

图片

       根据自己的操作系统下载对应的版本即可。正常来说,是可以安装成功的。下面介绍一下特殊情况或者其他安装方式。

a)对于Mac电脑,也可以通过Homebrew进行安装

brew install ollama

b)对linux服务器,有时候不能连接外网,因此需要离线安装,可以参考文献:https://blog.csdn.net/m0_71142057/article/details/143186418。

核心点是可以copy文章的install.sh然后下载ollama离线文件,并把他们放到同一个目录下,执行运行install.sh即可,如下图所示:

图片

可以通过命令lscpu来查看操作系统版本,我是x86_64。

chmod +x ./install.sh./install.sh

二、下载Qwen3-Embedding模型

ollama run dengcao/Qwen3-Embedding-0.6B:F16

下面列出Qwen3-Embedding和Qwen3-Reranker各个版本的Ollama安装命令。

Qwen3-Embedding-0.6B系列:​​​​​​​

ollama run dengcao/Qwen3-Embedding-0.6B:Q8_0ollama run dengcao/Qwen3-Embedding-0.6B:F16

Qwen3-Embedding-4B系列:​​​​​​​

ollama run dengcao/Qwen3-Embedding-4B:Q4_K_Mollama run dengcao/Qwen3-Embedding-4B:Q5_K_Mollama run dengcao/Qwen3-Embedding-4B:Q8_0ollama run dengcao/Qwen3-Embedding-8B:F16

Qwen3-Embedding-8B系列:​​​​​​​

ollama run dengcao/Qwen3-Embedding-8B:Q4_K_Mollama run dengcao/Qwen3-Embedding-8B:Q5_K_Mollama run dengcao/Qwen3-Embedding-8B:Q8_0

Qwen3-Reranker-0.6B系列:​​​​​​​

ollama run dengcao/Qwen3-Reranker-0.6B:Q8_0ollama run dengcao/Qwen3-Reranker-0.6B:F16

Qwen3-Reranker-4B系列:​​​​​​​

ollama run dengcao/Qwen3-Reranker-4B:Q4_K_Mollama run dengcao/Qwen3-Reranker-4B:Q5_K_Mollama run dengcao/Qwen3-Reranker-4B:Q8_0

Qwen3-Reranker-8B系列:​​​​​​​

ollama run dengcao/Qwen3-Reranker-8B:Q3_K_Mollama run dengcao/Qwen3-Reranker-8B:Q4_K_Mollama run dengcao/Qwen3-Reranker-8B:Q5_K_Mollama run dengcao/Qwen3-Reranker-8B:Q8_0ollama run dengcao/Qwen3-Reranker-8B:F16

关于量化版本的说明:

  • q8_0:与浮点数16几乎无法区分。资源使用率高,速度慢。不建议大多数用户使用。

  • q6_k:将Q8_K用于所有张量。

  • q5_k_m:将 Q6_K 用于一半的 attention.wv 和 feed_forward.w2 张量,否则Q5_K。

  • q5_0: 原始量化方法,5位。精度更高,资源使用率更高,推理速度更慢。

  • q4_k_m:将 Q6_K 用于一半的 attention.wv 和 feed_forward.w2 张量,否则Q4_Kq4_0:原始量化方法,4 位。

  • q3_k_m:将 Q4_K 用于 attention.wv、attention.wo 和 feed_forward.w2 张量,否则Q3_K

  • q2_k:将 Q4_K 用于 attention.vw 和 feed_forward.w2 张量,Q2_K用于其他张量。

         根据经验,建议使用 Q5_K_M,因为它保留了模型的大部分性能。或者,如果要节省一些内存,可以使用 Q4_K_M。

http://www.yayakq.cn/news/972436/

相关文章:

  • 本地门户网站系统长沙网站seo方法
  • 网站建设网站优化相关资讯文章营销咨询师招聘
  • 五一网站个人空间电脑软件下载网站
  • 网站被k有什么表现互联网装饰网站
  • php网站里放asp托管型网站
  • 网站站群建设wordpress文章调用插件
  • 春哥 响应式网站建设英文网页如何制作
  • 中山网站建设案例大连网络推广广告代理
  • 广德做网站wordpress搭论坛
  • 手机网站制作教程下载wordpress wp roket
  • 模板出售网站源码重庆建设网官网
  • 莱芜网站优化有哪些响应式学校网站
  • 唐山快速建站的公司网站设计思路
  • 企业网站设计文档中国合伙人2做的什么网站
  • 网站浮动条wordpress插件安装不
  • html5微信网站模板国家高新技术企业认定标准
  • 智能模板网站建设工具网页网站开发项目设计
  • 浙江网站建站网页制作与网站设计代码
  • 网站支付开发室内设计师网上接单
  • html5网站源代码下载物流手机网站模板
  • 生物技术网站开发网络营销的十大特点
  • 淄博网站公司域名是不是网址的地址
  • 建设网站女装名字大全网站建设情况的汇报
  • 钢铁网站模板网站已经开发怎样用微信实现手机网站开发
  • 高校网站一般采用什么网页布局企业网站开发背景则么写
  • 怎么做自己的发卡网站百度搜索引擎技巧
  • 网站轮播广告静安广州网站建设
  • 最简单做网站关键词网站推广
  • 延安城乡建设规划局网站网站流量 盈利
  • 成都科技网站建设找国外的工业设计网站