当前位置: 首页 > news >正文

大连网站开发培训班西安网站建设网站制作

大连网站开发培训班,西安网站建设网站制作,网站如何维护,做网站自适应框架本文是针对多模态对话系统核心技术栈的使用效果和网络测评整理。 测评内容基于用户体验,侧重于从使用者角度出发,讨论实际操作中的体验感受,如技术的易用性、输出效果如文本的连贯性、语音的自然度、口型同步的准确性等。不涉及具体算法架构…

本文是针对多模态对话系统核心技术栈的使用效果和网络测评整理。

测评内容基于用户体验,侧重于从使用者角度出发,讨论实际操作中的体验感受,如技术的易用性、输出效果如文本的连贯性、语音的自然度、口型同步的准确性等。不涉及具体算法架构的分析,仅供参考。


文本GPT千帆Claude
TTSElevenlabs讯飞GCP(Google cloud Platform) (convai内置)
lipsyncMetahumanSDKConvAI自研Audio to face

对比分析

文本

GPT

  • GPT全面能力比千帆更强 文字处理这块差不多
  • GPT的知识库比较大 并且敏感词限制很少/千帆的文心有敏感词设置,发布大模型经过备案审核

千帆

  • 最大的差异就是价格,千帆便宜
  • 文言文 中国文化等本土内容,千帆更头部

Claude (Claude与GPT分析对比,图源网络)

TTS

(仅中文语音分析)

Elevenlabs:有优质的台湾语调语音库,内陆语音库也还行。

讯飞:不支持convAI第三方集成,需要企业对接。本身有明显的“的地得”不分得问题。

GCP(Google cloud Platform):难听(指中文)。(metahuman内置的voice ID,google和Azure,whatever,也很难听)气口不对,声调错误(阴平阳平上声去声不分),甚至会读错字

Lipsync

Metahuman SDK:动画总体有非常多的bug:升级了pricing plan仍然有和免费试用版一样的五秒时间限制/ 会在嘴张着的情况停止讲话/  身首分离的问题可以解决但麻烦

convai自研有audio2face runtime 百分之七八十的效果,完全免费。

Audio2Face流式:(可以集成在ConvAI中)但企业版年费偏高昂

综合流程:

文本GPT千帆Claude
TTSElevenlabs讯飞GCP(Google cloud Platform) (convai内置)
lipsyncMetahumanSDKConvAI自研Audio to face

个人用户可以使用“GPT-Elevenlabs-ConvAI”的技术栈组合。均有免费额度。

企业用户要求最佳效果的技术栈组合可以参考“GPT-Elevenlabs-ConvAI-Audio to face runtime lipsync”

Reallusion建议:

切换音色:convai的协同表现非常好,但第三方API集成只支持Elevenlabs,需要使用付费套餐,但价格偏低廉。

Monthly interaction of different pricing plans​​​​​

You can use Elevenlabs voices in Convai. There are 2 ways to access Elevenlabs voices. First, your Convai plan must be a Gamer plan or higher. However, each plan has a separate ElevenLabs Interaction quota. ElevenLabs Quota is as in the screenshot I shared below. In this way, you can access ElevenLabs voices in the Character Voices section in Convai. Another method is to connect your ElevenLabs account. However, your Elevenlabs account must have a Pro plan or higher. This way you can also add custom ElevenLabs voices, and your ElevenLabs quota is the same as the quota on your account. Documentation: https://docs.convai.com/api-docs/plugins-and-integrations/elevenlabs-api-integration A small note, this way you can't use Convai's Elevenlabs voices, you need to upgrade your Convai plan. So when you connect the Elevenlabs API, everything related to Elevenlabs is connected to your Elevenlabs account.

convai不支持屏蔽关键词,需要去人设设置里告诉它不说某些词语,但不是强制屏蔽。

https://zh.wikipedia.org/wiki/%E6%AD%A7%E8%A7%86%E8%AF%AD

可以设置口癖如“这样子哦”“有啦”“真的假的?”“不好意思”“对啊/对啦”“没关系”“还好啦”“吼”“咩”。最好需要在人设里给详细解释:

“这样子哦”

这是一种表示理解或回应对方说话的口头禅,常常用在对话中表达对信息的接收或共鸣感。

“有啦”

台湾人常用“有啦”来强调某件事的存在或发生,例如:“我有做啦!”表示自己确实做了某事。

“真的假的?”

表示惊讶、怀疑或不确定的回应,类似于大陆的“真的吗?”。

“不好意思”

这在台湾不仅用于道歉,常常也用作礼貌的开场白或表示客气。例如,在请求帮助或打扰别人时,台湾人会说“不好意思”来显得更礼貌。

“对啊/对啦”

用于表示同意或附和,尤其是在对方表达观点时,台湾人会用“对啊”或“对啦”来表示赞同。

“没关系”

表示不介意、不在意,类似于“没事”、“无所谓”。这句话在台湾人的日常对话中非常常见,用来缓解尴尬或表示宽容。

“还好啦”

表示某件事情还算过得去、没有太大问题,常用来回应别人对自己状态或事情的询问。

“吼”

语气助词,用来加重语气或表达抱怨。例如:“你怎么这样吼?”有时带有一点撒娇或不满的意思。

“咩”

也是语气助词,常出现在句尾,用来表达无奈或调皮的感觉,例如:“我也不知道咩。”

其他建议:

动态字数:在人设里一般问答的长度设置的更精简,随着问题的难度而动态放宽字数限制。(否则每个回答都回答一长段 / 困难的问题很快回答 / 简单的问题过于啰嗦的回答 都会更不像真人)

眼球动画:make the AI not always look at player

细微动作:change NPC animation while listening player talking/ thinking about anwser。

Action:将走/跑/摊手等动作blend使用。

语音情绪转换:convai集成流程支持初始情绪设定(如图),对话过程中声音情绪转变暂不支持

http://www.yayakq.cn/news/705069/

相关文章:

  • 网站设计是干什么的影视公司起名
  • 十大农业网站国外客户推广网站
  • 西南城乡建设部网站首页网站建设与管理期末总结
  • 厦门海沧建设局网站dw网页设计代码茶文化
  • h5自适应网站建设如何去掉wordpress
  • 徐州优化网站建设婚恋网站做期货现货贵金属的人
  • 网站建设翻译谁提供开发公司调研汇报材料怎么写
  • 内网网站建设的步骤过程青海省西宁市住房城乡建设厅网站
  • 网站建站网站我待生活如初恋做网站海口
  • 万网个人网站wordpress驳回评论
  • 网站备案号怎么看wordpress登陆入口修改
  • 做外贸推广的网站有哪些福田做商城网站建设哪家效益快
  • 海南做网站的公司哪家好美工培训班学费多少钱
  • 东莞网站营销推广医院做网站开发
  • 重庆网站推广人员自己做网站的流程下载
  • 做ppt的兼职网站有哪些交换友链要注意什么
  • 中跃建设集团有限公司网站江苏 网站建设
  • seo织梦网站建设步骤网站建设管理分工
  • 青岛制作网站使用c#语言建设网站优点
  • 网站开发销售员学校网站开发方案
  • seo网站优化方案案例打包wordpress为app
  • 如何查询网站收录情况怎么建设网站挣钱
  • 泰州公司网站建设菏泽软件定制开发
  • 兴化 网站开发网页手机小游戏
  • 云服务器网站解析嵊州市网站建设
  • 网站策划建设家装网站建设公司哪家好
  • 上谷网络网站建设公司营销型网站建设
  • 网站内部链接的作用有哪些莱芜都市网最新消息
  • 徐州网站平台水果 网站源码
  • .net给网站做短信验证中国建筑网官网查询证书