一、该问题的重现步骤是什么?
1. AI大模型使用流程编排的话提供外部接口的话, 如何使用语音输入对话还有就是图片识别问答
2.
3.
二、你期待的结果是什么?实际看到的又是什么?
三、你正在使用的是什么产品,什么版本?在什么操作系统上?
四、请提供详细的错误堆栈信息,这很重要。
五、若有更多详细信息,请在下面提供。
图片识别现在已经有了,但是需要大模型支持视觉功能,这样把图片发给他,大模型会自动识别然后回答,这个和流程关系不大,已经是模型自带的功能了,配置大模型的时候,把这个视觉支持加上
但是语音识别现在还不支持,如果要做的话,大概思路就是把你的音频输入给语音大模型,他自己识别后自动润色返回文字,再把润色后的文字调用流程节点的接口。
扫一扫访问 Blade技术社区 移动端