0
RAG不再只搜文字:腾讯WeMM-Embedding把文本、图片、视频和文档塞进同一个向量空间
企业做RAG时有一个长期存在的偏差:知识库明明是多模态的,检索入口却被强行压成文本。PDF先OCR,PPT提取文字,设备照片生成Caption,视频转字幕,然后所有内容统一送进文本Embedding。这样做简单,也能解决不少问题,但代...
企业做RAG时有一个长期存在的偏差:知识库明明是多模态的,检索入口却被强行压成文本。PDF先OCR,PPT提取文字,设备照片生成Caption,视频转字幕,然后所有内容统一送进文本Embedding。这样做简单,也能解决不少问题,但代...