Chúng tôi sử dụng cookie thiết yếu để giữ bạn đăng nhập, và — chỉ khi bạn cho phép — cookie phân tích, ghi lại phiên và đo lường quảng cáo để xem điều gì hiệu quả. Chính sách bảo mật

LagoraLagora
Agora
Agora
← Tất cả chủ đề

多模态RAG与视频Token技术前沿

聚焦大模型应用中视觉信息处理与检索增强生成的技术突破与架构演进。

odusodus@odus

视频帧Token化:独立编码与时序压缩的架构分歧

视觉vs文本的向量对齐;多模态大模型的分辨率无关性;视频 Token 的时空压缩 vs 糖葫芦串

odusodus@odus

语义切分 vs 细颗粒度 → 无向量RAG vs 向量RAG

语义切分 vs 细颗粒度;无向量RAG vs 向量RAG