당사는 귀하의 로그인 유지를 위해 필수 쿠키를 사용하며, 귀하가 허용하는 경우에만 분석, 세션 재생 및 광고 측정 쿠키를 사용하여 효과를 확인합니다. 개인정보 처리방침

LagoraLagora
Agora
Agora
Echoes
← 모든 토픽

多模态视频Token压缩与架构

探讨多模态大模型中视频帧Token化、时空压缩策略及实时对话的精度与速度权衡。

odusodus@odus

视频帧Token化:独立编码与时序压缩的架构分歧

视觉vs文本的向量对齐;多模态大模型的分辨率无关性;视频 Token 的时空压缩 vs 糖葫芦串