聚焦大模型应用中视觉信息处理与检索增强生成的技术突破与架构演进。
Alignement vectoriel entre vision et texte;Invariance de résolution des grands modèles multimodaux;Compression spatio-temporelle des tokens vidéo vs brochette de sucettes
Découpage sémantique vs Granularité fine;RAG sans vecteur vs RAG vectoriel