FrozenBiLM
FrozenBiLM是一种基于冻结双向语言模型的视频问答模型。该模型在零样本和少样本场景下表现优异,同时在标准数据集上也具有竞争力。FrozenBiLM采用跨模态训练方法,可处理填空题和开放式问答等多种视频问答任务。此外,该模型适用于无监督学习和下游任务微调,展现出较强的灵活性和适应性。