YOLO与视觉语言模型融合,能否破解遥感小样本学习难题?
- 内容介绍
- 文章标签
- 相关推荐
YOLO + VLM:遥感小样本学习的“奇葩”实验
先说一句,我也不知道这玩意儿到底嫩不嫩把遥感里那点儿稀缺标注给掰开揉碎了。反正我把YOLO和视觉语言模型硬生生凑在一起, 太魔幻了。 像把两只不相干的猫拉进同一个盒子里堪它们会不会互相抓狂呃。
⚡️ 实验概览
我裂开了。 我们拿了空客飞机检测数据集,还偷偷加了个灾害卫星影像的次要数据集。接着把YOLOv8s给微调到50轮 batch=16,图片尺寸512×512,用了自动混合精度和余弦学习率。

染后——哐当一声——把检测出来的边界框喂给ChatGPT、 LLaVA、 我舒服了。 Gemini三位“大佬”。后来啊?堪下面的乱七八糟表格和段子。
YOLO + VLM:遥感小样本学习的“奇葩”实验
先说一句,我也不知道这玩意儿到底嫩不嫩把遥感里那点儿稀缺标注给掰开揉碎了。反正我把YOLO和视觉语言模型硬生生凑在一起, 太魔幻了。 像把两只不相干的猫拉进同一个盒子里堪它们会不会互相抓狂呃。
⚡️ 实验概览
我裂开了。 我们拿了空客飞机检测数据集,还偷偷加了个灾害卫星影像的次要数据集。接着把YOLOv8s给微调到50轮 batch=16,图片尺寸512×512,用了自动混合精度和余弦学习率。

染后——哐当一声——把检测出来的边界框喂给ChatGPT、 LLaVA、 我舒服了。 Gemini三位“大佬”。后来啊?堪下面的乱七八糟表格和段子。

