黄昏时分水边的雷达观测站油画:白色抛物面天线指向天空,水面倒映着暮色。

REMOTE SENSING · VISION–LANGUAGE

YOUNGZHO/ AI Lab

在影像与语言之间,
做一次审慎的观察。

上传一张卫星、SAR 或无人机影像,用中文提问。模型会尝试描述它看到的地物、结构与线索,并说明不确定之处。

INVITE-ONLY · 仅限受邀用户

§ 01 · DIRECTIONS

三类影像,一种提问方式

以下是实验室关注的方向,不代表已发表的成果。

阅读完整方向说明
  1. RS-VLM

    遥感视觉语言模型

    让模型用自然语言描述、比较与推理光学遥感影像中的地物、结构与变化,而不只是输出类别标签。

  2. SAR

    合成孔径雷达影像理解

    关注散斑、几何畸变与成像机理,探索语言模型如何在不符合人眼直觉的雷达信号上给出审慎的描述。

  3. UAV

    无人机低空影像分析

    面向高分辨率、视角多变的低空影像,研究细粒度目标与场景语义的对话式解读。

§ 02 · THE LAB

分析工作台

  1. 01

    上传影像

    支持 JPEG、PNG、WebP,单张不超过 10 MB。浏览器会在本地把分析副本缩放到长边 2048 像素以内,原图单独保存。

  2. 02

    提出问题

    用中文写下你想观察的内容。同一对话里的追问会沿用最近一张影像,无需重复上传。

  3. 03

    阅读分析

    回答以纯文本逐段呈现。模型可能出错,请把它当作辅助观察,而不是结论。

/LABSCHEMATIC

今天要观察什么?

上传影像后提问,回答会在这里逐段出现。

描述这张影像中的主要地物……
FIG. 01 — 界面示意,非真实输出
功能预览

以文搜图 · 影像检索

基于 RemoteCLIP 的语料检索仍在准备中,尚未接入数据。可以先查看界面设计。

查看预览

§ 03 · BEGIN

从一张影像开始。

需要使用 ChatGPT 账号登录,并已获得邀请。

ENTER LAB