SenseNova-Vision-7B-MoT

A 7B multi-modal omni-task model for visual understanding, depth/normal estimation, image generation, editing, detection, and OCR.

Task
Examples
Input Image Task Prompt / Query