中文
Models

llava-onevision-2

evolvinglmms-lab/llava-onevision-2

Fully open multimodal training framework unifying image, long-video, and spatial understanding, releasing models, datasets, and complete training pipelines for researchers building vision-language systems.

Topics

  • llava
  • llm
  • mllm
  • qwen3
  • vision-language-model
  • llava-onevision