
Multi-Modal AI
We develop multimodal learning systems that connect visual, language, and diverse real-world signals across computer vision, robotics, efficient LLMs, and applied AI.
- Computer Vision & Learning Algorithms
- Visual Recognition / Large-scale Models / Meta Learning
- Efficient Learning for LLMs
- Model Compression / Efficient Learning / System-level Optimization
- Robot Learning
- Vision-Language-Action / Efficient Robotics / 3D Recognition
- Industrial & Medical AI
- Battery AI / Fault Detection / Medical AI






