-
MM-LLMs: Recent Advances in MultiModal Large Language Models
Paper • 2401.13601 • Published • 49 -
A Touch, Vision, and Language Dataset for Multimodal Alignment
Paper • 2402.13232 • Published • 17 -
Neural Network Diffusion
Paper • 2402.13144 • Published • 101 -
FlashTex: Fast Relightable Mesh Texturing with LightControlNet
Paper • 2402.13251 • Published • 14
LoongMa
Loong-Ma
·
AI & ML interests
None yet
Recent Activity
liked a Space 5 days ago
nanotron/ultrascale-playbook updated a model 4 months ago
ugreen-ai/Qwen3.5-4B-GGUF updated a model 4 months ago
ugreen-ai/Qwen3.5-35B-A3B-GGUFOrganizations
fuseLLM
voice
LLM-RAG
Agent
-
Mora: Enabling Generalist Video Generation via A Multi-Agent Framework
Paper • 2403.13248 • Published • 78 -
LLM Agent Operating System
Paper • 2403.16971 • Published • 73 -
AutoCrawler: A Progressive Understanding Web Agent for Web Crawler Generation
Paper • 2404.12753 • Published • 43
align llm
MultiModal
-
MM-LLMs: Recent Advances in MultiModal Large Language Models
Paper • 2401.13601 • Published • 49 -
A Touch, Vision, and Language Dataset for Multimodal Alignment
Paper • 2402.13232 • Published • 17 -
Neural Network Diffusion
Paper • 2402.13144 • Published • 101 -
FlashTex: Fast Relightable Mesh Texturing with LightControlNet
Paper • 2402.13251 • Published • 14
LLM-RAG
fuseLLM
Agent
-
Mora: Enabling Generalist Video Generation via A Multi-Agent Framework
Paper • 2403.13248 • Published • 78 -
LLM Agent Operating System
Paper • 2403.16971 • Published • 73 -
AutoCrawler: A Progressive Understanding Web Agent for Web Crawler Generation
Paper • 2404.12753 • Published • 43
voice
align llm