inclusionAI
Team
community
AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning
SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning
Team members 82 private
Ring
-
robbyant/lingbot-world-base-cam
Image-to-Video ⢠Updated ⢠340 -
robbyant/lingbot-world-base-act-preview
Image-to-Video ⢠Updated ⢠21 -
robbyant/lingbot-world-fast
Image-to-Video ⢠19B ⢠Updated ⢠16.8k ⢠21 -
robbyant/lingbot-world-fast-diffusers
Image-to-Video ⢠19B ⢠Updated ⢠2.85k ⢠7
The newest flagship non-reasoning model series.
Ming is the multi-modal series of any-to-any models developed by Ant Ling team.
-
inclusionAI/Ming-flash-omni-2.0
Any-to-Any ⢠104B ⢠Updated ⢠2.47k ⢠267 -
inclusionAI/Ming-omni-tts-16.8B-A3B
Text-to-Speech ⢠18B ⢠Updated ⢠1.24k ⢠54 -
inclusionAI/Ming-omni-tts-0.5B
Text-to-Speech ⢠2B ⢠Updated ⢠9.38k ⢠36 -
inclusionAI/Ming-omni-tts-tokenizer-12Hz
Audio-to-Audio ⢠0.8B ⢠Updated ⢠21 ⢠10
-
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Paper ⢠2602.11858 ⢠Published ⢠61 -
inclusionAI/ZwZ-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠91 ⢠31 -
inclusionAI/ZwZ-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠219 ⢠46 -
inclusionAI/ZwZ-RL-VQA
Viewer ⢠Updated ⢠111k ⢠1.33k ⢠15
-
inclusionAI/Ling-1T
Text Generation ⢠1000B ⢠Updated ⢠2.37k ⢠⢠541 -
inclusionAI/Ling-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠2.09k ⢠214 -
inclusionAI/Ling-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠29.5k ⢠196 -
inclusionAI/Ling-mini-2.0-GGUF
16B ⢠Updated ⢠1.44k ⢠26
A collection of TwinFlow-accelerated diffusion models
GroveMoE is an open-source family of large language models developed by the AGI Center, Ant Research Institute.
-
inclusionAI/Ling-lite-1.5-2507
Text Generation ⢠17B ⢠Updated ⢠81 ⢠76 -
inclusionAI/Ling-lite-1.5-2506
Text Generation ⢠17B ⢠Updated ⢠75 ⢠52 -
inclusionAI/Ling-lite-1.5
Text Generation ⢠17B ⢠Updated ⢠38k ⢠57 -
inclusionAI/Ling-lite-base-1.5
Text Generation ⢠17B ⢠Updated ⢠52 ⢠33
AReaL-boba-2
Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification
-
inclusionAI/SingGuard-NSFA-0.8B
Image-Text-to-Text ⢠1B ⢠Updated ⢠166 ⢠2 -
inclusionAI/SingGuard-NSFA-2B
Image-Text-to-Text ⢠3B ⢠Updated ⢠119 ⢠1 -
inclusionAI/SingGuard-NSFA-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠96 ⢠1 -
inclusionAI/SingGuard-NSFA-9B
Image-Text-to-Text ⢠9B ⢠Updated ⢠160 ⢠2
Ling-2.6 series is designed for real-world agents that require fast responses, strong execution, and high token efficiency, with several sized SKUs.
-
inclusionAI/Ring-1T
Text Generation ⢠1000B ⢠Updated ⢠223 ⢠⢠231 -
inclusionAI/Ring-1T-FP8
Text Generation ⢠1000B ⢠Updated ⢠584 ⢠19 -
inclusionAI/Ring-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠102 ⢠101 -
inclusionAI/Ring-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠475 ⢠184
-
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
Paper ⢠2604.20796 ⢠Published ⢠243 -
inclusionAI/LLaDA2.0-Uni
Any-to-Any ⢠16B ⢠Updated ⢠8.65k ⢠248 -
inclusionAI/LLaDA2.0-Uni-FP8
Any-to-Any ⢠16B ⢠Updated ⢠5.37k ⢠5 -
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
Paper ⢠2512.15745 ⢠Published ⢠89
Ring is a reasoning MoE LLM provided and open-sourced by InclusionAI, derived from Ling.
The Agent Runtime for Self-Improvement
-
UI-Venus-1.5 Technical Report
Paper ⢠2602.09082 ⢠Published ⢠157 -
inclusionAI/UI-Venus-1.5-30B-A3B
Image-Text-to-Text ⢠31B ⢠Updated ⢠994 ⢠33 -
inclusionAI/UI-Venus-1.5-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠3.63k ⢠28 -
inclusionAI/UI-Venus-1.5-2B
Image-Text-to-Text ⢠2B ⢠Updated ⢠914 ⢠40
-
Ming-Omni: A Unified Multimodal Model for Perception and Generation
Paper ⢠2506.09344 ⢠Published ⢠31 -
inclusionAI/Ming-Lite-Omni
Any-to-Any ⢠19B ⢠Updated ⢠68 ⢠200 -
inclusionAI/Ming-Lite-Omni-1.5
Any-to-Any ⢠19B ⢠Updated ⢠201 ⢠85 -
inclusionAI/Ming-UniAudio-16B-A3B
Any-to-Any ⢠18B ⢠Updated ⢠59 ⢠80
Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification
-
inclusionAI/SingGuard-NSFA-0.8B
Image-Text-to-Text ⢠1B ⢠Updated ⢠166 ⢠2 -
inclusionAI/SingGuard-NSFA-2B
Image-Text-to-Text ⢠3B ⢠Updated ⢠119 ⢠1 -
inclusionAI/SingGuard-NSFA-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠96 ⢠1 -
inclusionAI/SingGuard-NSFA-9B
Image-Text-to-Text ⢠9B ⢠Updated ⢠160 ⢠2
Ring
Ling-2.6 series is designed for real-world agents that require fast responses, strong execution, and high token efficiency, with several sized SKUs.
-
robbyant/lingbot-world-base-cam
Image-to-Video ⢠Updated ⢠340 -
robbyant/lingbot-world-base-act-preview
Image-to-Video ⢠Updated ⢠21 -
robbyant/lingbot-world-fast
Image-to-Video ⢠19B ⢠Updated ⢠16.8k ⢠21 -
robbyant/lingbot-world-fast-diffusers
Image-to-Video ⢠19B ⢠Updated ⢠2.85k ⢠7
The newest flagship non-reasoning model series.
Ming is the multi-modal series of any-to-any models developed by Ant Ling team.
-
inclusionAI/Ming-flash-omni-2.0
Any-to-Any ⢠104B ⢠Updated ⢠2.47k ⢠267 -
inclusionAI/Ming-omni-tts-16.8B-A3B
Text-to-Speech ⢠18B ⢠Updated ⢠1.24k ⢠54 -
inclusionAI/Ming-omni-tts-0.5B
Text-to-Speech ⢠2B ⢠Updated ⢠9.38k ⢠36 -
inclusionAI/Ming-omni-tts-tokenizer-12Hz
Audio-to-Audio ⢠0.8B ⢠Updated ⢠21 ⢠10
-
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Paper ⢠2602.11858 ⢠Published ⢠61 -
inclusionAI/ZwZ-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠91 ⢠31 -
inclusionAI/ZwZ-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠219 ⢠46 -
inclusionAI/ZwZ-RL-VQA
Viewer ⢠Updated ⢠111k ⢠1.33k ⢠15
-
inclusionAI/Ring-1T
Text Generation ⢠1000B ⢠Updated ⢠223 ⢠⢠231 -
inclusionAI/Ring-1T-FP8
Text Generation ⢠1000B ⢠Updated ⢠584 ⢠19 -
inclusionAI/Ring-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠102 ⢠101 -
inclusionAI/Ring-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠475 ⢠184
-
inclusionAI/Ling-1T
Text Generation ⢠1000B ⢠Updated ⢠2.37k ⢠⢠541 -
inclusionAI/Ling-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠2.09k ⢠214 -
inclusionAI/Ling-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠29.5k ⢠196 -
inclusionAI/Ling-mini-2.0-GGUF
16B ⢠Updated ⢠1.44k ⢠26
-
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
Paper ⢠2604.20796 ⢠Published ⢠243 -
inclusionAI/LLaDA2.0-Uni
Any-to-Any ⢠16B ⢠Updated ⢠8.65k ⢠248 -
inclusionAI/LLaDA2.0-Uni-FP8
Any-to-Any ⢠16B ⢠Updated ⢠5.37k ⢠5 -
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
Paper ⢠2512.15745 ⢠Published ⢠89
A collection of TwinFlow-accelerated diffusion models
Ring is a reasoning MoE LLM provided and open-sourced by InclusionAI, derived from Ling.
The Agent Runtime for Self-Improvement
GroveMoE is an open-source family of large language models developed by the AGI Center, Ant Research Institute.
-
UI-Venus-1.5 Technical Report
Paper ⢠2602.09082 ⢠Published ⢠157 -
inclusionAI/UI-Venus-1.5-30B-A3B
Image-Text-to-Text ⢠31B ⢠Updated ⢠994 ⢠33 -
inclusionAI/UI-Venus-1.5-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠3.63k ⢠28 -
inclusionAI/UI-Venus-1.5-2B
Image-Text-to-Text ⢠2B ⢠Updated ⢠914 ⢠40
-
inclusionAI/Ling-lite-1.5-2507
Text Generation ⢠17B ⢠Updated ⢠81 ⢠76 -
inclusionAI/Ling-lite-1.5-2506
Text Generation ⢠17B ⢠Updated ⢠75 ⢠52 -
inclusionAI/Ling-lite-1.5
Text Generation ⢠17B ⢠Updated ⢠38k ⢠57 -
inclusionAI/Ling-lite-base-1.5
Text Generation ⢠17B ⢠Updated ⢠52 ⢠33
AReaL-boba-2
-
Ming-Omni: A Unified Multimodal Model for Perception and Generation
Paper ⢠2506.09344 ⢠Published ⢠31 -
inclusionAI/Ming-Lite-Omni
Any-to-Any ⢠19B ⢠Updated ⢠68 ⢠200 -
inclusionAI/Ming-Lite-Omni-1.5
Any-to-Any ⢠19B ⢠Updated ⢠201 ⢠85 -
inclusionAI/Ming-UniAudio-16B-A3B
Any-to-Any ⢠18B ⢠Updated ⢠59 ⢠80