ByteDance/Bernini-Diffusers-v2
Image-Text-to-Video • Updated • 27
None defined yet.
Generation as Auxiliary Supervision: Enhancing Visual Understanding at Zero Inference Overhead via Decoupled Embedding Prediction
SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring