1. X
  2. Kai Chen
Log inSign up
Kai Chen
60 posts
Image
user avatar
Kai Chen
@kaichen1998
PhD candidate at @HKUST | Data-centric foundation models for omni-modal intelligence
Hong Kong
kaichen1998.github.io
Joined May 2013
61
Following
24
Followers
RepliesRepliesMediaMedia
  • user avatar
    Kai Chen
    @kaichen1998
    Jun 17, 2025
    A new milestone 😁
    Image
  • user avatar
    Kai Chen
    @kaichen1998
    Jun 16, 2025
    🤔New reason LLMs keep releasing before your MLLM alignment finish? Try RACRO! Train once, flexible change to novel LLM reasoners when inference! 🔥Paper: arxiv.org/abs/2506.04559 🔥Code: github.com/gyhdog99/RACRO2 🔥@Gradio Demo: huggingface.co/spaces/Emova-o… #multimodalai #CVPR #CVPR25
    Image
    Image
  • user avatar
    Kai Chen
    @kaichen1998
    Jun 14, 2025
    Unique experience when you attend @CVPR conference without a visa using @Zoom :) #CVPR #CVPR25 #CVPR2025
    Image
    Image
    user avatar
    Kai Chen
    @kaichen1998
    Jun 14, 2025
    🔥Check our @CVPR poster @ 10:30 am on June 14, Hall D #47! EMOVA is a fully open-sourced E2E Omni-modal LLM with SoTA vision-language and speech results! 🔥 Web: emova-ollm.github.io 🔥 Code: github.com/emova-ollm/EMO… 🔥 Demo: huggingface.co/spaces/Emova-o… #CVPR2025 #CVPR25 #CVPR
  • user avatar
    Kai Chen
    @kaichen1998
    Jun 14, 2025
    🔥Check our @CVPR poster @ 10:30 am on June 14, Hall D #47! EMOVA is a fully open-sourced E2E Omni-modal LLM with SoTA vision-language and speech results! 🔥 Web: emova-ollm.github.io 🔥 Code: github.com/emova-ollm/EMO… 🔥 Demo: huggingface.co/spaces/Emova-o… #CVPR2025 #CVPR25 #CVPR
    Image
    Image
    03:23
    user avatar
    AK
    @_akhaliq
    Sep 27, 2024
    EMOVA Empowering Language Models to See, Hear and Speak with Vivid Emotions discuss: huggingface.co/papers/2409.18… GPT-4o, an omni-modal model that enables vocal conversations with diverse emotions and tones, marks a milestone for omni-modal foundation models. However, empowering
  • user avatar
    Kai Chen
    @kaichen1998
    Mar 27, 2025
    🎉Glad to see progress for Omni LLM @Alibaba_Qwen! 🤔Want to train your own Omni LLM? Consider our #CVPR2025 EMOVA as an open-source alternative! All datasets, code (train/infer), and weights (3B/7B/72B) are available! @_akhaliq @huggingface @CVPR @CVPRConf #Qwen #Multimodal
    user avatar
    Qwen
    @Alibaba_Qwen
    Mar 26, 2025
    Voice Chat + Video Chat! Just in Qwen Chat (chat.qwen.ai)! You can now chat with Qwen just like making a phone call or making a video call! Check the demo in youtube.com/watch?v=yKcANd… What's more, we opensource the model behind all this, Qwen2.5-Omni-7B, under the
    Image
    00:00

Log in or sign up for X

See what’s happening and join the conversation

Continue with phone
or
Log in with username or email
Terms·Privacy·Cookies·Accessibility·Ads Info·© 2026 X Corp.
Advertisement
Advertisement