1. X
  2. fairseq
Log inSign up
fairseq
12 posts
user avatar
fairseq
@fairseq
Sequence modeling toolkit for @PyTorch
github.com/pytorch/fairse…
Joined May 2020
11
Following
1,563
Followers
RepliesRepliesMediaMedia

Log in or sign up for X

See what’s happening and join the conversation

Continue with phone
or
Log in with username or email
Terms·Privacy·Cookies·Accessibility·Ads Info·© 2026 X Corp.
  • user avatar
    fairseq
    @fairseq
    Dec 21, 2021
    Models and code available in fairseq: github.com/pytorch/fairse…
    user avatar
    Xian Li
    @xl_nlp
    Dec 21, 2021
    🌍Few-shot learning beyond English🌏 📢 Announcing XGLMs, a series of multilingual autoregressive languages models setting new SoTA on few-shot learning and outperforming English-centric models (e.g. GPT-3). Paper: arxiv.org/abs/2112.10668 Models and code: github.com/pytorch/fairse…
    Image
  • user avatar
    fairseq
    @fairseq
    Nov 23, 2021
    Mixture of experts training in fairseq is now 40% faster thanks to Microsoft's Tutel library! Blog: microsoft.com/en-us/research… Fairseq code: github.com/pytorch/fairse… Tutel code: github.com/microsoft/tutel
  • user avatar
    fairseq
    @fairseq
    Mar 9, 2021
    fairseq now supports CPU offloading and full parameter+optimizer state sharding via fairscale's FullyShardedDataParallel module. See our tutorial to train a 13B parameter LM on 1 GPU: fb.me/fairseq_fsdp
  • user avatar
    fairseq
    @fairseq
    Nov 12, 2020
    We just released 0.10.0, which is our last significant release before 1.0.0 when we will migrate to @Hydra_Framework. Changelog:
    Image
    Release v0.10.0 · facebookresearch/fairseq
    From github.com
  • See @fairseq's full profile

    Sign up
    Log in
Advertisement
Advertisement