Tian (Owen) Ye
  • Agent Harness
  • Blogs
  • Publications

Publications

Publications

Research across foundation models, generative vision, and automated AI systems.

Sol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention Sparsification

Haopeng Li, Yitong Li, Junsong Chen, Tian Ye, Haozhe Liu, Jincheng Yu, Duomin Wang, Ruihua Zhang, Zeke Xie, Enze Xie, Song Han
arXiv 2026
arXiv Code Project Page

Training-free sparse attention for quality-preserving video generation, delivering over 2× end-to-end acceleration and up to 5× with Sol-Engine.

SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation

Junsong Chen, Jincheng Yu, Yitong Li, Shuchen Xue, Haozhe Liu, Jingyu Xin, Yuyang Zhao, Tian Ye, Zhangjie Wu, Zian Wang, Daquan Zhou, Ping Luo, Song Han, Enze Xie
arXiv 2026
arXiv Code Project Page

Open-source 5B/14B hybrid video DiTs for high-quality 720p generation, accelerated to 13.06 seconds on a single H100.

GenEvolve: Self-Evolving Image Generation Agents via Tool-Orchestrated Visual Experience Distillation

Sixiang Chen, Zhaohu Xing, Tian Ye, Xinyu Geng, Yunlong Lin, Jianyu Lai, Xuanhua He, Fuxiang Zhai, Jialin Gao, Lei Zhu
arXiv 2026
arXiv Code Project Page

SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer

Haoyi Zhu*, Haozhe Liu*, Yuyang Zhao*, Tian Ye*, Junsong Chen*, Jincheng Yu, Tong He, Song Han, Enze Xie
arXiv 2026
arXiv Code Project Page

An open-source world model for controllable minute-long 720p video generation on a single GPU.

UltraFlux: Data-Model Co-Design for High-quality Native 4K Text-to-Image Generation across Diverse Aspect Ratios

Tian Ye*, Song Fei*, Lei Zhu
CVPR 2026 Highlight
arXiv Code Project Page

Native 4K text-to-image generation across diverse aspect ratios, matching or surpassing Seedream 4.0.

PosterCraft: Rethinking High-Quality Aesthetic Poster Generation in a Unified Framework

SiXiang Chen*, Jianyu Lai*, Jialin Gao*, Tian Ye, Haoyu Chen, Hengyu Shi, Shitong Shao, Yunlong Lin, Song Fei, Zhaohu Xing, Yeying Jin, Junfeng Luo, Xiaoming Wei, Lei Zhu
ICLR 2026
arXiv Code Project Page

A unified framework for high-quality aesthetic poster generation with precise text rendering, strong layouts, and visual-language refinement.

LucidFlux: Caption-Free Universal Image Restoration via a Large-Scale Diffusion Transformer

Song Fei*, Tian Ye*, Lujia Wang, Lei Zhu
ICLR 2026
arXiv Code Project Page

A caption-free 14B restoration model delivering photorealistic results beyond leading commercial systems.

GlassWizard: Harvesting Diffusion Priors for Glass Surface Detection

Wenxue Li*, Tian Ye*, Xinyu Xiong, Jinbin Bai, Feilong Tang, Wenxuan Song, Zhaohu Xing, Lie Ju, Guanbin Li, Lei Zhu
ICCV 2025
Code

MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice

Hongwei Yi*, Tian Ye*, Shitong Shao*, Xuancheng Yang*, Jiantong Zhao*, Hanzhong Guo*, Terrance Wang*, Qingyu Yin, Zeke Xie, Lei Zhu, Wei Li, Michael Lingelbach, Daquan Zhou
Technical Report 2025
Project Page

Technical report for Hedra Inc.’s Character-3 model.

PromptHaze: Prompting Real-world Dehazing via Depth Anything Model

Tian Ye, Sixiang Chen, Haoyu Chen, Wenhao Chai, Jingjing Ren, Zhaohu Xing, Wenxue Li, Lei Zhu
AAAI 2025

AGLLDiff: Guiding Diffusion Models Towards Unsupervised Training-free Real-world Low-light Image Enhancement

Yunlong Lin*, Tian Ye*, Sixiang Chen*, Zhenqi Fu, Yingying Wang, Wenhao Chai, Zhaohu Xing, Lei Zhu, Xinghao Ding
AAAI 2025
arXiv Code Project Page

Learning Diffusion Texture Priors for Image Restoration

Tian Ye, Sixiang Chen, Wenhao Chai, Zhaohu Xing, Jing Qin, Ge Lin, Lei Zhu
CVPR 2024 Highlight

Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis

Jinbin Bai*, Tian Ye*, Wei Chow, Enxin Song, Qing-Guo Chen, Xiangtai Li, Zhen Dong, Lei Zhu, Shuicheng Yan
ICLR 2025
arXiv Code Project Page

The first SDXL-level high-resolution non-AR T2I model.

Sparse Sampling Transformer with Uncertainty-Driven Ranking for Unified Removal of Raindrops and Rain Streaks

Sixiang Chen*, Tian Ye*, Jinbin Bai, Jun Shi, Erkang Chen, Lei Zhu
ICCV 2023
Code Project Page

Adverse Weather Removal with Codebook Priors

Tian Ye*, Sixiang Chen*, Jinbin Bai*, Shi Jun, Chenghao Xue, Jingjia Jiang, Junjie Yin, Erkang Chen, Yun Liu
ICCV 2023
Code

Perceiving and Modeling Density for Image Dehazing

Tian Ye*, Yunchen Zhang*, Mingchao Jiang*, Liang Chen, Yun Liu, Erkang Chen
ECCV 2022 Oral
Code
© 2026 Tian (Owen) Ye · Powered by Hugo & PaperMod
Advertisement
Advertisement