Zhou Zhao
1999–2026 年に発表
- 580
- 論文数
- 21,596
- 被引用数
- 72
- h 指数
- 305
- i10 指数
被引用数
引用元
国・地域
機関
分野
- Computer Science80.9%
- Engineering4.1%
- Medicine3.7%
- Biochemistry, Genetics and Molecular Biology2.5%
- Environmental Science1.4%
- Social Sciences1.3%
- その他6.1%
トピック
- Multimodal Machine Learning Applications7.3%
- Topic Modeling7.1%
- Speech Recognition and Synthesis5%
- Natural Language Processing Techniques4.7%
- Human Pose and Action Recognition3.6%
- Music and Audio Processing3.5%
- その他68.8%
共著者
全論文
- Pseudo Numerical Methods for Diffusion Models on Manifolds
著者: Luping Liu, Yi Ren, Zhijie Lin, Zhou Zhao - ICLR 2022 被引用: 909
- FastSpeech 2: Fast and High-Quality End-to-End Text to Speech
著者: Yi Ren, Chenxu Hu, Xu Tan, Tao Qin, Sheng Zhao, Zhou Zhao, Tie-Yan Liu - ICLR 2021 被引用: 1,818
- Proceedings of the Twenty-Eighth International Joint Conference on Artificial Intelligence, IJCAI 2019, Macao, China, August 10-16, 2019
著者: Lianli Gao, Xiaosu Zhu, Jingkuan Song, Zhou Zhao, Heng Tao Shen - IJCAI 2019 被引用: 538
- UniAudio: An Audio Foundation Model Toward Universal Audio Generation
著者: Dongchao Yang, Jinchuan Tian, Xu Tan, Rongjie Huang, Songxiang Liu, Xuankai Chang, Jiatong Shi, Sheng Zhao, Jiang Bian, Xixin Wu, Zhou Zhao, Shinji Watanabe, Helen Meng - arXiv (Cornell University), CoRR 2023 被引用: 160
- Video Question Answering via Gradually Refined Attention over Appearance and Motion
著者: Dejing Xu, Zhou Zhao, Jun Xiao, Fei Wu, Hanwang Zhang, Xiangnan He, Yueting Zhuang - international conference on Multimedia, ACM Multimedia 2017 被引用: 415
- DiffSinger: Singing Voice Synthesis via Shallow Diffusion Mechanism
著者: Jinglin Liu, Chengxi Li, Yi Ren, Feiyang Chen, Peng Liu, Zhou Zhao - AAAI Conference on Artificial Intelligence 2022 被引用: 191
- AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension
著者: Qian Yang, Jin Xu, Wenrui Liu, Yunfei Chu, Ziyue Jiang, Xiaohuan Zhou, Yichong Leng, Yuanjun Lv, Zhou Zhao, Chang Zhou, Jingren Zhou - Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), ACL (1) 2024 被引用: 121
- Chat-3D: Data-efficiently Tuning Large Language Model for Universal Dialogue of 3D Scenes
著者: Zehan Wang, Haifeng Huang, Yang Zhao, Ziang Zhang, Zhou Zhao - arXiv (Cornell University), CoRR 2023 被引用: 110
- WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
著者: Shengpeng Ji, Ziyue Jiang, Wen Wang, Yifu Chen, Minghui Fang, Jialong Zuo, Qian Yang, Xize Cheng, Zehan Wang, Ruiqi Li, Ziang Zhang, Xiaoda Yang, Rongjie Huang, Yidi Jiang, Qian Chen, Siqi Zheng, Zhou Zhao - ICLR 2025 被引用: 200
- WavChat: A Survey of Spoken Dialogue Models
著者: Shengpeng Ji, Yifu Chen, Minghui Fang, Jialong Zuo, Jingyu Lu, Hanting Wang, Ziyue Jiang, Long Zhou, Shujie Liu, Xize Cheng, Xiaoda Yang, Zehan Wang, Qian Yang, Jian Li, Yidi Jiang, Jingzhen He, Yunfei Chu, Jin Xu, Zhou Zhao - arXiv (Cornell University), CoRR 2024 被引用: 94
- Improving Automatic Source Code Summarization via Deep Reinforcement Learning
著者: Yao Wan, Zhou Zhao, Min Yang, Guandong Xu, Haochao Ying, Jian Wu, Philip S. Yu - ACM/IEEE International Conference on Automated Software Engineering, ASE 2018 被引用: 407
- Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation
著者: Jiawei Huang, Yi Ren, Rongjie Huang, Dongchao Yang, Zhenhui Ye, Chen Zhang, Jinglin Liu, Xiang Yin, Zejun Ma, Zhou Zhao - arXiv (Cornell University), CoRR 2023 被引用: 94
- FastDiff: A Fast Conditional Diffusion Model for High-Quality Speech Synthesis
著者: Rongjie Huang, Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu, Yi Ren, Zhou Zhao - Thirty-First International Joint Conference on Artificial Intelligence, IJCAI 2022 被引用: 136
- AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head
著者: Rongjie Huang, Mingze Li, Dongchao Yang, Jiatong Shi, Xuankai Chang, Zhenhui Ye, Yuning Wu, Zhiqing Hong, Jiawei Huang, Jinglin Liu, Yi Ren, Yuexian Zou, Zhou Zhao, Shinji Watanabe - AAAI Conference on Artificial Intelligence 2024 被引用: 113
- Make-An-Audio: Text-To-Audio Generation with Prompt-Enhanced Diffusion Models
著者: Rongjie Huang, Jiawei Huang, Dongchao Yang, Yi Ren, Luping Liu, Mingze Li, Zhenhui Ye, Jinglin Liu, Xiang Yin, Zhou Zhao - ICML 2023 被引用: 505
- AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head
著者: Rongjie Huang, Mingze Li, Dongchao Yang, Jiatong Shi, Xuankai Chang, Zhenhui Ye, Yuning Wu, Zhiqing Hong, Jiawei Huang, Jinglin Liu, Yi Ren, Zhou Zhao, Shinji Watanabe - arXiv (Cornell University), CoRR 2023 被引用: 110
- GeneFace: Generalized and High-Fidelity Audio-Driven 3D Talking Face Synthesis
著者: Zhenhui Ye, Ziyue Jiang, Yi Ren, Jinglin Liu, Jinzheng He, Zhou Zhao - ICLR 2023 被引用: 210
- FastSpeech: Fast, Robust and Controllable Text to Speech
著者: Yi Ren, Yangjun Ruan, Xu Tan, Tao Qin, Sheng Zhao, Zhou Zhao, Tie-Yan Liu - NeurIPS 2019 被引用: 583
- Mega-TTS: Zero-Shot Text-to-Speech at Scale with Intrinsic Inductive Bias
著者: Ziyue Jiang, Yi Ren, Zhenhui Ye, Jinglin Liu, Chen Zhang, Qian Yang, Shengpeng Ji, Rongjie Huang, Chunfeng Wang, Xiang Yin, Zejun Ma, Zhou Zhao - arXiv (Cornell University), CoRR 2023 被引用: 68
- Self-Supervised Spatiotemporal Learning via Video Clip Order Prediction
著者: Dejing Xu, Jun Xiao, Zhou Zhao, Jian Shao, Di Xie, Yueting Zhuang - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2019 被引用: 438
- Chat-3D v2: Bridging 3D Scene and Large Language Models with Object Identifiers
著者: Haifeng Huang, Yilun Chen, Zehan Wang, Rongjie Huang, Runsen Xu, Tai Wang, Luping Liu, Xize Cheng, Yang Zhao, Jiangmiao Pang, Zhou Zhao - Advances in Neural Information Processing Systems 37, NeurIPS 2024 被引用: 190
- Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
著者: Zhenhui Ye, Tianyun Zhong, Yi Ren, Jiaqi Yang, Weichuang Li, Jiawei Huang, Ziyue Jiang, Jinzheng He, Rongjie Huang, Jinglin Liu, Chen Zhang, Xiang Yin, Zejun Ma, Zhou Zhao - ICLR 2024 被引用: 121
- Cross-Modal Interaction Networks for Query-Based Moment Retrieval in Videos
著者: Zhu Zhang, Zhijie Lin, Zhou Zhao, Zhenxin Xiao - SIGIR Conference on Research and Development in Information Retrieval 2019 被引用: 247
- CauseRec: Counterfactual User Sequence Synthesis for Sequential Recommendation
著者: Shengyu Zhang, Dong Yao, Zhou Zhao, Tat-Seng Chua, Fei Wu - SIGIR Conference on Research and Development in Information Retrieval 2021 被引用: 113
