Hi😊~I am currently an algorithm engineer at ByteDance. Previously, I worked as an algorithm engineer at Ant Group from July 2023 to June 2026. I received my master's degree in Artificial Intelligence from Gaoling School of Artificial Intelligence, Renmin University of China (RUC GSAI), advised by Prof. Zhiwu Lu. My research interests are Multi-modal Understanding and AIGC (AI generated content).
你好😊~我目前在字节跳动担任算法工程师。此前于 2023 年 7 月至 2026 年 6 月在蚂蚁集团担任算法工程师。我硕士毕业于中国人民大学高瓴人工智能学院人工智能专业,师从卢志武教授。我的研究兴趣包括多模态理解与 AIGC(人工智能生成内容)。
💼 Experience
- 2026.07 - Present, ByteDance 🎵, AI Search.
- 2023.07 - 2026.06, Ant Group 🐜, AI Search.
📖 Education
- 2020.09 - 2023.06, Master's, Renmin University of China, Gaoling School of Artificial Intelligence, Artificial Intelligence🤖.
- 2016.09 - 2020.06, Bachelor's, Renmin University of China, School of Science, Physics⚛️.
💻 Internships
- 2022.06 - 2022.10, ByteDance, Applied Vision Group.
- 2020.12 - 2022.03, Beijing Academy of Artificial Intelligence (BAAI).
💼 工作经历
- 2026.07 - 至今,字节跳动 🎵,AI Search。
- 2023.07 - 2026.06,蚂蚁集团 🐜,AI Search。
📖 教育经历
- 2020.09 - 2023.06,中国人民大学,高瓴人工智能学院,人工智能专业硕士🤖。
- 2016.09 - 2020.06,中国人民大学,理学院,物理学专业本科⚛️。
💻 实习经历
- 2022.06 - 2022.10,字节跳动,应用视觉组。
- 2020.12 - 2022.03,北京智源人工智能研究院(BAAI)。
📝 Publications
ACM MM 2023TikTalk: A Video-Based Dialogue Dataset for Multi-Modal Chitchat in Real World, Hongpeng Lin, Ludan Ruan, Wenke Xia, Peiyu Liu, Jingyuan Wen, Yixin Xu, Di Hu, Ruihua Song, Wayne Xin Zhao, Qin Jin, Zhiwu LuJournal of Software 2023Text-to-Chinese-Painting Method Based on Multi-Domain VQGAN, Zelong Sun, Guoxing Yang, Jingyuan Wen, Nanyi Fei, Zhiwu Lu, Ji-Rong WenNature Communications 2022Towards Artificial General Intelligence via a Multimodal Foundation Model, Nanyi Fei, Zhiwu Lu, Yizhao Gao, Guoxing Yang, Yuqi Huo, Jingyuan Wen, Haoyu Lu, Ruihua Song, Xin Gao, Tao Xiang, Hao Sun, Ji-Rong WenCOLING 2022Visual Prompt Tuning for Few-Shot Text Classification, Jingyuan Wen, Yutian Luo, Nanyi Fei, Guoxing Yang, Zhiwu Lu, Hao Jiang, Jie Jiang, Zhao CaoArXiv preprint 2022Multimodal Foundation Models Are Better Simulators of the Human Brain, Haoyu Lu, Qiongyi Zhou, Nanyi Fei, Zhiwu Lu, Mingyu Ding, Jingyuan Wen, Changde Du, Xin Zhao, Hao Sun, Huiguang He, Ji-Rong WenArXiv preprint 2021WenLan 2.0: Make AI Imagine via a Multimodal Foundation Model, Nanyi Fei, Zhiwu Lu, Yizhao Gao, Guoxing Yang, Yuqi Huo, Jingyuan Wen, Haoyu Lu, Ruihua Song, Xin Gao, Tao Xiang, Hao Sun, Ji-Rong WenArXiv preprint 2021WenLan: Bridging Vision and Language by Large-Scale Multi-Modal Pre-Training, Yuqi Huo, Manli Zhang, Guangzhen Liu, Haoyu Lu, Yizhao Gao, Guoxing Yang, Jingyuan Wen, Heng Zhang, Baogui Xu, Weihao Zheng, Zongzheng Xi, Yueqian Yang, Anwen Hu, Jinming Zhao, Ruichen Li, Yida Zhao, Liang Zhang, Yuqing Song, Xin Hong, Wanqing Cui, Danyang Hou, Yingyan Li, Junyi Li, Peiyu Liu, Zheng Gong, Chuhao Jin, Yuchong Sun, Shizhe Chen, Zhiwu Lu, Zhicheng Dou, Qin Jin, Yanyan Lan, Wayne Xin Zhao, Ruihua Song, Ji-Rong Wen