@misc{indiciae146236eaee12, title = {WenLan: Bridging Vision and Language by Large-Scale Multi-Modal Pre-Training}, author = {Yuqi Huo and Manli Zhang and Guangzhen Liu and Haoyu Lu and Yizhao Gao and Guoxing Yang and Jingyuan Wen and Heng Zhang and Baogui Xu and Weihao Zheng and Zongzheng Xi and Yueqian Yang and Anwen Hu and Jinming Zhao and Ruichen Li and Yida Zhao and Liang Zhang and Yuqing Song and Xin Hong and Wanqing Cui and Danyang Hou and Yingyan Li and Junyi Li and Peiyu Liu and Zheng Gong and Chuhao Jin and Yuchong Sun and Shizhe Chen and Zhiwu Lu and Zhicheng Dou and Qin Jin and Yanyan Lan and Wayne Xin Zhao and Ruihua Song and Ji-Rong Wen}, year = {2021}, url = {https://arxiv.org/abs/2103.06561}, note = {Source identifier: 2103.06561} }