Shunyu Liu,
Minghao Liu,
Huichi Zhou,
Zhenyu Cui,
Yang Zhou,
Yuhao Zhou,
Wendong Fan,
Ge Zhang,
Jiajun Shi,
Weihao Xuan, et al.
(2025).
VeriGUI: Verifiable Long-Chain GUI Dataset.
arXiv.
Shuo Cao,
Jiayang Li,
Xiaohui Li,
Yuandong Pu,
Kaiwen Zhu,
Yuanting Gao,
Siqi Luo,
Yi Xin,
Qi Qin,
Yu Zhou, et al.
(2025).
UniPercept: Towards Unified Perceptual-Level Image Understanding across Aesthetics, Quality, Structure, and Texture.
arXiv.
Kang Chen,
Tao Han,
Fenghua Ling,
Junchao Gong,
Lei Bai,
Xinyu Wang,
Jing-Jia Luo,
Ben Fei,
Wenlong Zhang,
Xi Chen, et al.
(2025).
The operational medium-range deterministic weather forecasting can be extended beyond a 10-day lead time.
Communications Earth & Environment.
Yizhou Wang,
Chen Tang,
Han Deng,
Jiabei Xiao,
Jiaqi Liu,
Jianyu Wu,
Jun Yao,
Pengze Li,
Encheng Su,
Lintao Wang, et al.
(2025).
SciReasoner: Laying the Scientific Reasoning Ground Across Disciplines.
arXiv.
Yiheng Wang,
Yixin Chen,
Shuo Li,
Yifan Zhou,
Bo Liu,
Hengjian Gao,
Jiakang Yuan,
Jia Bu,
Wanghan Xu,
Yuhao Zhou, et al.
(2025).
SciEvalKit: An Open-source Evaluation Toolkit for Scientific General Intelligence.
arXiv.
Yuhao Zhou,
Yiheng Wang,
Xuming He,
Ruoyao Xiao,
Zhiwei Li,
Qiantai Feng,
Zijie Guo,
Yuejin Yang,
Hao Wu,
Wenxuan Huang, et al.
(2025).
Scientists' First Exam: Probing Cognitive Abilities of MLLM via Perception, Understanding, and Reasoning.
Advances in Neural Information Processing Systems.
Wanghan Xu,
Yuhao Zhou,
Yifan Zhou,
Qinglong Cao,
Shuo Li,
Jia Bu,
Bo Liu,
Yixin Chen,
Xuming He,
Xiangyu Zhao, et al.
(2025).
Probing Scientific General Intelligence of LLMs with Scientist-Aligned Workflows.
arXiv.