Yifan Zhou,
Qihao Yang,
Yan Li,
Donggang Li,
Xiru Hu,
Hokin Deng,
Ziyang Gong,
Xuanyi Zhou,
Huacan Wang,
Xiangchao Yan, et al.
(2026).
Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation.
arXiv preprint.
Lei Bai,
Zongsheng Cao,
Yang Chen,
Zhiyao Cui,
Shangheng Du,
Yue Fan,
Shiyang Feng,
Zijie Guo,
Haonan He,
Liang He, et al.
(2026).
Scaling the Horizon, Not the Parameters: Reaching Trillion-Parameter Performance with a 35B Agent.
arXiv preprint.
Zongsheng Cao,
Bihao Zhan,
Jinxin Shi,
Jiong Wang,
Fangchen Yu,
Zhijie Zhong,
Yingnan Han,
Zijie Guo,
Tianshuo Peng,
Zhuo Liu, et al.
(2026).
Agents-K1: Towards Agent-native Knowledge Orchestration.
arXiv preprint.
Wanghan Xu,
Shuo Li,
Tianlin Ye,
Qinglong Cao,
Yixin Chen,
Hengjian Gao,
Yiheng Wang,
Qi Li,
Kun Li,
Sheng Xu, et al.
(2026).
ResearchClawBench: A Benchmark for End-to-End Autonomous Scientific Research.
arXiv preprint.
Wanghan Xu,
Yuhao Zhou,
Hengyuan Zhao,
Shuo Li,
Dianzhi Yu,
Zhenfei Yin,
Yaowen Hu,
Fengli Xu,
Wanli Ouyang,
Wenlong Zhang, et al.
(2026).
ReCrit: Transition-Aware Reinforcement Learning for Scientific Critic Reasoning.
arXiv preprint.
Junchao Gong,
Kaiyi Xu,
Wangxu Wei,
Siwei Tu,
Jingyi Xu,
Zili Liu,
Hang Fan,
Zhiwang Zhou,
Tao Han,
Yi Xiao, et al.
(2026).
Earth-o1: A Grid-free Observation-native Atmospheric World Model.
arXiv preprint.