论文

论文也可在 Google Scholar 查看。

按作者署名位置排列:第一作者、共同第一作者、其他署名位置。* 表示同等贡献。主要研究方向的详细介绍见研究页面。论文英文原题保留在中文译名下方。

投稿中

仅需最后一层的键值缓存

Last Layer Key-Value Cache is All You Need
Adobe Research · 投稿中
详情

通用测试时训练

Universal Test-Time Training
Adobe Research · 投稿中
详情

测试时生成

Test-Time Generation
Adobe Research · 投稿中
详情

第一作者

R-KV:感知冗余的 KV 缓存压缩,无需训练即可加速推理模型

R-KV: Redundancy-aware KV Cache Compression for Training-Free Reasoning Models Acceleration
Zefan Cai, Wen Xiao, Hanshi Sun, Cheng Luo, Yikai Zhang, Ke Wan, Yucheng Li, Yeyang Zhou, Li-Wen Chang, Jiuxiang Gu, Zhen Dong, Anima Anandkumar, Abedelkadir Asi, Junjie Hu
NeurIPS 2025
PDF · 项目主页 · 代码 · 视频 · 动态 · 详情

PyramidKV:基于金字塔式信息汇聚的动态 KV 缓存压缩

PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling
Zefan Cai, Yichi Zhang, Bofei Gao, Yuliang Liu, Yucheng Li, Tianyu Liu, Keming Lu, Wayne Xiong, Yue Dong, Junjie Hu, Wen Xiao
COLM 2025 亮点报告 Spotlight(24 / 418)
PDF · 项目主页 · 代码 · 动态 · 详情

从偏好到偏见:对齐微调如何塑造视频扩散模型中的社会偏见

From Preferences to Prejudice: The Role of Alignment Tuning in Shaping Social Bias in Video Diffusion Models
Zefan Cai*, Haoyi Qiu*, Haozhe Zhao*, Ke Wan, Jiachen Li, Jiuxiang Gu, Wen Xiao, Nanyun Peng, Junjie Hu
TMLR 2025
PDF · 代码

提升零样本事件检测中的事件定义遵循能力

Improving Event Definition Following For Zero-Shot Event Detection
Zefan Cai*, Po-Nien Kung*, Ashima Suvarna, Mingyu Derek Ma, Hritik Bansal, Baobao Chang, P. Jeffrey Brantingham, Wei Wang, Nanyun Peng
ACL 2024 (主会) · 长文
PDF

DialogVCS:对话系统升级中的鲁棒自然语言理解

DialogVCS: Robust Natural Language Understanding in Dialogue System Upgrade
Zefan Cai*, Xin Zheng*, Tianyu Liu*, Xu Wang, Haoran Meng, Jiaqi Han, Gang Yuan, Binghuai Lin, Baobao Chang, Yunbo Cao
NAACL 2024 (主会) · 长文
PDF

MMGR:多模态生成式推理

MMGR: Multi-Modal Generative Reasoning
Zefan Cai, Haoyi Qiu, Tianyi Ma, Haozhe Zhao, Gengze Zhou, Kung-Hsiang Huang, Parisa Kordjamshidi, Minjia Zhang, Wen Xiao, Jiuxiang Gu, Nanyun Peng, Junjie Hu
预印本 2025
PDF

共同第一作者

MENTOR:具有均衡多模态控制能力的高效自回归图像生成

MENTOR: Efficient Autoregressive Image Generation with Balanced Multimodal Control
Haozhe Zhao*, Zefan Cai*, Shuzheng Si, Liang Chen, Jiuxiang Gu, Wen Xiao, Minjia Zhang, Junjie Hu
Findings of ACL 2026
PDF

利用下一词元预测进行测试时训练

Test-Time Training with Next-Token Prediction
Xuan Ouyang*, Zefan Cai*, Junjie Hu
预印本 2026
PDF · 详情

Delta 注意力残差

Delta Attention Residuals
Cheng Luo*, Zefan Cai*, Junjie Hu
预印本 2026
PDF · 详情

MMICL:通过多模态上下文学习增强视觉语言模型

MMICL: Empowering Vision-language Model with Multi-Modal In-Context Learning
Haozhe Zhao*, Zefan Cai*, Shuzheng Si*, Xiaojian Ma, Kaikai An, Liang Chen, Zixuan Liu, Sheng Wang, Wenjuan Han, Baobao Chang
ICLR 2024 (海报)
PDF · 代码

通过教师语言选择与跨语言自蒸馏缓解多语言预训练语言模型的语言间性能差异

Mitigating Language-Level Performance Disparity in mPLMs via Teacher Language Selection and Cross-lingual Self-Distillation
Haozhe Zhao*, Zefan Cai*, Shuzheng Si, Liang Chen, Yufeng He, Kaikai An, Baobao Chang
NAACL 2024 (主会) · 长文
PDF · 代码

VeCAF:感知训练目标的视觉语言协同主动微调

VeCAF: Vision-language Collaborative Active Finetuning with Training Objective Awareness
Rongyu Zhang*, Zefan Cai*, Huanrui Yang*, Zidong Liu, Denis A. Gudovskiy, Tomoyuki Okuno, Yohei Nakata, Kurt Keutzer, Baobao Chang, Yuan Du, Li Du, Shanghang Zhang
ACM Multimedia 2024
PDF

大语言模型的组合式任务表示

Compositional Task Representations for Large Language Models
Nan Shao*, Zefan Cai*, Chonghua Liao, Yanan Zheng, Zhilin Yang
ICLR 2023(海报)
PDF · 代码

SANTA:针对远程监督命名实体识别中不准确与不完整标注噪声的独立策略

SANTA: Separate Strategies for Inaccurate and Incomplete Annotation Noise in Distantly-Supervised Named Entity Recognition
Shuzheng Si*, Zefan Cai*, Shuang Zeng, Guoqiang Feng, Jiaxing Lin, Baobao Chang
ACL 2023 (Findings) · 长文
PDF

ML-Bench:大语言模型利用开源库完成机器学习任务

ML-Bench: Large Language Models Leverage Open-source Libraries for Machine Learning Tasks
Yuliang Liu*, Xiangru Tang*, Zefan Cai*, Junjie Lu, Yichi Zhang, Yanjun Shao, Zexuan Deng, Helan Hu, Zengxian Yang, Kaikai An, Ruijun Huang, Shuzheng Si, Sheng Chen, Haozhe Zhao, Zhengliang Li, Liang Chen, Yiming Zong, Yan Wang, Tianyu Liu, Zhiwei Jiang, Baobao Chang, Yujia Qin, Wangchunshu Zhou, Yilun Zhao, Arman Cohan, Mark Gerstein
ICLR 2025 DL4C 研讨会与 Agentic AI for Scientific Discovery 研讨会
PDF · 项目主页 · 代码 · 数据

其他署名位置

大语言模型评审器助力发现数学错误:利用自然语言反馈构建更好的数学验证器

LLM Critics Help Catch Bugs in Mathematics: Towards a Better Mathematical Verifier with Natural Language Feedback
Bofei Gao, Zefan Cai, Runxin Xu, Peiyi Wang, Ce Zheng, Runji Lin, Keming Lu, Dayiheng Liu, Chang Zhou, Wen Xiao, Junjie Hu, Tianyu Liu, Baobao Chang
ACL 2025 (Findings) · 长文
PDF · 代码

并非所有注意力头都同样重要:融合检索与推理的注意力头级 KV 缓存压缩方法

Not All Heads Matter: A Head-Level KV Cache Compression Method with Integrated Retrieval and Reasoning
Yu Fu, Zefan Cai, Abedelkadir Asi, Wayne Xiong, Yue Dong, Wen Xiao
ICLR 2025 (海报)
PDF · 代码 · 详情

不遗漏任何偏好:群体分布偏好优化

No Preference Left Behind: Group Distributional Preference Optimization
Binwei Yao, Zefan Cai, Yun-Shiuan Chuang, Shanglin Yang, Ming Jiang, Diyi Yang, Junjie Hu
ICLR 2025 (海报)
PDF · 代码

HeadInfer:通过按注意力头卸载实现内存高效的大语言模型推理

HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading
Cheng Luo, Zefan Cai, Hanshi Sun, Jinqi Xiao, Bo Yuan, Wen Xiao, Junjie Hu, Jiawei Zhao, Beidi Chen, Anima Anandkumar
ICML 2025 长上下文基础模型研讨会
PDF · 代码 · 详情

扩展音频同步视觉动画:一种高效训练范式

Scaling Up Audio-Synchronized Visual Animation: An Efficient Training Paradigm
Lin Zhang, Zefan Cai, Yufan Zhou, Shentong Mo, Jinhong Lin, Cheng-En Wu, Yibing Wei, Yijing Zhang, Ruiyi Zhang, Wen Xiao, Tong Sun, Junjie Hu, Pedro Morgado
预印本 2025
PDF

视觉语言智能的火花:用于高效精细图像生成的二维自回归 Transformer

A Spark of Vision-Language Intelligence: 2-Dimensional Autoregressive Transformer for Efficient Fine-grained Image Generation
Liang Chen, Sinan Tan, Zefan Cai, Weichu Xie, Haozhe Zhao, Yichi Zhang, Junyang Lin, Jinze Bai, Tianyu Liu, Baobao Chang
ICLR 2025 (海报)
PDF · 代码 · 模型

UniTemp:通过双向蒸馏实现任意时间顺序的视频生成

UniTemp: Unlocking Video Generation in Any Temporal Order via Bidirectional Distillation
Lin Zhang, Sicheng Mo, Zefan Cai, Jinhong Lin, Zihao Lin, Jiuxiang Gu, Krishna Kumar Singh, Yuheng Li, Yin Li
预印本 2026
PDF

Omni-Math:面向大语言模型的通用奥林匹克级数学基准

Omni-Math: A Universal Olympiad Level Mathematic Benchmark for Large Language Models
Bofei Gao, Feifan Song, Zhe Yang, Zefan Cai, Yibo Miao, Qingxiu Dong, Lei Li, Chenghao Ma, Liang Chen, Runxin Xu, Zhengyang Tang, Benyou Wang, Daoguang Zan, Shanghaoran Quan, Ge Zhang, Lei Sha, Yichang Zhang, Xuancheng Ren, Tianyu Liu, Baobao Chang
ICLR 2025 (海报)
PDF · 项目主页 · 代码 · 数据

COMMA:具备通信能力的多模态多智能体基准

COMMA: A Communicative Multimodal Multi-Agent Benchmark
Timothy Ossowski, Jixuan Chen, Danyal Maqbool, Zefan Cai, Tyler Bradshaw, Junjie Hu
TMLR 2025
PDF

大语言模型并非公平的评估者

Large Language Models Are Not Fair Evaluators
Peiyi Wang, Lei Li, Liang Chen, Zefan Cai, Dawei Zhu, Binghuai Lin, Yunbo Cao, Qi Liu, Tianyu Liu, Zhifang Sui
ACL 2024 (主会) · 长文
PDF · 代码

PCA-Bench:在感知、认知与行动链中评估多模态大语言模型

PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain
Liang Chen, Yichi Zhang, Shuhuai Ren, Haozhe Zhao, Zefan Cai, Yuchi Wang, Peiyi Wang, Xiangdi Meng, Tianyu Liu, Baobao Chang
ACL 2024 (Findings) · 长文
PDF · 代码 · 数据

通过多模态大语言模型实现端到端具身决策

Towards End-to-End Embodied Decision Making via Multi-Modal Large Language Model
Liang Chen, Yichi Zhang, Shuhuai Ren, Haozhe Zhao, Zefan Cai, Yuchi Wang, Peiyi Wang, Tianyu Liu, Baobao Chang
NeurIPS 2023 决策基础模型研讨会
PDF · 代码

通过不确定性感知教师学习与学生间协同学习提升远程监督命名实体识别的鲁棒性

Improving the Robustness of Distantly-Supervised Named Entity Recognition via Uncertainty-Aware Teacher Learning and Student-Student Collaborative Learning
Shuzheng Si, Helan Hu, Haozhe Zhao, Shuang Zeng, Kaikai An, Zefan Cai, Baobao Chang
ACL 2024 (Findings) · 长文
PDF

AdaptiveStep:依据模型置信度自动划分推理步骤

AdaptiveStep: Automatically Dividing Reasoning Step through Model Confidence
Yuliang Liu, Junjie Lu, Zhaoling Chen, Chaofeng Qu, Jason Klein Liu, Chonghan Liu, Zefan Cai, Yunhui Xia, Li Zhao, Jiang Bian, Chuheng Zhang, Wei Shen, Zhouhan Lin
ICML 2025 (海报)
PDF · 代码 · 模型

BabyVision:超越语言的视觉推理

BabyVision: Visual Reasoning Beyond Language
Liang Chen, Weichu Xie, Yiyan Liang, Hongfeng He, Hans Zhao, Zhibo Yang, Zhiqi Huang, Haoning Wu, Haoyu Lu, Y. Charles, Yiping Bao, Yuantao Fan, Guopeng Li, Haiyang Shen, Xuanzhong Chen, Wendong Xu, Shuzheng Si, Zefan Cai, Wenhao Chai, Ziqi Huang, Fangfu Liu, Tianyu Liu, Baobao Chang, Ming Wu, Xiaobo Hu, Kaiyuan Chen, Yixin Ren, Yang Liu, Yuan Gong, Kuan Li
预印本 2026
PDF