主要职责
中国科学院贯彻落实党中央关于科技创新的方针政策和决策部署,在履行职责过程中坚持党中央对科技工作的集中统一领导。主要职责是:
一、开展使命导向的自然科学领域基础研究,承担国家重大基础研究、应用基础研究、前沿交叉共性技术研究和引领性颠覆性技术研究任务,打造原始创新策源地。 更多+
办院方针
面向世界科技前沿,面向经济主战场,面向国家重大需求,面向人民生命健康,率先实现科学技术跨越发展,率先建成国家创新人才高地,率先建成国家高水平科技智库,率先建设国际一流科研机构,加快打造原始创新策源地,加快突破关键核心技术,努力抢占科技制高点。
院况简介
中国科学院是国家科学技术界最高学术机构、国家科学技术思想库,自然科学基础研究与高技术综合研究的国家战略科技力量。
1949年,伴随着新中国的诞生,中国科学院成立。建院70余年来,中国科学院时刻牢记使命,与科学共进,与祖国同行,以国家富强、人民幸福为己任,人才辈出,硕果累累,为我国科技进步、经济社会发展和国家安全作出了不可替代的重要贡献。 更多+
科技奖励
科技期刊
科技专项
科研进展/ 更多
工作动态/ 更多
工作动态/ 更多
中国科学院学部
中国科学院院部
语音播报
近日,中国科学院软件研究所等围绕动态类型程序语言中复杂执行路径难以有效分析的问题,分析大语言模型的路径约束推理能力,并构建覆盖测试生成、路径可行性判定和缺陷检测的评测基准。
执行路径由程序从入口到出口依次经过的语句和分支构成,是理解程序语义、生成高覆盖测试和发现特定路径缺陷的基础。传统符号执行通过收集路径约束,并借助SMT求解器求解。但面对Python等语言的动态类型、复杂数据结构、对象行为及大量外部接口调用时,传统符号往往难以建立准确的约束模型。大语言模型在代码生成和理解方面的进展,为不依赖SMT约束求解的路径推理提供了可能,但能否沿复杂控制流准确推理且转化为真实软件测试收益,仍缺少研究。
为评估大语言模型能否进行正确的执行路径推理,研究团队围绕三个问题展开。一是给定目标执行路径,模型能否生成输入并准确复现该路径;二是给出路径和分支条件,模型能否判断路径可达、不可达或会触发特定类型缺陷;三是在包含第三方库和复杂依赖的真实Python项目中,路径信息能否帮助模型生成覆盖度更高的单元测试。由此,团队选取14款主流大语言模型,构建出包含基准构建、实证评估的大模型复杂执行路径推理能力分析框架。同时,团队提出了基于插桩和控制流图最小覆盖遍历的路径提取方法,用于数据集构建,并通过实际执行、覆盖率统计和人工标注检验模型输出。
实验显示,大语言模型已初步具备复杂路径约束推理能力。在平均包含233条语句、103个分支的测试生成任务中,推理模型o4-mini达到最高的65.6%路径复现率,表明旗舰推理模型已拥有较强的路径推理能力。在路径分类与缺陷检测任务中,Qwen3-235B识别出全部120个含除零缺陷的程序;与之相反,推理模型在这一任务上没有优势,说明过长推理思维链可能推翻模型正确判断。在真实软件仓库中,路径信息可提升大部分模型的总体行覆盖率,但第三方库和接口的理解能力以及测试的可执行性仍是将路径推理能力转化为工程收益的主要瓶颈。
研究表明,大语言模型现阶段更适合作为符号执行的互补式启发工具。模型可利用代码语义和外部接口知识提供候选输入、缺陷线索和测试方向;传统程序分析负责路径提取、约束校验和结果验证。二者结合,有望形成面向真实软件系统的混合式路径推理与智能测试方法。
相关论文被软件工程领域国际期刊TOSEM 2026录用。

大语言模型执行路径约束求解与测试流程
扫一扫在手机打开当前页
© 1996 - 中国科学院 版权所有 京ICP备05002857号-1
京公网安备110402500047号 网站标识码bm48000002
地址:北京市西城区三里河路52号 邮编:100864
电话: 86 10 68597114(总机) 86 10 68597289(总值班室)








