🧩 软件工程 · Bilingual Paper Reading

软件工程 · 论文精读

代码生成、程序分析、软件测试、软件架构与质量
0篇论文
0份精读版
0段朗读音频
0大细分领域
01

全部论文

Complete Archive · 20
01
科研

随机过程代码生成:把「文档计划 + 随机过程」的思想迁移到代码生成,提升长代码连贯性

Stochastic Code Generation
大模型写短代码很溜、写长代码就跑题——本文把文本生成领域「先由随机过程生成计划、再照着计划写」的 Time Control 解法搬到代码生成上,基于 CodeParrot 改造,在 HumanEval 上效果与原模型相当、部分情况更优。
arXiv:2304.08243 · 2023年4月14日(v1) · 机构未标注
02
优化

帕累托最优代码生成:把「验证器选择」变成精度-吞吐量的帕累托优化问题

Pareto Optimal Code Generation
「生成-执行-排序」的代码生成范式越来越烧算力,本文把「选哪种验证信号」当作帕累托优化问题,实证发现「轻量过滤 + ORM 排序」的分阶段验证能把吞吐量提高 11.64 倍、精度只损失 8.26%。
arXiv:2506.10056 · 2025年6月11日(v1) · 机构未标注
03
大模型

IFEvalCode:受控代码生成——评测与增强代码大模型的指令遵循能力

IFEvalCode: Controlled Code Generation
代码 LLM 不光要「写得对」,还要「听话」——本文构建了 1.6K 样本、8 种语言、中英双语的受控代码生成基准 IFEvalCode,把「正确性」与「指令遵循」分开打分,并提出「前向 + 后向约束生成」框架训练模型更听话。
arXiv:2507.22462 · 2025年7月30日(v1) · 北京航空航天大学
04
科研

基于推理的软件测试(把测试问题当作因果推理任务)

Reasoning-Based Software Testing
与其问「什么输入和故障最相关」,不如问「什么输入会导致系统故障」——把软件测试重构成因果推理任务。
arXiv:2303.01302 · 2023年3月2日(v1) · 机构未标注
05
科研

软件测试教育中的幽默(让测试课不再「枯燥」)

Humor in Software Testing Education
在加拿大、德国两所大学的测试入门课中引入幽默元素,58 名学生的混合方法研究表明:幽默让测试更有趣、更有归属感、更激发创造,对女生尤其明显。
arXiv:2606.21682 · 2026年6月19日(v1) · 机构未标注
06
信息检索

软件测试文献检索研究(测试的形式化与理论基础考察)

Searching publications on software testing
一篇「元研究」式短札记:系统检索「测试的形式化与理论」相关文献,结论是——软件测试的基础在某些方面尚未完备。
arXiv:1008.2647 · 2010年8月16日(v1) · 阿姆斯特丹大学
07
科研

虚拟现实软件测试的实证刻画:对 97 个开源 VR 应用的量化与质性研究

Characterizing Virtual Reality Software Testing
翻遍 97 个开源 VR 项目(含 28 个工业项目),发现 74.2% 一个测试都没有——VR 软件测试还处在「蛮荒时代」。
arXiv:2211.01992 · 2022年11月3日(v1) · 机构未标注
08
科研

自然语言静态程序分析:用 大白话定义程序分析任务,自动生成 CodeQL 查询

Naturalistic Static Program Analysis
把「写静态分析规则」变成「用大白话描述需求」——NASRA 自动把自然语言翻译成 CodeQL 查询,用它找出 Java 程序里的密码学误用。
arXiv:2301.04862 · 2023年1月12日(v1) · 机构未标注
09
科研

可信且保密的程序分析:不泄露源码也能完成多方软件合规认证

Trusted And Confidential Program Analysis
卖方不想交源码、买方又不敢轻信——把源码加密后送进可信执行环境做分析,双方都能信,谁也没泄密。
arXiv:2112.00346 · 2021年12月1日(v1) · 机构未标注
10
科研

关系式程序合成:自动合成一个或多个程序,使它们共同满足一条关系式规格

Relational Program Synthesis
把「验证两个程序是否满足关系」倒过来想,就是「合成一组满足关系的程序」——用关系式版本空间把组合爆炸的搜索空间压下来。
arXiv:1809.02283 · 2018年9月7日(v1) · 得克萨斯大学奥斯汀分校
11
科研

交互式程序合成:用增量算法、分步问题建模与反馈式意图细化,让「示例编程」又快又可靠

Interactive Program Synthesis
示例编程(PBE)卡在「1–2 秒响应」和「用户不是程序员」两关,本文把交互形式化成三个维度,同时撬动性能与正确性。
arXiv:1703.03539 · 2017年3月10日(v1) · 机构未标注
12
科研

度量程序合成:把「观测等价」放松为「观测相似」,用距离聚类压缩搜索空间、用距离引导修复逼近正确答案

Metric Program Synthesis
找不到「输出完全一样」的程序时,先按距离聚类留下「输出差不多」的代表元,再对「差不多对」的程序做距离引导修复,最终精确命中示例。
arXiv:2206.06164 · 2022年6月13日(v1) · 机构未标注
13
科研

程序综合的几何学:把程序看作解析簇的奇点(贝叶斯后验的「相」)

Geometry of Program Synthesis
在经典理论里程序是一段离散代码、没有「空间」;本文把程序重新理解为连续空间中解析簇的奇点、贝叶斯后验的「相」,为程序综合开辟新研究方向。
arXiv:2103.16080 · 2021年3月30日(v1) · 墨尔本大学
14
科研

资源引导的程序综合:让递归程序既满足功能规格、又满足资源上界

Resource-Guided Program Synthesis
把「功能正确」和「资源高效」放进同一套类型系统,让用户给的资源上界指挥程序搜索,生成「构造即正确、构造即高效」的递归程序。
arXiv:1904.07415 · 2019年4月16日(v1) · 加州大学
15
神经网络

神经符号程序综合:让神经网络从输入输出示例学会构造程序

Neuro-Symbolic Program Synthesis
用两个神经模块(互相关 I/O 网络 + R3NN)把「搜索程序」变成「生成程序」:看一眼输入输出示例,就一步步长出程序树,还能泛化到训练时没见过的程序。
arXiv:1611.01855 · 2016年11月6日(v1) · 卡内基梅隆大学
16
科研

饱和式程序综合:用饱和式定理证明从功能规格中边证边写程序

Program Synthesis in Saturation
给定理证明器装上「答案文字」机制,证明「程序正确」的同时把程序代码也抽出来——证明完成,程序到手。
arXiv:2402.18962 · 2024年2月29日(v1) · 机构未标注
17
科研

自我填充代码生成:把「填空式」能力引入自回归解码,让代码模型非单调地写代码

Self-Infilling Code Generation
利用代码模型「填充中间」的看家本领,让生成过程可以随时「暂停—写结尾—回头补中间—循环同步」,代码更规整、质量更高。
arXiv:2311.17972 · 2023年11月29日(v1) · 机构未标注
18
科研

函数约束的程序综合:限定函数集合 + 自动生成子函数,让 LLM 写出可用的程序

Function-constrained Program Synthesis
把大模型写代码约束在「你给的函数集合」里,写不出来就自动造新的子函数补充进函数库,直到写出能跑的代码——像带一个越用越熟练的程序员学徒。
arXiv:2311.15500 · 2023年11月27日(v1) · 机构未标注
19
科研

2LS:面向程序分析的验证工具

2LS for Program Analysis
把 C 程序的验证任务翻译成二阶逻辑公式,再用「展开 + 模板不变式综合 + 增量 SAT 求解」的组合算法求解——一台又快又灵活的程序分析引擎。
arXiv:2302.02380 · 2023年2月5日(v1) · 机构未标注
20
预测

评估从业者对软件缺陷预测的信念

Assessing Practitioner Beliefs about Software Defect Prediction
用数十个开源项目里 300,000+ 次真实代码变更,检验 10 条广为流传的缺陷预测「信仰」——只有 2 条被数据强支持,其余大多只有零散证据,而且会随版本出现又消失。
arXiv:1912.10093 · 2019年12月20日(v1) · 机构未标注
02

推荐阅读路线

Reading Path
TIER 01

入门

基础概念扫盲,零基础可读。先建立对本方向核心问题的直觉。

TIER 02

进阶

核心方法与代表性应用,配合专业基础与数学工具食用更佳。

TIER 03

硬核

前沿专题与工程细节,打好基础后再啃,收益最大。

03

两周听力计划

Two-Week Plan
🛡️

创作不易
禁止一切形式爬取

本站为公益学习平台,全部精读内容均由编者逐篇人工制作,倾注大量时间与心血。

本站内容受版权保护,未经许可不得批量抓取、转载或商用,违者必究。任何形式的自动化抓取、镜像复制与二次分发,均属侵权行为。

恳请尊重劳动成果,以直接访问的方式阅读与分享。