Jialun Cao
- Enchanting Program Specification Synthesis by Large Language Models using Static Analysis and Program Verification
2024/03/31 by Cheng Wen, Jialun Cao, Wen, Cheng +15 · 21 citations
Computer Science · #Software Engineering Research #Software Testing and Debugging Techniques #Software System Performance and Reliability
- From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
2025/01/27 by Jialun Cao, Yaojie Lu, Cao, Jialun +21 · 12 citations
Computer Science · #Natural Language Processing Techniques
- ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation
2024/12/24 by Mengyang Wu, Yuzhi Zhao, Wu, Mengyang +17 · 7 citations
Computer Science · #Adversarial Robustness in Machine Learning #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #Digital Media Forensic Detection #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
- MR-Adopt: Automatic Deduction of Input Transformation Function for Metamorphic Testing
2024/08/28 by Congying Xu, Songqiang Chen, Xu, Congying +11 · 6 citations
Medicine · #Advanced MRI Techniques and Applications
- DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
2024/08/23 by Qiming Zhu, Jialun Cao, Zhu, Qiming +11 · 3 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Model-Driven Software Engineering Techniques #Real-time simulation and control systems #Software Engineering (cs.SE) #Software Testing and Debugging Techniques
- Code Benchmarks Should Prioritize Rigor, Reliability, and Reproducibility
2025/01/18 by Jialun Cao, Cao, Jialun, Zixuan Ling +24 · 4 citations
Medicine · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #Computation and Language (cs.CL) #Computational and Text Analysis Methods #Ethics and Social Impacts of AI #FOS: Computer and information sciences #Software Engineering (cs.SE)
- NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition
2025/07/24 by Le Deng, Deng, Le, Zhonghao Jiang +7 · 9 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning and Data Classification #Natural Language Processing Techniques #Software Engineering (cs.SE) #Topic Modeling
- FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
2025/04/09 by Dekun Dai, Dai, Dekun, Mingwei Liu +13 · 2 citations
Computer Science · #Software Engineering Research #Software Testing and Debugging Techniques #Software System Performance and Reliability
- Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval
2025/02/26 by Jia‐Rong Wu, Songqiang Chen, Wu, Jiarong +7 · 3 citations
Computer Science · Medicine · Social Sciences · #Topic Modeling #Artificial Intelligence in Healthcare and Education #Computational and Text Analysis Methods
- When LLMs Meet API Documentation: Can Retrieval Augmentation Aid Code Generation Just as It Helps Developers?
2025/03/19 by Jingyi Chen, Songqiang Chen, Chen, Jingyi +7 · 2 citations
Computer Science · #FOS: Computer and information sciences #Library Science and Information Systems #Mathematics, Computing, and Information Processing #Natural Language Processing Techniques #Software Engineering (cs.SE)
- Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports
2026/07/17 by Jingyi Chen, Songqiang Chen, Hengcheng Zhu +3
#cs.SE