vix.ing · top · new · best · stats · spec

Jialun Cao

  1. Enchanting Program Specification Synthesis by Large Language Models using Static Analysis and Program Verification
    2024/03/31 by Cheng Wen, Jialun Cao, Wen, Cheng +15 · 21 citations
    Computer Science · #Software Engineering Research #Software Testing and Debugging Techniques #Software System Performance and Reliability
  2. From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
    2025/01/27 by Jialun Cao, Yaojie Lu, Cao, Jialun +21 · 12 citations
    Computer Science · #Natural Language Processing Techniques
  3. ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation
    2024/12/24 by Mengyang Wu, Yuzhi Zhao, Wu, Mengyang +17 · 7 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #Digital Media Forensic Detection #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
  4. MR-Adopt: Automatic Deduction of Input Transformation Function for Metamorphic Testing
    2024/08/28 by Congying Xu, Songqiang Chen, Xu, Congying +11 · 6 citations
    Medicine · #Advanced MRI Techniques and Applications
  5. DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
    2024/08/23 by Qiming Zhu, Jialun Cao, Zhu, Qiming +11 · 3 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Model-Driven Software Engineering Techniques #Real-time simulation and control systems #Software Engineering (cs.SE) #Software Testing and Debugging Techniques
  6. Code Benchmarks Should Prioritize Rigor, Reliability, and Reproducibility
    2025/01/18 by Jialun Cao, Cao, Jialun, Zixuan Ling +24 · 4 citations
    Medicine · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #Computation and Language (cs.CL) #Computational and Text Analysis Methods #Ethics and Social Impacts of AI #FOS: Computer and information sciences #Software Engineering (cs.SE)
  7. NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition
    2025/07/24 by Le Deng, Deng, Le, Zhonghao Jiang +7 · 9 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning and Data Classification #Natural Language Processing Techniques #Software Engineering (cs.SE) #Topic Modeling
  8. FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
    2025/04/09 by Dekun Dai, Dai, Dekun, Mingwei Liu +13 · 2 citations
    Computer Science · #Software Engineering Research #Software Testing and Debugging Techniques #Software System Performance and Reliability
  9. Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval
    2025/02/26 by Jia‐Rong Wu, Songqiang Chen, Wu, Jiarong +7 · 3 citations
    Computer Science · Medicine · Social Sciences · #Topic Modeling #Artificial Intelligence in Healthcare and Education #Computational and Text Analysis Methods
  10. When LLMs Meet API Documentation: Can Retrieval Augmentation Aid Code Generation Just as It Helps Developers?
    2025/03/19 by Jingyi Chen, Songqiang Chen, Chen, Jingyi +7 · 2 citations
    Computer Science · #FOS: Computer and information sciences #Library Science and Information Systems #Mathematics, Computing, and Information Processing #Natural Language Processing Techniques #Software Engineering (cs.SE)
  11. Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports
    2026/07/17 by Jingyi Chen, Songqiang Chen, Hengcheng Zhu +3
    #cs.SE