vix.ing · top · new · best · stats · spec

Cao, Jialun

  1. Enchanting Program Specification Synthesis by Large Language Models using Static Analysis and Program Verification
    2024/03/31 by Cheng Wen, Wen, Cheng, Jialun Cao +15 · 21 citations
    Computer Science · #Software Engineering Research #Software Testing and Debugging Techniques #Software System Performance and Reliability
  2. From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
    2025/01/27 by Jialun Cao, Yaojie Lu, Cao, Jialun +21 · 12 citations
    Computer Science · #Natural Language Processing Techniques
  3. CRUXEval-X: A Benchmark for Multilingual Code Reasoning, Understanding and Execution
    2024/08/23 by Xu, Ruiyang, Cao, Jialun, Lu, Yaojie +6 · 7 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
  4. A study on Prompt Design, Advantages and Limitations of ChatGPT for Deep Learning Program Repair
    2023/04/17 by Cao, Jialun, Li, Meiziniu, Wen, Ming +1 · 3 citations
    #FOS: Computer and information sciences #Software Engineering (cs.SE)
  5. ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation
    2024/12/24 by Mengyang Wu, Yuzhi Zhao, Wu, Mengyang +17 · 7 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #Digital Media Forensic Detection #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
  6. MR-Adopt: Automatic Deduction of Input Transformation Function for Metamorphic Testing
    2024/08/28 by Congying Xu, Songqiang Chen, Xu, Congying +11 · 6 citations
    Medicine · #Advanced MRI Techniques and Applications
  7. DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
    2024/08/23 by Qiming Zhu, Jialun Cao, Zhu, Qiming +11 · 4 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Model-Driven Software Engineering Techniques #Real-time simulation and control systems #Software Engineering (cs.SE) #Software Testing and Debugging Techniques
  8. JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
    2024/06/10 by Cao, Jialun, Chen, Zhiyong, Wu, Jiarong +2 · 3 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Programming Languages (cs.PL) #Software Engineering (cs.SE)
  9. Code Benchmarks Should Prioritize Rigor, Reliability, and Reproducibility
    2025/01/18 by Jialun Cao, Cao, Jialun, Zixuan Ling +24 · 4 citations
    Medicine · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #Computation and Language (cs.CL) #Computational and Text Analysis Methods #Ethics and Social Impacts of AI #FOS: Computer and information sciences #Software Engineering (cs.SE)
  10. NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition
    2025/07/24 by Le Deng, Deng, Le, Zhonghao Jiang +7 · 9 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning and Data Classification #Natural Language Processing Techniques #Software Engineering (cs.SE) #Topic Modeling
  11. FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
    2025/04/09 by Dekun Dai, Mingwei Liu, Dai, Dekun +13 · 2 citations
    Computer Science · #Software Engineering Research #Software Testing and Debugging Techniques #Software System Performance and Reliability
  12. Logarithmic regret in the ergodic Avellaneda-Stoikov market making model
    2024/09/03 by Cao, Jialun, Šiška, David, Szpruch, Lukasz +1 · 1 citation
    #91G80 #93C41 #93E20 #FOS: Economics and business #FOS: Mathematics #Optimization and Control (math.OC) #Primary 93E35 #Secondary 93C40 #Trading and Market Microstructure (q-fin.TR)
  13. Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval
    2025/02/26 by Jia‐Rong Wu, Wu, Jiarong, Songqiang Chen +7 · 3 citations
    Computer Science · Medicine · Social Sciences · #Topic Modeling #Artificial Intelligence in Healthcare and Education #Computational and Text Analysis Methods
  14. When LLMs Meet API Documentation: Can Retrieval Augmentation Aid Code Generation Just as It Helps Developers?
    2025/03/19 by Jingyi Chen, Songqiang Chen, Chen, Jingyi +7 · 2 citations
    Computer Science · #FOS: Computer and information sciences #Library Science and Information Systems #Mathematics, Computing, and Information Processing #Natural Language Processing Techniques #Software Engineering (cs.SE)
  15. Across Programming Language Silos: A Study on Cross-Lingual Retrieval-augmented Code Generation
    2025/06/04 by Zhu, Qiming, Cao, Jialun, Chen, Xuanang +5 · 2 citations
    #FOS: Computer and information sciences #Software Engineering (cs.SE)
  16. Vulnerability-Affected Versions Identification: How Far Are We?
    2025/09/04 by Chen, Xingchu, Liu, Chengwei, Cao, Jialun +6 · 1 citation
    #FOS: Computer and information sciences #Software Engineering (cs.SE)