Abstract is missing.
- A Hybrid LLM-Guided Approach to Code Migration Using API-Derived RulesGabriel Vitor Klaumann Gubert, Stefan Kugele, Munir Georges. 1-5 [doi]
- An Experience Report on LLM-Based Agentic Translation from Android to iOS: Pitfalls and InsightsZhili Zeng, Kimya Khakzad Shahandashti, Alvine Boaye Belle, Song Wang 0009, Zhen Ming (Jack) Jiang. 6-16 [doi]
- Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code GenerationLaboni Sarker, Mara Downing, Achintya Desai, Tevfik Bultan. 17-28 [doi]
- AutoReSpec: A Framework for Generating Specification using Large Language ModelsRagib Shahariar Ayon, Shibbir Ahmed. 29-39 [doi]
- Backporting in Robot Operating System: Identifying Commit Purpose and Propagation Need with Large Language ModelsPankaj Manoharlal Thakur, Kyle Thomson, Wesley Klewerton Guez Assunção, Bowen Xu. 40-50 [doi]
- Code for Machines, Not Just Humans: Quantifying AI-Friendliness with Code Health MetricsMarkus Borg, Nadim Hagatulah, Adam Tornhill, Emma Söderberg. 51-61 [doi]
- CodeViz: Collaborative Multi-Agent System for Analytical and Visualization Tasks in Data ScienceSai Sanjna Chintakunta, Nathalia Nascimento 0001, Everton Guimarães. 62-66 [doi]
- Deep Graph-Language Fusion for Structure-Aware Code GenerationMert Tiftikci, Amir Molzam Sharifloo, Mira Mezini. 67-71 [doi]
- Detecting and Correcting Hallucinations in LLM-Generated Code via Deterministic AST AnalysisDipin Khati, Daniel Rodríguez-Cárdenas, Paul Pantzer, Denys Poshyvanyk. 72-76 [doi]
- DynamicsLLM: a Dynamic Analysis-based Tool for Generating Intelligent Execution Traces Using LLMs to Detect Android Behavioural Code SmellsHoucine Abdelkader Cherief, Florent Avellaneda, Naouel Moha. 77-87 [doi]
- Execution-free Agentic Program Repair for Enterprise-Scale DevelopmentSaurabh Bodhe, Sanjukta De, Subhayan Roy, Jaydip Pokiya, Indira Vats, Sehajpreet Kaur, XueMeng Li, Lejin Varghese, Yonas Bedasso, Max Kiehn. 88-98 [doi]
- Exploring the Potential of Large Language Models in Simulink-Stateflow Mutant GenerationPablo Valle, Shaukat Ali 0001, Aitor Arrieta. 99-109 [doi]
- Finding Missing Input Validation in TEEs via LLM-Assisted Symbolic ExecutionChengyan Ma 0001, Jieke Shi, Ruidong Han, Ye Liu 0012, Yuqing Niu, David Lo 0001. 110-115 [doi]
- From Human to Machine Refactoring: Assessing GPT-4's Impact on Python Class Quality and ReadabilityAlessandro Midolo, Emiliano Tramontana, Massimiliano Di Penta. 116-127 [doi]
- Impacts of Generative AI on Agile Teams' Productivity: A Multi-Case Longitudinal StudyRafael Tomaz, Paloma Guenes, Allysson Allex Araújo, Maria Teresa Baldassarre, Marcos Kalinowski. 128-138 [doi]
- Jailbreaking Large Language Models via Multi-Task Embedding-based PromptSongrui Li, Hanmo You, Jiajun Jiang. 139-143 [doi]
- MalCVE: Malware Detection and CVE Association Using Large Language ModelsEduard Andrei Cristea, Petter Molnes, Jingyue Li. 144-154 [doi]
- PatchGPT: Multi-Agent Patch Backporting without Model Fine-TuningYe Liu 0012, Ruidong Han, Chengyan Ma 0001, Yuqing Niu, David Lo 0001. 155-159 [doi]
- PIChecker: Automatic Privacy Detector for Third Party Libraries in Android AppsKerui Huang, Xian Zhan, Xin Xia 0001. 160-171 [doi]
- Stalled, Biased, and Confused: Uncovering Reasoning Failures in LLMs for Cloud-Based Root Cause AnalysisEvelien Riddell, James Riddell, Gengyi Sun, Michal Antkiewicz, Krzysztof Czarnecki 0001. 172-183 [doi]
- Reporting LLM Prompting in Automated Software Engineering: A Guideline Based on Current Practices and ExpectationsAlexander Korn, Lea Zaruchas, Chetan Arora 0002, Andreas Metzger, Sven Smolka, Fanyu Wang, Andreas Vogelsang. 184-194 [doi]
- Visual Loop: Bridging the Cognitive Gap in Software Development Through Visual-AI CollaborationLuis Filipe Fernandes Gomes, Xin Zhou 0014, David Lo 0001, Rui Abreu 0001. 195-200 [doi]
- XMENTOR: A Rank-Aware Aggregation Approach for Human-Centered Explainable AI in Just-in-Time Software Defect PredictionSaumendu Roy, Banani Roy, Chanchal Roy, Richard Bassey. 201-212 [doi]
- COMPASS: A Psychometrics-Guided Multi-Dimensional Benchmark for Code Generation EvaluationJames Meaden, Markus Borg. 213-217 [doi]
- MiG.4: A Curated Dataset of Library Migrations in Java and PythonMatheus Barbosa, Pedro Baptista, João Eduardo Montandon. 218-222 [doi]
- MIRROR: A Dataset of Structural Metrics for Repackaged Android AppsSebastian Siedler, Karim Elish. 223-227 [doi]
- OmniBench-RAG: A Multi-Domain Evaluation Platform for Retrieval-Augmented Generation ToolsJiaxuan Liang, Shide Zhou, Kailong Wang 0001. 228-232 [doi]
- PromiseAwait: A Dataset of JavaScript Migrations from Promises to Async/AwaitRafael Araujo Magesty, João Eduardo A Montandon. 233-237 [doi]
- SEMODS: A Validated Dataset of Open-Source Software Engineering ModelsAlexandra González, Xavier Franch, Silverio Martínez-Fernández. 238-242 [doi]
- Towards Comprehensive Benchmarking Infrastructure for LLMs In Software EngineeringDaniel Rodríguez-Cárdenas, Xiaochang Li, Marcos Macedo, Antonio Mastropaolo, Dipin Khati, Yuan Tian, Huajie Shao, Denys Poshyvanyk. 243-248 [doi]
- Tricky²: Towards a Benchmark for Evaluating Human and LLM Error InteractionsCole Granger, Dipin Khati, Daniel Rodríguez-Cárdenas, Denys Poshyvanyk. 249-253 [doi]
- VHDL-Instruct: Training Open Dataset for LLMs Benchmarking and HDL Code GenerationPatrik Drazic, Benaoumeur Senouci, Boualem Benatallah. 254-258 [doi]