
It puts measurement behind a widely repeated folk belief about prompt framing, scoring persuasion-style templates on real coding benchmarks across correctness, maintainability and security.
articleBeyond Prompt Engineering: A Systematic Analysis of Prompt Lexical Sensitivity and Its Impacts on QualityQipeng Xie, Zi Liang, Jiafei Wu, Yufei Chen, Weizheng Wang, Wenao Ma, Zhong Ming, Haiqin Yang, Kaishun Wu
articleBeyond the Traceback: Using LLMs for Adaptive Explanations of Programming ErrorsAlexandru-Radu Moraru, Shreyan Biswas, Ujwal Gadiraju
articleCode Health in LLM-Based Test Generation: Effectiveness and Token EfficiencyFreya Wirdemann, Markus Borg, Nadim Hagatulah, Adam TornhillChecking sign-in…
Loading comments…