
Shows measurable gaps between -inferred network protocol state machines and hand-built ground truth across 16 protocols, a concrete caution before relying on LLMs to auto-generate models for security testing or fuzzing harnesses.
articlePerfReasoning: How Well Do LLMs Reason on Hardware Performance?Dan Zhao, Karthikeyan Sankaralingam, Christos Kozyrakis, Qijing Huang
articleLarge Language Models and Language Server Protocol: a match made in contextAlessandro Schena, Ilgiz Mustafin, Julia Kotovich
articleDo LLMs Make More Mistakes If They Do Not Believe the Input Data?Peter Kochelka, Ale\v{s} Manuel Pap\'a\v{c}ek, Vojt\v{e}ch Dvo\v{r}\'ak, Ond\v{r}ej Du\v{s}ekChecking sign-in…
Loading comments…