
If you write servers or tools, this is a checklist for exposing the state an agent needs to recover: execution lifecycle, explicit external-effect semantics, machine-readable results, postcondition verification.
articleThe Devil Is in the Interface: Evaluating How Tool Architecture Shapes Coding Agent BehaviorXiangzhe Xu, Hamidreza Saghir, Qianhui Wu, Marc-Alexandre C\^ot\'e, Tong Wang, Kiran Lakkaraju, Kexin Pei, Xiangyu Zhang
articlePosition: Multi-Agent Systems Should Prioritize Concurrency ControlXin Yang, Letian Li, Zimo Ji, Terry Jingchen Zhang, Wenyuan Jiang
articleToolRobustBench: Stage-Wise Perturbation Evaluation and Failure Diagnosis for Tool-Calling AgentsYiShan Zheng, Yuan Wu, Yi ChangChecking sign-in…
Loading comments…