arxiv:2608.26623
Amit Kumar Saha
amitsaha
AI & ML interests
None yet
Recent Activity
authored a paper 17 days ago
AgentJudgeBench: A Multi-Difficulty Benchmark for Evaluating LLM Judges on Agentic Tool-Calling submitted a paper 17 days ago
AgentJudgeBench: A Multi-Difficulty Benchmark for Evaluating LLM Judges on Agentic Tool-Calling