arxiv:2608.26623
Amit Kumar Saha
amitsaha
AI & ML interests
None yet
Recent Activity
authored a paper 7 days ago
AgentJudgeBench: A Multi-Difficulty Benchmark for Evaluating LLM Judges on Agentic Tool-Calling submitted a paper 7 days ago
AgentJudgeBench: A Multi-Difficulty Benchmark for Evaluating LLM Judges on Agentic Tool-Calling