All research

Large Language Models · Operations Research

Peer Reviewed2025

Evaluating LLM Reasoning in the Operations Research Domain with ORQA

Research introducing ORQA, an Operations Research Question Answering benchmark designed to evaluate the ability of large language models to reason through complex operations-research and mathematical-optimization problems.

Status

Peer Reviewed

Year

2025

Dataset

Publication

AAAI Conference on Artificial Intelligence (AAAI-25)

Research methods

LLM EvaluationOperations ResearchReasoningBenchmarkingOptimization

Publications & resources

I2Prod Research

Explore the rest of our research.

All research