{"as_of":"2026-08-12T21:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aedc8184fc0b53039c53f999eb28c22329e307e5bef8415640c27bc12a15d815","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T06:01:13.464975Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T14:04:55.047752Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:53:26.427900Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"cited_work":{"arxiv_id":"2412.17874","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.17874","snapshot_observed_at":"2026-06-29T12:53:26.427900Z","title":"Yu, Samarendra Chandan Bindu Dash, Rindranirina Ramamonjison, Jabo Serge Byusa, Giuseppe Carenini, Zirui Zhou, and Yong Zhang","venue":null,"work_id":"82be172f-f67f-4619-ba77-f6a5f595c2ee","year":2025},"citing_paper":{"arxiv_id":"2605.28158","last_updated":"2026-05-27T08:41:30Z","snapshot_observed_at":"2026-07-06T23:37:45.223562Z","submitted_at":"2026-05-27T08:41:30Z","title":"OR-Space: A Full-Lifecycle Workspace Benchmark for Industrial Optimization Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T12:52:20.911788Z"},"links":{"cited_paper":"/paper/2412.17874","citing_paper":"/paper/2605.28158"},"observation_digest":"sha256:e46b352b4a43203f4f6d8fb5ca934eb3a7e2a54d7faf56bf9cf602bb9c0b72c4","observation_id":"1bd31f04-0455-440b-8edd-2387edd8cb9a","resolution":{"observed_at":"2026-06-29T12:53:26.429358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17874","snapshot_observed_at":"2026-08-02T14:04:55.047752Z","title":"and Dash, Samarendra Chandan Bindu and Ramamonjison, Rindranirina and Byusa, Jabo Serge and Carenini, Giuseppe and Zhou, Zirui and Zhang, Yong , month = dec, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18256","last_updated":"2026-05-14T06:47:20Z","snapshot_observed_at":"2026-08-05T02:13:07.767245Z","submitted_at":"2026-05-14T06:47:20Z","title":"PEARL: Solver-in-the-Loop Interactive Optimization Modeling from Natural Language","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T14:04:55.047752Z"},"links":{"cited_paper":"/paper/2412.17874","citing_paper":"/paper/2607.18256"},"observation_digest":"sha256:f6b80ab50aa73b81f411c97b983f71b686c4a97fa8bd5bba93cafaab70360eb9","observation_id":"e5411e1e-52e1-4d6c-a80c-8aaaa983226d","resolution":{"observed_at":"2026-08-02T14:04:55.047752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.17874/citation-record","integrity":"/paper/2412.17874/integrity","json":"/paper/2412.17874/citation-record.json","paper":"/paper/2412.17874"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.245034Z","title":null,"venue":null,"work_id":"aaa8f39f-1dbd-4750-85da-940e1e6a68bb","year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.213502Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:78000e9135bf494286bcb8a6e5acb8fdce39d0c0836318a77c3b2d78d43d55ab","observation_id":"68d6994c-3dc5-4957-968c-396688aaeb8a","resolution":{"observed_at":"2026-08-11T06:01:14.249266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-11T06:01:13.219136Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.219136Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:1c8e44302913b66db6eca6c9337be755515a202d70dd7bdb8c4a871c1716d5f7","observation_id":"12f0f0e2-2d3a-407f-969d-8376ec9c58a1","resolution":{"observed_at":"2026-08-11T06:01:13.219136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01781","last_updated":"2024-07-03T11:20:43Z","snapshot_observed_at":"2026-08-12T14:13:22.687215Z","submitted_at":"2024-02-01T19:12:25Z","title":"When Benchmarks are Targets: Revealing the Sensitivity of Large Language Model Leaderboards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01781","snapshot_observed_at":"2026-08-11T06:01:13.224508Z","title":"A.; Alnumay, Y.; Alrashed, S.; Alsubaie, S.; Almushaykeh, Y.; Mirza, F.; Alotaibi, N.; Altwairesh, N.; Alowisheq, A.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.224508Z"},"links":{"cited_paper":"/paper/2402.01781","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:d567556b55df1928c3588e219d8e61c4e24badf689065f9a0ac502dc24b30d15","observation_id":"dc6b0e4d-8ae7-4e3b-b0c6-2ed46a0dbf33","resolution":{"observed_at":"2026-08-11T06:01:13.224508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03762","last_updated":"2023-08-10T14:24:37Z","snapshot_observed_at":"2026-08-05T14:37:13.469156Z","submitted_at":"2023-07-21T17:04:25Z","title":"GPT-4 Can't Reason","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03762","snapshot_observed_at":"2026-08-11T06:01:13.229345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.229345Z"},"links":{"cited_paper":"/paper/2308.03762","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:eb43626dbddf31710edc5002390c59ca301f0a7de3a91778c554c88cc47f8158","observation_id":"22f4c639-14a5-40f2-ac9a-b50adc2ac2c2","resolution":{"observed_at":"2026-08-11T06:01:13.229345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03195","last_updated":"2023-05-04T22:46:43Z","snapshot_observed_at":"2026-08-12T01:35:25.191628Z","submitted_at":"2023-05-04T22:46:43Z","title":"Gpt-4: A Review on Advancements and Opportunities in Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03195","snapshot_observed_at":"2026-08-11T06:01:13.234417Z","title":"A.; and Dawodi, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.234417Z"},"links":{"cited_paper":"/paper/2305.03195","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:8ecd21431ce37d05fb28b5a39dbc622b9105dc42b4011755baab5af1f0f3446f","observation_id":"445d8fbe-c42f-4526-a14a-cd79a4b33107","resolution":{"observed_at":"2026-08-11T06:01:13.234417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.239163Z","title":"W.; Hou, L.; Longpre, S.; Zoph, B.; Tay, Y.; Fedus, W.; Li, Y.; Wang, X.; Dehghani, M.; Brahma, S.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.239163Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:eef3b86e5c8ed50264a8473616d9fd489ddd56fda5fda75991a93791c410374f","observation_id":"8d10d948-8641-484e-9d54-a332e500303a","resolution":{"observed_at":"2026-08-11T06:01:13.239163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.220990Z","title":"H.; Choi, E.; Collins, M.; Garrette, D.; Kwiatkowski, T.; Nikolaev, V.; and Palomaki, J","venue":null,"work_id":"ba1bc834-784d-42aa-adfa-4eb9a3a52f9e","year":2020},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.244043Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:b1719ff56996df98bf591dbdd6661b0f7f6654ad726f9cdae8a0fe40a59e3bd3","observation_id":"2c6a37fd-fbfb-4db2-9ecc-5db8c75c4a51","resolution":{"observed_at":"2026-08-11T06:01:14.225689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.206722Z","title":null,"venue":null,"work_id":"d9fd31b0-76b9-4831-bdc7-67fab5672f75","year":2021},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.248227Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:6cb82907e064a4a480319033d16d415f2f3398bf720a8bc5983bddd892b86785","observation_id":"a632a6cd-fa12-471a-b467-fcec5e46d3f2","resolution":{"observed_at":"2026-08-11T06:01:14.211088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T06:01:13.252630Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.252630Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:8dbb081bc04600fda71ea929935fd3f620f6934b00eb6e2353aab75bfa2171b6","observation_id":"29851cbd-16e7-4c4a-8a40-82bae0bf2f07","resolution":{"observed_at":"2026-08-11T06:01:13.252630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.192799Z","title":"L.; Jiang, L.; Lin, B","venue":null,"work_id":"9c927328-aabc-4342-bf8b-b2345035a610","year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.261035Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:64afb73a703c77da0c1c4782afc38bd61fd7f61e01d15c00b2393a25c980561a","observation_id":"a54a65ce-f3ea-48d0-a5f4-99a9eadabeab","resolution":{"observed_at":"2026-08-11T06:01:14.196973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03244","last_updated":"2024-03-26T20:35:45Z","snapshot_observed_at":"2026-08-10T21:44:37.554218Z","submitted_at":"2024-01-06T15:55:14Z","title":"Artificial Intelligence for Operations Research: Revolutionizing the Operations Research Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03244","snapshot_observed_at":"2026-08-11T06:01:13.266814Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.266814Z"},"links":{"cited_paper":"/paper/2401.03244","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:d8a7b6414a6f73ae4f6e80e9f2e59f85326e0742b36fe91cd76254372a85d97f","observation_id":"f84d7a43-34f2-4587-bee8-14eea64c0160","resolution":{"observed_at":"2026-08-11T06:01:13.266814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-11T06:01:13.271099Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.271099Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:f218f4e4ceaeef2a997e76a001aa1b5a6cb297293e9ca156e63efa81a7ca8ed5","observation_id":"6322410d-4b80-4556-aa8e-730d1c9c4351","resolution":{"observed_at":"2026-08-11T06:01:13.271099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07919","last_updated":"2023-09-12T15:08:46Z","snapshot_observed_at":"2026-08-10T05:38:55.120527Z","submitted_at":"2022-12-15T15:52:39Z","title":"ROSCOE: A Suite of Metrics for Scoring Step-by-Step Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07919","snapshot_observed_at":"2026-08-11T06:01:13.275868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.275868Z"},"links":{"cited_paper":"/paper/2212.07919","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:fb2e7c2bbafd3036f8fbe2a40940150e26e098aad190f2ca699852ca8c8f4eb5","observation_id":"0a493bf4-5146-420c-91ff-d0e72e32099e","resolution":{"observed_at":"2026-08-11T06:01:13.275868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.179025Z","title":"S.; and Lieberman, G","venue":null,"work_id":"ad3234a1-cc8a-4ef8-aa99-f28b7da5210e","year":2015},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.280616Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:3323a056922e826ee134e413d377141d8fcab4982310daa3e2134066fb66cb0a","observation_id":"bc6ae4a2-945b-4b15-b85e-7614a78c1903","resolution":{"observed_at":"2026-08-11T06:01:14.183521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-11T06:01:13.285048Z","title":"Q.; Sablayrolles, A.; Mensch, A.; Bamford, C.; Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.285048Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:9c0b1f8647daaf530ede107411749a15d260970d28e0fe613dd2db8ed66f80e8","observation_id":"fd90435d-9fff-4f73-a00c-001554724563","resolution":{"observed_at":"2026-08-11T06:01:13.285048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T06:01:13.289632Z","title":"Q.; Sablayrolles, A.; Roux, A.; Mensch, A.; Savary, B.; Bamford, C.; Chaplot, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.289632Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:7764d61cf66f7414ddea246a0c153006d4403807acf4b706119d67ee58329b38","observation_id":"6ceb40ee-cf92-43d1-a83e-d2965699681b","resolution":{"observed_at":"2026-08-11T06:01:13.289632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.294120Z","title":"K.; Cappart, Q.; Rousseau, L.-M.; and Laurent, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.294120Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:6dd6e123e7a236e0cbb6fb2e679e58f6671fb3217c6bd864fd5961991b16b5ca","observation_id":"22ab3a8c-1f56-46d7-9c10-5991548ad834","resolution":{"observed_at":"2026-08-11T06:01:13.294120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.298871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.298871Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:c02b43a85fe6cbc83f6bfee6813e436768a29a13b510ffe4a3f6bf37782ac7bc","observation_id":"02e260e8-575c-4937-8bb4-51bdb5ccf500","resolution":{"observed_at":"2026-08-11T06:01:13.298871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07955","last_updated":"2024-08-15T02:18:08Z","snapshot_observed_at":"2026-08-10T01:18:53.696585Z","submitted_at":"2024-01-15T20:42:16Z","title":"A Study on Large Language Models' Limitations in Multiple-Choice Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07955","snapshot_observed_at":"2026-08-11T06:01:13.308137Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.308137Z"},"links":{"cited_paper":"/paper/2401.07955","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:463b77e060e0a374348be6fa08aa1d26f7174713088cd177cd063376632aabaa","observation_id":"9b97d735-46c1-4aed-a19a-68178faf30b0","resolution":{"observed_at":"2026-08-11T06:01:13.308137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.312704Z","title":"S.; Reid, M.; Matsuo, Y.; and Iwasawa, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.312704Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:604063be712e5875c2eaefbaceb878bbbb33dfd7798ee8e284e933e9f9a20957","observation_id":"f8f16f9f-9f07-423a-8cad-dc87cde89c62","resolution":{"observed_at":"2026-08-11T06:01:13.312704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16040","last_updated":"2024-11-11T10:40:50Z","snapshot_observed_at":"2026-07-06T17:35:06.195492Z","submitted_at":"2024-02-25T09:41:50Z","title":"EHRNoteQA: An LLM Benchmark for Real-World Clinical Practice Using Discharge Summaries","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16040","snapshot_observed_at":"2026-08-11T06:01:13.316678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.316678Z"},"links":{"cited_paper":"/paper/2402.16040","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:5d819d1e03889d010a5700536f1f26b711163e2f5f519b3d81999ee51eff1e3b","observation_id":"8d2d1c1e-d381-429d-8875-495f8f4069d2","resolution":{"observed_at":"2026-08-11T06:01:13.316678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14540","last_updated":"2023-05-23T21:50:06Z","snapshot_observed_at":"2026-07-06T15:32:06.975391Z","submitted_at":"2023-05-23T21:50:06Z","title":"LLMs as Factual Reasoners: Insights from Existing Benchmarks and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14540","snapshot_observed_at":"2026-08-11T06:01:13.320631Z","title":"R.; Xiong, C.; Joty, S.; and Wu, C.-S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.320631Z"},"links":{"cited_paper":"/paper/2305.14540","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:189e91173a91447afff3c621b26e1918e1d4dd1a59501cc7d9ec2689dffd7d1d","observation_id":"df5805a9-b5cd-4fc3-92bc-c560ea5a3497","resolution":{"observed_at":"2026-08-11T06:01:13.320631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-11T06:01:13.324531Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.324531Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:0d2ff7eba8caafead24ca265209f23703ff8d5bef0e6c40d7cc8a32f86bdd013","observation_id":"fa20c8d6-e5c0-4a8a-8c66-111d6d2a58ff","resolution":{"observed_at":"2026-08-11T06:01:13.324531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.136921Z","title":"E.; Motzfeldt, A","venue":null,"work_id":"64b3d8c7-9d58-40a2-860b-9ffdcf6b7356","year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.328477Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:a12218044142ab55e3225e252ec4ce72d02e4801c8443a007f38c7fbf37dca05","observation_id":"c38f5b1e-0639-411a-8d06-a7e29e619112","resolution":{"observed_at":"2026-08-11T06:01:14.140950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.123465Z","title":null,"venue":null,"work_id":"0944c0a3-9656-4222-bfe2-a28a128a6cdb","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.333600Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:32c9131d3f1f6fa32ddda08151234f6f7a6e2dc8afba6c25510cbe889ce92b6e","observation_id":"67538198-086c-4acd-b18e-595df23c8c51","resolution":{"observed_at":"2026-08-11T06:01:14.127909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.109044Z","title":null,"venue":null,"work_id":"76caa032-16d9-48db-a4f4-0ef478a3b8a4","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.338709Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:76a52265eb413bba465ee9067e9742094d901c93d2779b2841b344ed89a9f55f","observation_id":"879dc9c7-7fda-4a30-8318-e8c7f7d3a988","resolution":{"observed_at":"2026-08-11T06:01:14.113552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-11T06:01:13.343137Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.343137Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:42ff46d74248b8cfda7cefe26398e7a56e1602ead309643d6e9a685265f7b3a3","observation_id":"5aaa81e2-16f5-451b-ab2f-4d0067d0f0c0","resolution":{"observed_at":"2026-08-11T06:01:13.343137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.094100Z","title":"S.; and Tahmasbi, N","venue":null,"work_id":"391c9ff6-1461-4656-9f57-0f55c131f8c8","year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.347516Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:e2a96540fb5f0f40f02da31b0e23a15dd7b8f310e609f5805ec546ae104da7da","observation_id":"7d44e252-3626-4ea8-b077-37656a4cac12","resolution":{"observed_at":"2026-08-11T06:01:14.098629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.079645Z","title":"T.; Ramamonjison, R.; Carenini, G.; Zhou, Z.; and Zhang, Y","venue":null,"work_id":"9a596d70-e744-4724-b57d-8d6467a2bd34","year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.351578Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:bcdd42ca9505dcb2b6c8c21271f531470f367792cfe42096e062e9ca3741cab9","observation_id":"526960c3-40f1-48db-8458-ce8e01ee7723","resolution":{"observed_at":"2026-08-11T06:01:14.084444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.064541Z","title":"A.; Archetti, C.; Ayhan, H.; Battarra, M.; Bennell, J","venue":null,"work_id":"309a5c19-4636-4eda-be0d-1424c5944492","year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.355746Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:931cd6fe0578abd1e2327752341d40008bf132c25aec353291b9bccb72629db7","observation_id":"dfc987ae-847c-49c5-8dd6-83fc84fd472e","resolution":{"observed_at":"2026-08-11T06:01:14.069728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.049738Z","title":null,"venue":null,"work_id":"3ed6d8a1-2e7b-4c09-8ef8-97eda3073f89","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.359562Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:b6994a25cbdcbe28ab2499eb5d00405c46e0445bb8eda59420e158a981b2ed7a","observation_id":"9aef081e-5ccb-4448-bb56-7c90277285b1","resolution":{"observed_at":"2026-08-11T06:01:14.054526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.033858Z","title":null,"venue":null,"work_id":"ee4bd7ee-89c6-46ff-a998-c4e81f2a3b46","year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.364144Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:5037a64f4729e36cffa6f61d2d9f091c91cf46267624904a10ab4f3522f731f4","observation_id":"d6bf7693-3dab-40b2-b25e-4213fa80522c","resolution":{"observed_at":"2026-08-11T06:01:14.039284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.017346Z","title":null,"venue":null,"work_id":"f63b247e-216e-40b5-8f16-286f79fd1e80","year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.368764Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:f7e9cd3824a458ffb87d8912b1bf423d952221944d873a6c6efa9e0305f6d012","observation_id":"bb14e046-1d4d-426b-a103-e19b177cda99","resolution":{"observed_at":"2026-08-11T06:01:14.022198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06729","last_updated":"2023-02-13T22:34:02Z","snapshot_observed_at":"2026-08-12T10:17:03.173926Z","submitted_at":"2023-02-13T22:34:02Z","title":"STREET: A Multi-Task Structured Reasoning and Explanation Benchmark","version":1},"cited_work":{"arxiv_id":"2302.06729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.06729","snapshot_observed_at":"2026-08-11T06:01:13.608969Z","title":"STREET: A Multi-Task Structured Reasoning and Explanation Benchmark","venue":"cs.CL","work_id":"6e12248f-a093-4f75-b944-f6dc36da160b","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.372619Z"},"links":{"cited_paper":"/paper/2302.06729","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:32699ae53a1125874e56c2c1571c0d127e32353f141eab71299ae2a98a1bea7c","observation_id":"16508159-1e93-42b4-b3ac-5f4e58a7ecac","resolution":{"observed_at":"2026-08-11T06:01:13.616408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:14.003634Z","title":null,"venue":null,"work_id":"0988a4e4-896b-4d86-abdc-5edb5519ca80","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.376923Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:d0607c618cbc713c20200e0fb8c1a97e8df473145ff12a6bde8b1c7dda3bac85","observation_id":"f497bc25-89a4-4546-86bf-35861ca70fe7","resolution":{"observed_at":"2026-08-11T06:01:14.007827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.989566Z","title":null,"venue":null,"work_id":"988b0585-0ba8-4da5-a71f-d16b4b92d44b","year":2021},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.381085Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:40e8bbeaebad64e49e02b4b426ae17722d6f34798df72c515e20e8291dae91e5","observation_id":"0d2af395-c654-4ade-bf6c-c034c4342590","resolution":{"observed_at":"2026-08-11T06:01:13.993883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13692","last_updated":"2023-07-28T03:31:08Z","snapshot_observed_at":"2026-08-09T12:39:36.870016Z","submitted_at":"2023-07-25T17:55:19Z","title":"ARB: Advanced Reasoning Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13692","snapshot_observed_at":"2026-08-11T06:01:13.384978Z","title":"J.; Gupta, K.; and Komatsuzaki, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.384978Z"},"links":{"cited_paper":"/paper/2307.13692","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:c670db7169f0ecd4abdbc19cb93f6585fbc42a86f29edf16f86106804c9dabb1","observation_id":"bdd9c261-5c0f-47b3-9e8b-1f8b9dd6a8cd","resolution":{"observed_at":"2026-08-11T06:01:13.384978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.976294Z","title":null,"venue":null,"work_id":"1e4baf72-c616-4363-a718-626e3b96d965","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.389220Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:1fd69c578e3520f10896df9a2449bc1247a669b881ed3e71200128ad0789018d","observation_id":"e8281403-1f21-4c4b-9c86-3f9fc1a176a2","resolution":{"observed_at":"2026-08-11T06:01:13.980261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00937","last_updated":"2019-03-15T18:02:58Z","snapshot_observed_at":"2026-08-10T07:37:55.457401Z","submitted_at":"2018-11-02T15:34:29Z","title":"CommonsenseQA: A Question Answering Challenge Targeting Commonsense Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00937","snapshot_observed_at":"2026-08-11T06:01:13.393464Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.393464Z"},"links":{"cited_paper":"/paper/1811.00937","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:51ec7bf6ce60ec97d6fbecf485b9d7b6b189462c4ac360521c6d044e837053ff","observation_id":"8e6d57ac-5ea3-41b6-b2b0-3c2b8ff5ae7b","resolution":{"observed_at":"2026-08-11T06:01:13.393464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T06:01:13.398115Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.398115Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:792f898f82a44eacb011928bf68b4f6d7dbf72e70c07280b4f3f7bfd61e822a8","observation_id":"dbb1a25c-22e4-476f-ad6b-0be011c76fc7","resolution":{"observed_at":"2026-08-11T06:01:13.398115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.962638Z","title":"H.; Baldwin, T.; Verspoor, K.; and Cohn, T","venue":null,"work_id":"910c0b15-2c02-460e-964c-7b9a17f200e6","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.403477Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:2b8b069a545ded189ec5875825971cde722509750a5f30961188f4c0d96394b2","observation_id":"f0250fb9-a761-4cee-b6dc-563a20532bd4","resolution":{"observed_at":"2026-08-11T06:01:13.966992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10498","last_updated":"2023-11-26T01:15:41Z","snapshot_observed_at":"2026-07-06T13:23:11.566484Z","submitted_at":"2022-06-21T16:15:27Z","title":"PlanBench: An Extensible Benchmark for Evaluating Large Language Models on Planning and Reasoning about Change","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10498","snapshot_observed_at":"2026-08-11T06:01:13.407994Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.407994Z"},"links":{"cited_paper":"/paper/2206.10498","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:976ec35dd5bdc5e8746a6edf7573ee394c5a4a02db7dfc68a62d9fa24e3e9d69","observation_id":"fdac3854-9208-4f7e-b8a9-0ce2b26796fe","resolution":{"observed_at":"2026-08-11T06:01:13.407994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.412714Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.412714Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:d550d9d05109b6775a43c38cd9734e33eb916fbb34bbd982f5236fe79da5355b","observation_id":"a8462897-dfda-474e-ae4b-9c3520581c96","resolution":{"observed_at":"2026-08-11T06:01:13.412714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.938395Z","title":null,"venue":null,"work_id":"d84c5470-ba7c-4350-9385-fefb909c0d3a","year":2020},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.417335Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:e1ef009ee459b4821473c06510009eca2aefada3c5ab82dc8ef171dade142316","observation_id":"960a3e2a-c468-41eb-b4f4-2c22536c5e4f","resolution":{"observed_at":"2026-08-11T06:01:13.942681Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-11T06:01:13.422045Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.422045Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:68e757a7c4b76e9e05271d4b039c91be94b3773a2deba9c75b9507e2127c9d5e","observation_id":"e42cd0a4-f71f-42ed-aec8-ed3db2ce6619","resolution":{"observed_at":"2026-08-11T06:01:13.422045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.426697Z","title":"V.; Zhou, D.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.426697Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:d157bea45a4456a8ea0f07a7d1591734e8e6744b65eac658e894e4313562a5b1","observation_id":"af23395b-a856-40fa-a939-58714baa9e45","resolution":{"observed_at":"2026-08-11T06:01:13.426697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.914650Z","title":"J.; Han, X.; Fu, X.; Zhong, T.; Zeng, J.; Song, M.; et al","venue":null,"work_id":"6eaf6907-09ba-4998-8a94-f7f4bfd86b28","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.430657Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:54bf96bc0f9efecc3a39a92566c544edbd62a1a6e87cfd04f435c23c68482421","observation_id":"025e930c-52f9-484c-941a-0987afd78e79","resolution":{"observed_at":"2026-08-11T06:01:13.919078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.434581Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.434581Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:cb44221eb277aba2340e474005e9a8a16363b6efa5341a9e71e8c08fb4969adf","observation_id":"c60de498-ef34-4493-a227-76fdf4730b67","resolution":{"observed_at":"2026-08-11T06:01:13.434581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.438814Z","title":"R.; and Cao, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.438814Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:ed006bf46061b855a4394291c8bdb98315cfda78bbd1ff5cac5189385421c380","observation_id":"ebd57184-84af-43c4-b0db-b0b26e5327e8","resolution":{"observed_at":"2026-08-11T06:01:13.438814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.882739Z","title":null,"venue":null,"work_id":"6a5697a9-ab75-4768-bdde-2b66b381bbdb","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.442771Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:d8802bf03fc06a8aceef3f06e547f1a33e709be59941f70c263aa27b6b42418a","observation_id":"f59b197f-d882-4a78-bf39-e7ad611c1cd7","resolution":{"observed_at":"2026-08-11T06:01:13.886557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.868883Z","title":null,"venue":null,"work_id":"8ee0596e-901d-4dba-9157-393c00e09388","year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.446897Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:1d48b0784f4bfb958502651f25289548634a4ed78b5d414a66fa7800f893f8a6","observation_id":"69e2fd78-8702-4995-b7b9-e355741499c9","resolution":{"observed_at":"2026-08-11T06:01:13.873261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05112","last_updated":"2024-07-22T12:16:30Z","snapshot_observed_at":"2026-08-10T05:47:39.262556Z","submitted_at":"2023-11-09T02:55:58Z","title":"A Survey of Large Language Models in Medicine: Progress, Application, and Challenge","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05112","snapshot_observed_at":"2026-08-11T06:01:13.450801Z","title":"S.; Zhou, P.; Liu, J.; Hua, Y.; Mao, C.; Wu, X.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.450801Z"},"links":{"cited_paper":"/paper/2311.05112","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:2cfd965c84bde558e9828ee0ba4a95e85b4e96c3fca8212433c743331ec85e2d","observation_id":"58e7c573-3579-4e93-b162-8016e5747c45","resolution":{"observed_at":"2026-08-11T06:01:13.450801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03620","last_updated":"2024-02-06T01:13:53Z","snapshot_observed_at":"2026-08-10T20:43:15.965276Z","submitted_at":"2024-02-06T01:13:53Z","title":"Self-Discover: Large Language Models Self-Compose Reasoning Structures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03620","snapshot_observed_at":"2026-08-11T06:01:13.455187Z","title":"V.; Chi, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.455187Z"},"links":{"cited_paper":"/paper/2402.03620","citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:70993adb80e29848c9234357a9cebec6087bee7667e26a7ef66a79dc330a7987","observation_id":"0464d609-0546-4789-bff1-a2d653934511","resolution":{"observed_at":"2026-08-11T06:01:13.455187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.459761Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.459761Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:109f1770d7e3b05b1a3092fc966a6047b771e1eff417e621fa0c392b35b6679f","observation_id":"a3653acd-2a51-433b-9a5e-c1df42a0fb71","resolution":{"observed_at":"2026-08-11T06:01:13.459761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:01:13.464975Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T06:01:13.464975Z"},"links":{"citing_paper":"/paper/2412.17874"},"observation_digest":"sha256:32b1817108bc5feda7e77b2a974102de523858d58404b0f4f250079f718876ca","observation_id":"1025bf59-9919-42cc-b7ea-322f029ad3b4","resolution":{"observed_at":"2026-08-11T06:01:13.464975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.17874","last_updated":"2025-02-09T16:39:50Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T05:55:50.065952Z","submitted_at":"2024-12-22T09:10:34Z","title":"Evaluating LLM Reasoning in the Operations Research Domain with ORQA"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 2 inbound Pith citation observations for arXiv:2412.17874."}