{"as_of":"2026-08-08T17:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7689e87467cab6c8aff728540d37441da9974b60cf399d0482270cee12929b03","coverage":[{"denominator":238,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:41:20.255874Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:34:30.627327Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:34:32.141658Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"cited_work":{"arxiv_id":"2505.14279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14279","snapshot_observed_at":"2026-08-06T17:34:32.141658Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","venue":"cs.CL","work_id":"00a228a1-1527-40d9-b9b7-03e9727e1e75","year":2025},"citing_paper":{"arxiv_id":"2507.10522","last_updated":"2025-07-14T17:47:28Z","snapshot_observed_at":"2026-08-08T07:16:35.931563Z","submitted_at":"2025-07-14T17:47:28Z","title":"DeepResearch$^{\\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:30.627327Z"},"links":{"cited_paper":"/paper/2505.14279","citing_paper":"/paper/2507.10522"},"observation_digest":"sha256:45d0dffd4b9f64eba8399bc66c1e920f0c7bb442ccee1198dae890ea792da4b3","observation_id":"0690fa75-c482-4f54-bdd8-f3da76d3f084","resolution":{"observed_at":"2026-08-06T17:34:32.261596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14279/citation-record","integrity":"/paper/2505.14279/integrity","json":"/paper/2505.14279/citation-record.json","paper":"/paper/2505.14279"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.461105Z","title":"These alterations mimic realistic errors that may go unnoticed in automated evaluations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.461105Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b42eb1f50826ad51947f3c0b4037df634fd61074c827e9f63e5137234d8a74cd","observation_id":"332db1ee-8ec1-4b4d-8680-abccee039192","resolution":{"observed_at":"2026-08-07T15:41:10.461105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.538531Z","title":"Research Fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.538531Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:452d206adc020e6d51f73749b29c21141f052be4a4139d4653f4f2478800f685","observation_id":"c476f6f5-eecd-40bd-b37c-2af7fed5286d","resolution":{"observed_at":"2026-08-07T15:41:10.538531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.744690Z","title":"– Extreme: Remove the last sentence and append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.744690Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1d152666ee975fd4aa1f9ad8076900d2fce72ed80d6679e5d0d6274fc8797f4b","observation_id":"c951a1e4-507f-4bd5-b798-cce091f3c167","resolution":{"observed_at":"2026-08-07T15:41:10.744690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:09.754564Z","title":"In Proceed- ings of the 17th Conference of the European Chap- ter of the Association for Computational Linguistics, pages 1650–1669","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:09.754564Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5000cef5c5f7d2a98fc684e742ed9491d6ac842c7b85292e51fe43f9fa78780d","observation_id":"19bbbb97-d433-4a37-aed4-98bf0079a921","resolution":{"observed_at":"2026-08-07T15:41:09.754564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.966575Z","title":"however\",","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.966575Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:fc1bd0fe10b106cda917d4464f0c1f8df1fb6e75242d48d846d6b91ae337b056","observation_id":"1bbabe68-e7bc-463b-8022-73abafb38293","resolution":{"observed_at":"2026-08-07T15:41:10.966575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:09.894540Z","title":"In Proceedings of the 37th International Conference on Neural In- formation Processing Systems, NIPS ’23, Red Hook, NY , USA","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:09.894540Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:0e0c8b7c1b7287c00b896148f4fa6611c94d82e3be27c0026e8580554e9c3903","observation_id":"77c3fbbe-5983-4c93-85bb-3decec7f7e32","resolution":{"observed_at":"2026-08-07T15:41:09.894540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.184552Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.184552Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:25b432d703b246d855e2acbb3d99027cd5f8e5838e6838b19cbbe8bf2e5fd629","observation_id":"9b1daebd-176d-4249-be25-8e39037f00a3","resolution":{"observed_at":"2026-08-07T15:41:11.184552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T15:41:10.083275Z","title":"In Proceedings of the 57th annual meeting of the as- sociation for computational linguistics, pages 1085– 1097","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.083275Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:15073f4eb6767676275a4d4a6e754ef066a7c942d06249414126747fd3817019","observation_id":"eadb2dc3-3f6b-4111-aebb-d8057d1f20cb","resolution":{"observed_at":"2026-08-07T15:41:10.083275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.151604Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.151604Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:17692eca98eab1a16f1a993a543610d227fd1d86206f451497438f5cee391740","observation_id":"2ad93087-4824-4673-b8c6-cbd719ac74f4","resolution":{"observed_at":"2026-08-07T15:41:10.151604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.631398Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.631398Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1147a61c69b28dfb0688713a2c6d9c396891cf1fcb67384042122807397d68c2","observation_id":"b6b401c2-0b35-4fab-9ebe-3ce9d7ef62d5","resolution":{"observed_at":"2026-08-07T15:41:10.631398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.740191Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.740191Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8c05e6187de32c51ffea6a28e06c5c90c7c6aacc93841d4e0ca34060a9decf93","observation_id":"dfa3daa8-5e1c-4479-8894-c7825b3f8fbb","resolution":{"observed_at":"2026-08-07T15:41:10.740191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.818806Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.818806Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:55717f8fd6e852f959c82d3be448c0c920a2e89b9fd26530884e0c43dbc7d619","observation_id":"3832d8b2-eeb2-46e3-be72-f9a4c64cdc50","resolution":{"observed_at":"2026-08-07T15:41:10.818806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.091813Z","title":"– Extreme: Randomly shuffle all sen- tences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.091813Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:be0adce1a80a193f660fb8010bbf744555bb9b565c71ef18b68442a5d5efdcba","observation_id":"4d0c629f-b0f7-4893-8ce9-5dad464fef38","resolution":{"observed_at":"2026-08-07T15:41:11.091813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.296245Z","title":"– Extreme: Append a sentence from an informal tweet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.296245Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:dee447f3c2d91b0fd197123e3e269f818f7b8d6e0bee78c8903eea7ac7a9a25e","observation_id":"2b81a11e-a3c1-4ff3-91b6-e7b65f4db880","resolution":{"observed_at":"2026-08-07T15:41:11.296245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.420784Z","title":"Here is a redundant sentence","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.420784Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e68594d8a14cca6b389c4d9163881555827367d802131404010fc0b8cc34e22c","observation_id":"349c8d91-a13c-4ff1-8deb-0e6a0a268849","resolution":{"observed_at":"2026-08-07T15:41:11.420784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.755052Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.755052Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:82b4c9701964b646cd9712992ec7723f4d8cbedf0080810b41469c73f0c3b455","observation_id":"e7841a81-9923-4ace-8848-2ac8c47d2f98","resolution":{"observed_at":"2026-08-07T15:41:11.755052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.888088Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.888088Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1f82ec56f2803bedef647fd1fb82ac2edd8e9a151184e295acf0803d301aa597","observation_id":"93e5ce2e-c1aa-401e-89fa-eadc8f000322","resolution":{"observed_at":"2026-08-07T15:41:11.888088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.021779Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.021779Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4cbe474131474d1e0888e5b9053a5a18965f2e48a027acb6a5aa1a923866a958","observation_id":"03060775-15d2-43f0-a93c-a9e8b6777949","resolution":{"observed_at":"2026-08-07T15:41:12.021779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.178157Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.178157Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4de003697db52caa8130793190902f82585f8a6ffe636273075c00e034757b7e","observation_id":"dc522936-bc27-4fa1-892a-4a86b467f870","resolution":{"observed_at":"2026-08-07T15:41:12.178157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.299079Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.299079Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8d222ff4be42754241bce608b2b7eb10991ef0fdc3ee44cee134b88266ec06ed","observation_id":"0d06994a-2e31-4301-87f9-4aaa81f94e9a","resolution":{"observed_at":"2026-08-07T15:41:12.299079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.423322Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.423322Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:97ac97f268f36f325ed78b99116d3c6239c763118c9c0d5bfb020331a8257fee","observation_id":"24ac681e-529e-481e-83d3-69a0e22e1ee0","resolution":{"observed_at":"2026-08-07T15:41:12.423322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.577790Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.577790Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:01e23953915c41d2c6359d5dc9b95e1c987efe4fc87f487ffb91bf300b56ef16","observation_id":"24983167-4c8c-4976-9b9b-c42006c378e4","resolution":{"observed_at":"2026-08-07T15:41:12.577790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.738275Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.738275Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:82e0006864caca708255ae07fac633184a662fa4c93ef733f0385ac378dbdccb","observation_id":"e6f0551c-10a3-4c44-8090-f129b8046044","resolution":{"observed_at":"2026-08-07T15:41:12.738275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.878609Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.878609Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:9ec12c1fa15fb1add54977592f0d5cabe49bb54c8abd45ba8a2378af6f50eca8","observation_id":"cbfd7d27-8cd5-4133-88c1-cc40319c3924","resolution":{"observed_at":"2026-08-07T15:41:12.878609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.001717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.001717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1c5ef84f38b9f2b7774a3c5f7dcb9e25f8d08a887b716d6abdc61c1333420576","observation_id":"eae91843-3197-49e9-87be-ce417d0ddd4e","resolution":{"observed_at":"2026-08-07T15:41:13.001717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.186067Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.186067Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:baa399b0540ec7be95fefae89811704e9d24eb7fea417d0ad13e2ad56ed5bdd9","observation_id":"141e0aaa-589e-4e9f-b890-1fb571feb832","resolution":{"observed_at":"2026-08-07T15:41:13.186067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.408717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.408717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1f96c895036569a87630f8f6746ea388a0428d1fefb9fae16bb1e58cef25ef44","observation_id":"61b1a62f-3cc3-42cd-a9de-86eede92825c","resolution":{"observed_at":"2026-08-07T15:41:13.408717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.469859Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.469859Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2e400c730060fce59ad9c345f3c4982a76b163f6719e3a314a3f63c478e6b7cf","observation_id":"4924f260-032a-498d-9977-6f6c8c889ee6","resolution":{"observed_at":"2026-08-07T15:41:13.469859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.522414Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.522414Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:23e368108a0adb27097df414972512705eedb06504b3c2f036314541749562bb","observation_id":"072a86f1-6b48-405b-bf47-915b71f00812","resolution":{"observed_at":"2026-08-07T15:41:13.522414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.605269Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.605269Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:6c3ed02d62b509642fa59855e84ae3a8c49de42937cc122f458521651d6831e5","observation_id":"14b7a219-4dbc-436f-be41-258ac53c9a63","resolution":{"observed_at":"2026-08-07T15:41:13.605269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.693885Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.693885Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:493daa4f8f182dfe15426e78e74df068f84c2e76a1a689228f2eaf6641345b3c","observation_id":"f9c92743-af67-43fe-8248-ed803de14676","resolution":{"observed_at":"2026-08-07T15:41:13.693885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.783338Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.783338Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c4587e95839f907f1091ecfcf7e12e641c1595ff6107a67667d969f05f134e59","observation_id":"19dbaf49-1e67-4afc-87c0-b5c48d28505d","resolution":{"observed_at":"2026-08-07T15:41:13.783338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.870856Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.870856Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:a93e98c0920aea35edd6ef31fe2ae1269b3b162e69df42500a6f3a13dbb68c3c","observation_id":"f38f2272-fbf7-4299-a418-a16c18d8e1c3","resolution":{"observed_at":"2026-08-07T15:41:13.870856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.952513Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.952513Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e88955db4f38fc6ced00d7797423b03282a9a67f8d858d5accf64cb73500d2bb","observation_id":"1d561a44-f96f-48c3-abb4-b9c66c4683c2","resolution":{"observed_at":"2026-08-07T15:41:13.952513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.005247Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.005247Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8d08a240232ca23df258e2b187aff4af6c80266dcfc593b34eb95dca73172ae7","observation_id":"62e53074-b425-4c19-830c-714f794baf15","resolution":{"observed_at":"2026-08-07T15:41:14.005247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.091717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.091717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:66b07fc035d1bc6d9987a816fd7a83297e2899ee55f1036be90cd9b3974f950c","observation_id":"5d59f393-4954-4855-a4e9-126c4bf85048","resolution":{"observed_at":"2026-08-07T15:41:14.091717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.177795Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.177795Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8a913e1f3fdc73d81e25682f368768e226ca0afbc46241c5330e031975b5e86c","observation_id":"b5ff1d6b-f9ad-492b-a2b5-d3dc6c0f570f","resolution":{"observed_at":"2026-08-07T15:41:14.177795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.253619Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.253619Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e87903b3cd33207ec2053a7dd5dd973d11bcf8e0208bb4ea27a09fabffe41734","observation_id":"709f17ba-df42-4e6b-91af-c18d1b79f5e5","resolution":{"observed_at":"2026-08-07T15:41:14.253619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.343375Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.343375Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5a3058f8905f74789e908b6f5f47acf0a7f185a5e1e4cd89f68e4077486de312","observation_id":"1c9e7b2a-4cc7-44d1-a76a-2ced9a60bb93","resolution":{"observed_at":"2026-08-07T15:41:14.343375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.429262Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.429262Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c90518bbeea16a2b48fea55de2e7f174a78576dd56fcae53d029d2d06c80b498","observation_id":"a28e7146-79a1-4253-8509-d95a213d2e9b","resolution":{"observed_at":"2026-08-07T15:41:14.429262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.512730Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.512730Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d7a47dafa652ccd994f24a84fbc74a6225d81834d9f82de597f7e0acf2995dbc","observation_id":"1be723e3-cd3e-4338-8c2d-35a26eec5672","resolution":{"observed_at":"2026-08-07T15:41:14.512730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.624422Z","title":"Set Rubrics M1 M2 M3 M4 M5 M6 M7 benign","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.624422Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c7ac49abbe0df0cadfe4ff1adb5859d469141a83fcd1ba11b123a643b6a3aea8","observation_id":"495b3c65-6f0e-4b6f-836e-c94fd86ba210","resolution":{"observed_at":"2026-08-07T15:41:14.624422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.701821Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.701821Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:279795a1cf0a14d363b2533c7823604f170f2eec4a1085f31b61a730869ea5e9","observation_id":"be10b81f-71ab-4d55-aa0d-edb2dae74731","resolution":{"observed_at":"2026-08-07T15:41:14.701821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.841596Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.841596Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:60df980dba2f464cf8c8be3ab2bf5ed533398fb2b954acdaefbafdecbdefb7e3","observation_id":"c2f8103c-c23b-4a18-8f72-7565ac5aef6f","resolution":{"observed_at":"2026-08-07T15:41:14.841596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.923073Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.923073Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:601ce06a2bd3b94e0b4c955cded97d958fc577dfe5846e04573b3eccbb0343f4","observation_id":"62cb296e-7ff1-49ce-ac9b-6621ecfedc91","resolution":{"observed_at":"2026-08-07T15:41:14.923073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.009164Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.009164Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:324bddc7321dc0393db6ab0fa9f4d7f8437c2df4706e3ed31d3d77a32cf460e4","observation_id":"4ef53334-da63-4ca5-897a-4fdf20851e9e","resolution":{"observed_at":"2026-08-07T15:41:15.009164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.102676Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.102676Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c9cb67833fd56332f9c19b9d6c2034361d6b8d5a185876540acdee507e272458","observation_id":"fe6646ac-99b0-47ba-8c72-c28837d0dcd0","resolution":{"observed_at":"2026-08-07T15:41:15.102676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.223363Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.223363Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:fa57d05ee1be3bf2b9addd4f6c3edfda568c525c8dcbd3a4d15ec4cbf82e3999","observation_id":"2b9b0988-c325-417c-b279-2d81a2c42cbd","resolution":{"observed_at":"2026-08-07T15:41:15.223363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.309780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.309780Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:82bb4554e2b567303b0870fdb38e25df733a96e0a2fdde5c95f78bce430ae880","observation_id":"bd54827e-c525-4ad3-8d59-5061527d4f91","resolution":{"observed_at":"2026-08-07T15:41:15.309780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.459548Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.459548Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4c2111ee320c0612ff5869772f78b3f706de92008884bd096336a392db36c7da","observation_id":"9d55030d-a9d6-4306-8df7-52b7dbb228c8","resolution":{"observed_at":"2026-08-07T15:41:15.459548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.537273Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.537273Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:758cc038e09d6b4968340680b5e040b4d88657c7d09a40b8c435757499d47a5f","observation_id":"6282475d-1f54-4d68-80b5-359a7aaf751d","resolution":{"observed_at":"2026-08-07T15:41:15.537273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.639095Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.639095Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c847b6fcaf22ee4ca97bcde9356db65c688086340b47560a7cd3be5f800e3d89","observation_id":"1c593693-4299-4e78-adcb-c7d644e8d6fd","resolution":{"observed_at":"2026-08-07T15:41:15.639095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.729156Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.729156Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:7515d95fb3386ba9b0a337495971becf71c771faa87472900910deabe8500f04","observation_id":"1e72812b-34fc-42fb-9778-b05f933937f6","resolution":{"observed_at":"2026-08-07T15:41:15.729156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.811587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.811587Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f0f57b6f3222857fa9c0e072d6c3ff7fea93c3323ace735ef78b9e7543399b32","observation_id":"81f6db67-d2c2-4fae-9d8c-a951f09d7379","resolution":{"observed_at":"2026-08-07T15:41:15.811587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.915830Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.915830Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:37137d011ee21e920c3462574aebed61bc5dc621b278d04b386781535b28e076","observation_id":"306d5c56-9f6b-4933-821f-1330d75ebf7b","resolution":{"observed_at":"2026-08-07T15:41:15.915830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.994743Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.994743Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:7a2f7ec73a77769469f26f18752791203bfe61b69805358aa250f5aeb0d4fac9","observation_id":"db6d393c-1bc2-4756-a830-80a723e709f0","resolution":{"observed_at":"2026-08-07T15:41:15.994743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.146419Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.146419Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b79f8f7fba93a0e02752b79853da5f95fc079a983ebc3b5909347919986fd728","observation_id":"b4ac9295-0bb7-466c-8804-de8f5b0468ef","resolution":{"observed_at":"2026-08-07T15:41:16.146419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.267483Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.267483Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:971d6ef95ab3e6695c707e586adbc78a190422447cfeee475dbc747acd377e6a","observation_id":"7946b2b8-9d26-442c-8d8e-7a61d99fc17c","resolution":{"observed_at":"2026-08-07T15:41:16.267483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.351395Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.351395Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:bc099b8ce167eb4ceb77698b0b510c41b0f6e7006bbd8acbe3fde06696afb911","observation_id":"6c8ec02e-32ad-49a8-a074-3f75deef90f0","resolution":{"observed_at":"2026-08-07T15:41:16.351395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.459889Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.459889Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:bd9fa390e9b8d5dd1bdf6bb3715fa05ca6bef4c2d9a8bf07943f01f6072712fd","observation_id":"a795c52a-05b4-41b4-868f-c245d83d8739","resolution":{"observed_at":"2026-08-07T15:41:16.459889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.572280Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.572280Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8bfd509a425bc0fa83c7e2472fc02c7b58f50b43d05c0ac69d9cd730b2150fef","observation_id":"ac6a07d2-0356-4b05-abb4-ec54df3891b2","resolution":{"observed_at":"2026-08-07T15:41:16.572280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.690686Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.690686Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d90a99b7d291e7a4603aa9effce9553b6229ef6d6ec9f88c89f9f744bd84d91e","observation_id":"ad596cdf-45ea-4827-af9a-147f40592611","resolution":{"observed_at":"2026-08-07T15:41:16.690686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.805495Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.805495Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4b8aa9b13380a62e0406792bc3a26c9b85f100340c5139d477cab4d044352603","observation_id":"ff4300ea-0496-4f52-bd61-9f81c58c67b2","resolution":{"observed_at":"2026-08-07T15:41:16.805495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.921569Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.921569Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d1dbc2eb79f95638b1fc0315a282c8e589a28fd23ef6782e57d1c28cd4c8a913","observation_id":"9593a0d9-3ce9-4057-b5fc-34ae025037fe","resolution":{"observed_at":"2026-08-07T15:41:16.921569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.036860Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.036860Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:ead8233775d71ebc90a5efecf81c278d1a4fed145762bd2371f856bde6e9f147","observation_id":"e18b0893-bdd0-40ae-91b9-c3a99ded40c9","resolution":{"observed_at":"2026-08-07T15:41:17.036860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.157136Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.157136Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c364bb2d5d9310affbd24971117602b726c2944142d1ca3bd0aebb27bafed13b","observation_id":"7942aaad-e72c-478f-9b92-670c5ffff9f3","resolution":{"observed_at":"2026-08-07T15:41:17.157136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.231515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.231515Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:03cf05a03345c9641f84c6aae640385a691d6271fb216050a77e2fa1d589a16b","observation_id":"498e705d-fc9f-44fc-bd4a-d380eca18837","resolution":{"observed_at":"2026-08-07T15:41:17.231515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.307935Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.307935Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:765bbc2c892eefaf100507104fabb5765174bc4013af9cd8007a22249abfcaff","observation_id":"9d80ffc2-91cf-4d2e-8bf5-ecce98d3c530","resolution":{"observed_at":"2026-08-07T15:41:17.307935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.404663Z","title":"Set Rubrics M1 M2 M3 M4 M5 M6 M7 benign","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.404663Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:efaaf20c4bb25348dec10ddbcd4710d38a35287c5e82730a19eab357c2805fb3","observation_id":"f947f22c-7e19-4d3d-843c-09522345b9ee","resolution":{"observed_at":"2026-08-07T15:41:17.404663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.506426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.506426Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1c15e3a10ed255d2ba9800e24588ec6080f913a74f1e5ef50ec1b132ccad2f7a","observation_id":"67949395-410f-4400-9a6c-84a3ac15ed90","resolution":{"observed_at":"2026-08-07T15:41:17.506426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.614987Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.614987Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:3bf2bf65a3885af1bb92cbcb0d625424d97a3d7af71ee694bee946201cfceaa0","observation_id":"c618124a-7e04-493c-85d7-a1e6aa7713eb","resolution":{"observed_at":"2026-08-07T15:41:17.614987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.702562Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.702562Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:3c493a9536673600ffa89b726e21c9847995961061dab81a052d46ba487f826a","observation_id":"526ed5ea-84c1-48c8-b44d-548732188ae7","resolution":{"observed_at":"2026-08-07T15:41:17.702562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.837289Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.837289Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f699105394b891fb237532de69f38120d258071086a0ae0105d4994698c52bc6","observation_id":"edf909cd-3474-4da7-a8a7-1b3967bf9814","resolution":{"observed_at":"2026-08-07T15:41:17.837289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.972712Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.972712Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:317d2fb80afd40c34b1bf9476a8d82cfedfd816de0feade7d5f2181390a2de74","observation_id":"de9e4fe1-f0f4-430a-9cf1-769d033aa987","resolution":{"observed_at":"2026-08-07T15:41:17.972712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.074954Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.074954Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:904a40784e0f80513a63e4191bb0ce04a1155dd5b0adb77ace0fa199297aaae9","observation_id":"68110f00-6a31-4920-aee4-11efeae71287","resolution":{"observed_at":"2026-08-07T15:41:18.074954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.176527Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.176527Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2e085fa75c578e73ea3b9b6e01eebe3bba4bf9ec0089821ad8c2e41b9dbc1ae4","observation_id":"dbb1786d-5256-4749-94c4-c8daf9f4f554","resolution":{"observed_at":"2026-08-07T15:41:18.176527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.273717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.273717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:eea00d61f99dacfbe5cde8380cffdb7a1e6516f4d41aaa90877c97f1ae425452","observation_id":"551a7c89-c885-4007-9a54-55f08564f598","resolution":{"observed_at":"2026-08-07T15:41:18.273717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.379842Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.379842Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:778311c40c192273a23ad0c7849e170a2d6da2b88aeebd7241c4ce180b336e8d","observation_id":"94027041-c4db-403e-896b-0f61147e3ca8","resolution":{"observed_at":"2026-08-07T15:41:18.379842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.449810Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.449810Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:463898d8d53fb16bfb56ff88c47bca0afe2b227069e664f0599b3c3cbd21bf58","observation_id":"44f7deb9-f520-45f6-8234-7d35fc78cd5d","resolution":{"observed_at":"2026-08-07T15:41:18.449810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.535325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.535325Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:994d605736928ccb07e0c16f8f61c8ae629ce922fc2da064d7fa70b7fe49d8bb","observation_id":"7a72b4aa-9c3b-4b0c-8466-09371ae6525d","resolution":{"observed_at":"2026-08-07T15:41:18.535325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.608324Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.608324Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:307d4336686762f8016e360c116e25af62835e292d157253688d9c82cdfb8b7e","observation_id":"74f37b4b-e7e1-4231-b0b8-4373e3d585b1","resolution":{"observed_at":"2026-08-07T15:41:18.608324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.685283Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.685283Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d28a712fb28d46e4880088cec63d6be70ff2c113b6d1e0edafa3668ca1b1d35e","observation_id":"d08dba1b-64a1-4110-b86d-2a5856667f23","resolution":{"observed_at":"2026-08-07T15:41:18.685283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.763665Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.763665Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:ab8d84b4c72f7ac067c59d63ff56b3ab41e3a2787b195892c2f1c3bea36fe330","observation_id":"ff613d9f-caa0-4af9-9675-f3616fbfa676","resolution":{"observed_at":"2026-08-07T15:41:18.763665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.900593Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.900593Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5eccda94a36e81df10740a3521ae8dcf0b673f620cda176f05431b1c1604d860","observation_id":"89ee8712-fa3e-4869-b8b9-792c224f8b79","resolution":{"observed_at":"2026-08-07T15:41:18.900593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.037954Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.037954Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2d4882f031a95e1e30881dee7ee0f88a6372a3d3b1f1d0ba4640fd6cf6c940e7","observation_id":"9a788887-f4db-470e-b064-e28731d58d57","resolution":{"observed_at":"2026-08-07T15:41:19.037954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.139256Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.139256Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2bddbb370b2998dc95533cf4b97a97110d12585d9300c090ad421bf7074f2c79","observation_id":"bbe41dc1-4099-4a31-abb8-1b123567f3ac","resolution":{"observed_at":"2026-08-07T15:41:19.139256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.219973Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.219973Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:825ef164dddf0e6896f0b2dbb0d436118b4859f968d781dd7f6bf393b5b4a8a1","observation_id":"fc8e2d31-2fe4-4ab7-8a80-e0761bb634f2","resolution":{"observed_at":"2026-08-07T15:41:19.219973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.340708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.340708Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4108c7b5b71a6ba85023f9452106a171d6bf5c4a025da6ed55e9a351b66edb34","observation_id":"33073363-1264-45e5-85a9-18db563d46d8","resolution":{"observed_at":"2026-08-07T15:41:19.340708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.419406Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.419406Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1ba2558c33c3f7b76fb76c3667adb524137528d89b4fda3fb5e757e7c058918a","observation_id":"8cd60862-5044-47c0-8c8c-f32e412e8bbd","resolution":{"observed_at":"2026-08-07T15:41:19.419406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.512403Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.512403Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4c32a5c4a17df35b9dae13633d75e7b7d2fd41074f58a222f8b0d14744352c6f","observation_id":"b4929638-3773-4a9e-b018-ac57be1eafee","resolution":{"observed_at":"2026-08-07T15:41:19.512403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.607251Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.607251Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:a66de5c4953cf4b7e5128b5413eef63c12f9e6bb56c7e256beaa103ab100459b","observation_id":"e00d3944-88f9-4fd4-9956-b56e5b79021e","resolution":{"observed_at":"2026-08-07T15:41:19.607251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.689453Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.689453Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2c1ceb30c6ca0ed6a6eca9cd8b3b7e9004cd6f51cddd8b03b475a676e342a6ec","observation_id":"a743ceb3-c1d9-473b-9707-b00845a148f7","resolution":{"observed_at":"2026-08-07T15:41:19.689453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.765357Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.765357Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2becc6ebfbcf7d2537f14f8b83a6cab98737a2561dd2208e0d2158cbc5205ece","observation_id":"515b0523-ea3b-4229-893f-3dfc4352740e","resolution":{"observed_at":"2026-08-07T15:41:19.765357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.840623Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.840623Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:023cfa17d357ef0b6b7e849b05928011596785e6ccb012c7dbc9df89f8e6c769","observation_id":"ab4ca766-b88b-40ce-9b01-564e34083b1a","resolution":{"observed_at":"2026-08-07T15:41:19.840623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.915393Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.915393Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f75c1fecb158a4ce69839864497c2b3805eb66cfe1bfe26fbb14a560700c37c6","observation_id":"a9fd80bc-bbbd-4a0d-a15b-dc6b49b40252","resolution":{"observed_at":"2026-08-07T15:41:19.915393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.983858Z","title":"Set Rubrics M1 M2 M3 M4 M5 M6 M7 benign","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.983858Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c1477ae5057acfba8ea8b9c03e2c07d5487489550d9bd630f6d9165a0292db9b","observation_id":"d226a8d0-4898-4895-b9ef-61c838070341","resolution":{"observed_at":"2026-08-07T15:41:19.983858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.065351Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.065351Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c055ef1f72c2bd3b0805633349196f3efd89a13716135e4ec43b87753120664c","observation_id":"33f4ec98-fce1-4d83-9852-a5942b12affa","resolution":{"observed_at":"2026-08-07T15:41:20.065351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.122055Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.122055Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8d781c472742a8a78d3b44bafb407f4766af06a844eb320be0644cca411900e9","observation_id":"e02a8f69-0329-4ce2-942c-d759657e5589","resolution":{"observed_at":"2026-08-07T15:41:20.122055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.188795Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.188795Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:aef23911dae7f61e0aabb036c6af273be419557d7857b0d341a599cec374051a","observation_id":"30d4f575-e8a5-423f-8b39-1ea4ce2ae164","resolution":{"observed_at":"2026-08-07T15:41:20.188795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.255874Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.255874Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:7cb6fb37f40dadac1fdffa9a9e316f50e23634d4c2248825eb4e92a85d3f5839","observation_id":"8d39d701-f496-4805-8f8e-1326330b5d3e","resolution":{"observed_at":"2026-08-07T15:41:20.255874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:35:04.974076Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":238},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 238 outbound references and 1 inbound Pith citation observation for arXiv:2505.14279."}