{"as_of":"2026-08-08T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e8c88bb463ed463be78ce58f311759e5f75bf78dd96fd62155af0490f437f4c","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:17:27.518793Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.08277/citation-record","integrity":"/paper/2508.08277/integrity","json":"/paper/2508.08277/citation-record.json","paper":"/paper/2508.08277"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.985209Z","title":"Learning and Instruction , volume=","venue":null,"work_id":"41d37591-4632-44d1-a98d-70263e5f77bd","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.222816Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:589f18542d4c9e420a446f477c4d23de1343f2cdbc6629f322de5188758f4dc4","observation_id":"9c87b443-174a-44c4-b61a-a0e875c32538","resolution":{"observed_at":"2026-08-06T10:17:29.993224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.965700Z","title":"Proceedings of the Eleventh ACM Conference on Learning@ Scale , pages=","venue":null,"work_id":"cd78fe23-65dd-4464-9326-7e179477fcda","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.314059Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:3d16fd3fd0b31d087f5ea9c31a2c1a7a15e0277aa61d185afcf5cc8fbab230b3","observation_id":"272e5580-81d2-49a3-8fe0-76780418aba4","resolution":{"observed_at":"2026-08-06T10:17:29.970897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.930465Z","title":"Springer, Cham , year=","venue":null,"work_id":"64fcc551-4a17-4bc1-8e57-f33531fe5780","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.480697Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:f49a2b128d8c5a16c426167378ad244bab17014209c5dafbdfebfb58531cdb88","observation_id":"4474936f-8e55-4001-bdb7-de122f203e81","resolution":{"observed_at":"2026-08-06T10:17:29.937748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.897792Z","title":"ACM transactions on computer-human interaction , volume=","venue":null,"work_id":"bb02f05f-077c-4304-a4f5-7f4e07bff555","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.600562Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:9fc1fa0d4ac43c9727f6e54e50bc2eaca95b2e62f80fae059d62ba3c750e67bf","observation_id":"55f68602-8419-4ac9-b6ec-3818e7cd5909","resolution":{"observed_at":"2026-08-06T10:17:29.910334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.864541Z","title":"Expert Systems With Applications , volume=","venue":null,"work_id":"2e615300-5693-4a10-948f-fadf4abdab3f","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.700956Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:acd3025b6da2e3c553fd230aaa67baed7a822739e1877ad7c94eebc87960162f","observation_id":"fc1b8494-42a5-4eef-b948-afdb551e9041","resolution":{"observed_at":"2026-08-06T10:17:29.873390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.830397Z","title":"Education and Information Technologies , pages=","venue":null,"work_id":"de1d92cf-710e-40f6-8389-7bc163c778b1","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.813730Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:b7876335ca02ccb4b508a5272435f63cc042714f62a2a9ff8675bf036307a0d8","observation_id":"eb69c36f-0fe4-4a60-a5d9-961d271db5af","resolution":{"observed_at":"2026-08-06T10:17:29.841816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.756083Z","title":"Thinking Skills and Creativity , volume=","venue":null,"work_id":"684bccbb-4a36-4f86-9586-446bc555462f","year":2018},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:24.949860Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:daaa08dfe9a1f4486c52e5ff24876c66d376215adbef7fcdc864689c21b2ea98","observation_id":"b5ef7c28-d7e7-4fcb-aae5-fdabf95e0d68","resolution":{"observed_at":"2026-08-06T10:17:29.786070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.707531Z","title":"2023 , school=","venue":null,"work_id":"f6ce1dde-b2da-4339-a7ba-d8eee801498d","year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:25.146320Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:a65c4f3a83e9ef85d2ef69238d3f63ef2ca188d17bbdc284bee2c06a653a8023","observation_id":"d0409e55-86ac-42c5-bea6-dd29007095a4","resolution":{"observed_at":"2026-08-06T10:17:29.716537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:25.299078Z","title":"ACM Transactions on Intelligent Systems and Technology , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:25.299078Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:40a75a5cad6f46afef00ef036c223248f5762ef509183a01464d5343f780799e","observation_id":"050696c3-429d-4a07-a139-06cff7431915","resolution":{"observed_at":"2026-08-06T10:17:25.299078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.596375Z","title":"Proc Meeting of the Association for Computational Linguistics , year=","venue":null,"work_id":"7e362b57-3736-463b-98d9-0a9bd7d2b510","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:25.384086Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:5eab7f2c66d840edc07ad2da85fe68aadf53d8486ee05bad1bf23bf019a86e9c","observation_id":"5eaa5337-a1c7-4ceb-94cc-527c159a81b1","resolution":{"observed_at":"2026-08-06T10:17:29.608659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:25.528315Z","title":"Text summarization branches out , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:25.528315Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:ad7e1fd3aaf4fa6beced8945223459b754afa256eeab48be0c0170ea1fe1c56a","observation_id":"ff2dec81-9ee4-4ec9-a7b7-0fb938119f8d","resolution":{"observed_at":"2026-08-06T10:17:25.528315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:25.700381Z","title":"Proceedings of the acl workshop on intrinsic and extrinsic evaluation measures for machine translation and/or summarization , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:25.700381Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:61b44a7b079725ee6728384a8a4075418b6d22c3045eda47c222eb6917b4d524","observation_id":"710f1c03-bc62-41d9-897e-f0f91bd53342","resolution":{"observed_at":"2026-08-06T10:17:25.700381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.483021Z","title":"Journal of High Energy Physics , volume=","venue":null,"work_id":"fc5afe40-2752-4bf5-b780-a8a7658a4fa7","year":2022},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.110308Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:61202b434c865a66f2a7d8dfd7bf8737ed35f4d36e03f9e83255fc59d6ee4f6f","observation_id":"8f46911f-c6ab-40f1-b723-7fb1ce3cb4e8","resolution":{"observed_at":"2026-08-06T10:17:29.507123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.448432Z","title":"Hydrological processes , volume=","venue":null,"work_id":"9044d539-3dd4-4a63-84ad-cde9704320b3","year":2014},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.223721Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:fcfe29e81ce2ea7854bb275e655a983d3373fc2434ccf05c960afe07984a0aa3","observation_id":"77e87f03-7f46-45ff-92e5-3d5d3552dbcd","resolution":{"observed_at":"2026-08-06T10:17:29.457319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:26.403839Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.403839Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:138910d7542d55e4be8512e5442fec1b13e65cc4bc52262c4c61d1065cb69c57","observation_id":"c2004606-bc0d-4054-af3a-3b3c349bb87d","resolution":{"observed_at":"2026-08-06T10:17:26.403839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-06T10:17:26.562584Z","title":"arXiv preprint arXiv:2211.09110 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.562584Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:36e8156b564d12e14175a8c661ad0530e53355ebd7096019eb79457013554aa8","observation_id":"e289a0af-ab01-48f9-bed8-91f8f04369d8","resolution":{"observed_at":"2026-08-06T10:17:26.562584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.365008Z","title":"Proceedings of the Fourth Workshop on Data analytics in the Cloud , pages=","venue":null,"work_id":"39e25901-bf6d-4d1a-9520-e7e04a93e654","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.712655Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:126167a619421b65625d474a0d4e1bf88754ff3947e562e2eb1efba61899be70","observation_id":"bee932d6-69a1-479e-9e23-c05f546b65ad","resolution":{"observed_at":"2026-08-06T10:17:29.376790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.317359Z","title":"Teaching in Higher education , volume=","venue":null,"work_id":"db9768e7-2776-481e-8086-3440d0993029","year":2006},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.811030Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:986c6d6cf7bf2675da239a6a6ee8a66e2712fdf6e20045569b689c2fb5fcbae2","observation_id":"14baa380-b8d7-4879-81d0-ab6c95913c8a","resolution":{"observed_at":"2026-08-06T10:17:29.329176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.285268Z","title":"18th Conference on Software Engineering Education & Training (CSEET'05) , pages=","venue":null,"work_id":"75b9f0b0-ca05-412f-81a4-f3ee43f7f4d8","year":2005},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:26.960181Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:8c52339d3950abbb43761e0fab0fb93178bc781e0c1f4c2c71aeeea88e9a4554","observation_id":"20e6b57a-95c3-4470-a14a-a4d5d42b500f","resolution":{"observed_at":"2026-08-06T10:17:29.296373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.261691Z","title":"2024 5th International Conference for Emerging Technology (INCET) , pages=","venue":null,"work_id":"b21c9d82-d926-483d-984f-859c768fd234","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.017307Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:0067328e0aec5e7fdf6d952b0beb3882bcbe70d147994fff7b59a87eb6c9ad0b","observation_id":"6d253ea7-a9d8-4023-967e-b8ca38e26620","resolution":{"observed_at":"2026-08-06T10:17:29.270303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.222254Z","title":"Glasgow: Quality Assurance Agency (QAA) for Higher Education , year=","venue":null,"work_id":"9d754b41-1784-45ad-8c51-d33bea4d56c4","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.027503Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:b5ee48a2ac8fde24c253f33180d27e6b94e51cee41d08168f994db5d93099eb0","observation_id":"462337ae-13d7-4293-9b34-66edf05d1590","resolution":{"observed_at":"2026-08-06T10:17:29.236184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.191149Z","title":"Available at SSRN 4312418 , year=","venue":null,"work_id":"c8cec4c0-9884-457b-9a28-73f6e4f9f9e8","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.050204Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:a0e1dd15b231c47909d95c61f666a6e75d0b4e1bd6850730233421b860aa9f6c","observation_id":"5056b92d-07f3-42e4-8793-5b86fd8b949a","resolution":{"observed_at":"2026-08-06T10:17:29.200566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.061006Z","title":"Learning and individual differences , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.061006Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:e755c73072e4c79863def42a75781549b4deccd448f99fb206c5c90ac0420357","observation_id":"42abc01e-aaf9-46f4-b957-d3c91f0f289a","resolution":{"observed_at":"2026-08-06T10:17:27.061006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.076510Z","title":"Journal of Artificial Intelligence Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.076510Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:4d0150a2f1e17262c9194b8582baedcd295e28378bd6504e6c9a8a170e4d4257","observation_id":"2f431ec5-44ed-4b96-82a5-7234ee5c0d35","resolution":{"observed_at":"2026-08-06T10:17:27.076510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.088002Z","title":"Proceedings of the Eleventh ACM Conference on Learning@ Scale , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.088002Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:ce09144fcfaf41c019e182807897c011a965a9c7546c7e717fdf0e3390233b4f","observation_id":"f7dc3f0b-ac3d-475d-a482-1c38bd3b098a","resolution":{"observed_at":"2026-08-06T10:17:27.088002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.122899Z","title":"World Wide Web , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.122899Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:a1de0db988d25cd5cc1c442e0fb5324dd6ffa8282e4906e31aca5c7b352b6926","observation_id":"2225407c-6cd8-45eb-8676-c2eca11aa181","resolution":{"observed_at":"2026-08-06T10:17:27.122899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.130420Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.130420Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:a9993b8f40e24d5c2af144b80224631ce947dd15ed107739bbb8e9dab65b2adc","observation_id":"236a9bf5-2c98-48ad-a887-8f35b3a7ff56","resolution":{"observed_at":"2026-08-06T10:17:27.130420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:29.006700Z","title":"Innovate: Journal of Online Education , volume=","venue":null,"work_id":"99a55ad8-fcc9-4e56-bdc1-037e4e57daf0","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.142441Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:26c6b5663adbaf8f169754d914b2e35018727d421e557b4f02f0dc84247ee6da","observation_id":"552a14f4-699d-4b39-8a4a-d9aaa50f8921","resolution":{"observed_at":"2026-08-06T10:17:29.013293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.973125Z","title":"Second Workshop on Computer-Supported Peer Review in Education, associated with Educational Data Mining , year=","venue":null,"work_id":"d170ec02-51f6-41e5-bb23-89ea9713abc5","year":null},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.149496Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:42fd5ae7b841fe26d4b4d9139fa97b4979e9d1fde4f82a845318d4499a7574db","observation_id":"d93f4ce0-9969-4bb4-83e0-aa9122b83122","resolution":{"observed_at":"2026-08-06T10:17:28.991808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.929411Z","title":"2024 IEEE Frontiers in Education Conference (FIE) , pages=","venue":null,"work_id":"0411991b-3396-411c-ba98-4ae7009980be","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.160555Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:1330a00c7d2d100f490af3ae26951b87b37472d9ea988ea860a5c58d236cda7d","observation_id":"3dfe4d1f-e88f-4895-bbdd-7ec1ce6bd022","resolution":{"observed_at":"2026-08-06T10:17:28.947767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.891510Z","title":null,"venue":null,"work_id":"c1b8a6e1-5101-4e23-a5e0-7b1a23601352","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.165734Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:2ab745afaea4f4a06ff8d67c6e7caaf3089be44c858351864c572e058f31e614","observation_id":"b0e87664-2edf-477f-b281-53057dd4a3af","resolution":{"observed_at":"2026-08-06T10:17:28.900947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-06T10:17:27.176437Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.176437Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:d800ec438c029071617e1a28883f87595153b48002935d9e36442ac81c1d8023","observation_id":"86b48c0a-2136-4b19-8163-04aa37bd19b6","resolution":{"observed_at":"2026-08-06T10:17:27.176437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.825761Z","title":"Banerjee and A","venue":null,"work_id":"bbdb5432-2269-47a7-8487-b6a72400d762","year":2005},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.181804Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:dd9056c68494679d18ef647fe70498346b5ec65ac576a08603c046135a2395c4","observation_id":"b36e0111-b7ec-4987-aaf1-32bae2fb0262","resolution":{"observed_at":"2026-08-06T10:17:28.842833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.765651Z","title":"Bhatnagar","venue":null,"work_id":"7cf268e0-820a-4720-ab74-d17500fbecd8","year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.188681Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:9c893f14515d681303d1a6356e073920feac7e7daaa176978fedb37c4dd27b83","observation_id":"bd956ff1-3190-4a36-9152-1dad23e72e77","resolution":{"observed_at":"2026-08-06T10:17:28.772553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.705930Z","title":null,"venue":null,"work_id":"f89037a9-9c7c-44c5-ad41-0696a8cefb5b","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.196393Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:3f2b626c71844f70e5afe894d371aff7730edcdcd5f4123b38db9f29e51d908e","observation_id":"0e883130-2661-4990-95af-ed0732975dd6","resolution":{"observed_at":"2026-08-06T10:17:28.726093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.204753Z","title":"Chang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.204753Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:39f2318895f22fd9fb438843ddb10ce5d0a01b82759d650e7662d815c5834974","observation_id":"9d78d382-df9b-459a-8487-c4e829f95538","resolution":{"observed_at":"2026-08-06T10:17:27.204753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12692","last_updated":"2023-05-04T18:04:49Z","snapshot_observed_at":"2026-08-04T11:24:42.436632Z","submitted_at":"2023-02-24T15:35:36Z","title":"Language Models are Few-shot Learners for Prognostic Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12692","snapshot_observed_at":"2026-08-06T10:17:27.213243Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.213243Z"},"links":{"cited_paper":"/paper/2302.12692","citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:9809e6e0b07aaee43b914dff53d86fb1f38c4f08d4a1986f083c750f99a8512e","observation_id":"d03e1c93-bb58-4c80-ac40-cc515bce4166","resolution":{"observed_at":"2026-08-06T10:17:27.213243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.640380Z","title":"Crain, J","venue":null,"work_id":"538b94f6-779e-450a-9956-c58fc095191a","year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.234627Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:4d11dbdd6d7f1d16b2fe8a3b78221089452e55871ff62632a654e9d193ab5245","observation_id":"a17e402e-ade8-4922-896f-1d4e2d3fc788","resolution":{"observed_at":"2026-08-06T10:17:28.646169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.617856Z","title":null,"venue":null,"work_id":"2aadc82a-0ff4-4967-8193-637b40127827","year":2018},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.252883Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:03d13bf2b95681b4baab07cf372b0219498e008463bc45424c62b2053429f4c5","observation_id":"43463620-59e2-4bcd-8141-11f4de5a17d9","resolution":{"observed_at":"2026-08-06T10:17:28.624119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.581967Z","title":"Gehringer, L","venue":null,"work_id":"39fcbde2-a76a-42d9-8ab9-7d600ccdcd37","year":2007},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.260457Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:54b47c03bff1f47d42a3da1ae7fde9a96c76c1eed2175581e3590e0b758ac986","observation_id":"03d230a4-d0ad-4d3c-b860-73417a0d72c5","resolution":{"observed_at":"2026-08-06T10:17:28.589552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.546828Z","title":"Gehrmann, E","venue":null,"work_id":"6f6f33fb-d6b2-4680-a0a3-dd897102388c","year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.268805Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:09937d04e55aa0ed8b7e60a74134674f4e1f763fed6665be1d1b68095255f81c","observation_id":"652d424a-7a80-4ab7-9baf-8b9c7f84144b","resolution":{"observed_at":"2026-08-06T10:17:28.556584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.502486Z","title":"Gehrmann and R","venue":null,"work_id":"cf4cc79b-c752-4ad3-a2c7-6764ff844f7c","year":2022},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.274354Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:ed27fa03939bbb6084835a9ea6eaac5faac4424dd90fba8608a57503f05472b9","observation_id":"360170ed-e008-445a-a6a1-8be44f6fb955","resolution":{"observed_at":"2026-08-06T10:17:28.514640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.472516Z","title":"Gielen, E","venue":null,"work_id":"1e05a9be-0b57-4207-9b3b-acbb799c6151","year":2010},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.282316Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:792c5f2c601b62b18761464aa12cc868f31100669eae9cf7012323da95590316","observation_id":"7513dfca-2004-41c8-8622-5b7bed474492","resolution":{"observed_at":"2026-08-06T10:17:28.480437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.438395Z","title":"u chemann, M. Bannert, D. Dementieva, F. Fischer, U. Gasser, G. Groh, S. G \\","venue":null,"work_id":"9acccb4d-4411-4aff-bd11-126a9715e024","year":2023},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.291590Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:866dc06895e58299fb4dba9c9ba7144c70080685b7eb48399f89419f3007ad10","observation_id":"882bbeaf-524c-4d19-8b7b-212e655cc8ff","resolution":{"observed_at":"2026-08-06T10:17:28.452422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.381952Z","title":"Kulkarni, S","venue":null,"work_id":"cb79695b-7132-4ba6-b538-f2d9398c607f","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.304087Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:cb3261198357e146f23e3f95174e69663b2d81840f2a2ffc6126d2fddc44d3a0","observation_id":"e685cb80-2e76-4b76-9fb9-b7f7cd001024","resolution":{"observed_at":"2026-08-06T10:17:28.391364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.333080Z","title":null,"venue":null,"work_id":"210206ba-d877-4e88-bd5f-b43a748075cb","year":2004},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.329561Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:e4112c91ba435d959f6273017069b79853d7c5b083b92b6abe156b079be5ea55","observation_id":"2860c6b7-6cc5-4cb5-a43a-379f3aca5e55","resolution":{"observed_at":"2026-08-06T10:17:28.351147Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00192","last_updated":"2020-10-31T05:26:49Z","snapshot_observed_at":"2026-07-06T10:10:23.119918Z","submitted_at":"2020-10-31T05:26:49Z","title":"Personalized Multimodal Feedback Generation in Education","version":1},"cited_work":{"arxiv_id":"2011.00192","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.00192","snapshot_observed_at":"2026-08-06T10:17:27.677265Z","title":"Personalized Multimodal Feedback Generation in Education","venue":"cs.CL","work_id":"a95f9551-7cf1-451d-9ead-34bfaf52e386","year":2020},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.340395Z"},"links":{"cited_paper":"/paper/2011.00192","citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:122ed07a4df46810c08b3f68a0cebcc184e1ded4c499be6c297efe702f490291","observation_id":"de3fe33e-e378-4910-9e06-a0166f93ec55","resolution":{"observed_at":"2026-08-06T10:17:27.695524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.296364Z","title":"Liu and D","venue":null,"work_id":"4116d81c-5d87-4355-be04-7a8fd7ff8dc5","year":2006},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.353961Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:d4b45a349247212190dff3b62033191c9b13bcddf847c7ab8464fe17643f3e11","observation_id":"476e90c2-9a89-4155-b56a-642d33c13fc7","resolution":{"observed_at":"2026-08-06T10:17:28.306611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.272368Z","title":"Lu and X","venue":null,"work_id":"7d5388bb-d1a4-4d61-b2c5-9a317f83ef46","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.362607Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:425127adafd517712895a516ec9a28aa45012c09db851aa6aca76eb40f699733","observation_id":"048f0689-f022-4e2e-b3d1-b4c0a83c6de7","resolution":{"observed_at":"2026-08-06T10:17:28.281989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.206977Z","title":null,"venue":null,"work_id":"4b228b12-2369-4db8-b78c-fc136867c785","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.371772Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:29b5d76d019c721a0887ff9336cb2fe47515a155334e444d23fe4d08e869aa2e","observation_id":"49fd9cf6-54b5-413d-8939-fc973193f34e","resolution":{"observed_at":"2026-08-06T10:17:28.253040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.155165Z","title":null,"venue":null,"work_id":"14c38891-c242-4bb6-b4f0-511cf8b2a808","year":2025},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.381892Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:89c5dad77e0393a19e7b4d33a85c7da021bedfac12321f576aa7aa51ed7d6122","observation_id":"a791954b-c75c-483f-9204-07ff37ba48d9","resolution":{"observed_at":"2026-08-06T10:17:28.174802Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.125734Z","title":"Papineni, S","venue":null,"work_id":"d3e4535a-13dd-40cc-9ab6-1f0f9e2ab250","year":2002},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.396409Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:4d8bb72522213d0927589916e1b84286c69760892c2e45b56024707559de1297","observation_id":"4c553f14-76b3-4e64-963a-9d8f64ea61ab","resolution":{"observed_at":"2026-08-06T10:17:28.132991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.084200Z","title":"Rafailov, A","venue":null,"work_id":"07343657-42be-4d4e-bc7b-e47a7acd14cd","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.413847Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:553b988f62634d9b3223a0f1d29bef0fbbba178c22e337a5b4cdfc150aa9e6c2","observation_id":"5cb712de-bf3a-4bdf-b587-66b0d86b6988","resolution":{"observed_at":"2026-08-06T10:17:28.091812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.051010Z","title":null,"venue":null,"work_id":"1f7bf06b-8d39-4234-93c2-ab214f0dcac8","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.422597Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:a9485841d4d5acf1017d1b48a4603128c4cc33a32ce6bf21a39a784efd45e69e","observation_id":"a85ae4cc-2437-49fa-8b36-ac20656bcf3a","resolution":{"observed_at":"2026-08-06T10:17:28.060153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:28.026607Z","title":null,"venue":null,"work_id":"bddd6d2d-13a7-4e0a-8dad-0eaad26d1bdf","year":2024},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.440977Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:53a8e4b4f49857d49f4a1c78ebbcd8f1a514fd106632344b22f0292a35e061cc","observation_id":"4358526c-c02e-495f-ac30-eb7cf318e2dd","resolution":{"observed_at":"2026-08-06T10:17:28.032715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.980563Z","title":"Zeid and M","venue":null,"work_id":"8f9f0f73-1d98-4767-82a6-475b9792a490","year":2005},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.464135Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:5c367b0a2b8fab638533918e18563e9ef31966185774918c05060a7c33c7f455","observation_id":"32f0c425-7c96-46b4-9a90-8a0537106bba","resolution":{"observed_at":"2026-08-06T10:17:27.994382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:17:27.903328Z","title":null,"venue":null,"work_id":"b7d4b211-03a2-40d5-9dee-a8130c2f6e8f","year":2022},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.485628Z"},"links":{"citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:f4d37ec269b6539af5e0e72c6774b83489254e39cbabe7cdc4ea6aad84ca077d","observation_id":"1631cd12-969b-44c7-9c16-dc5a6530ba8c","resolution":{"observed_at":"2026-08-06T10:17:27.917050Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-06T10:17:27.493254Z","title":"Zhang, V","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.493254Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:1b24daaeaf2fbe07283458e3f29459c2d020394304b4438c7b071a26c7932d15","observation_id":"ea96fc57-dea1-4fca-ba82-73873db37fdb","resolution":{"observed_at":"2026-08-06T10:17:27.493254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02622","last_updated":"2019-09-26T09:56:23Z","snapshot_observed_at":"2026-07-06T08:19:30.852269Z","submitted_at":"2019-09-05T20:26:44Z","title":"MoverScore: Text Generation Evaluating with Contextualized Embeddings and Earth Mover Distance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02622","snapshot_observed_at":"2026-08-06T10:17:27.518793Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T10:17:27.518793Z"},"links":{"cited_paper":"/paper/1909.02622","citing_paper":"/paper/2508.08277"},"observation_digest":"sha256:67147d624c7dbb08e8dd1cb071dc6f16ffd6fccd321e2fd98d90f9f54509d6d7","observation_id":"9c7f9d6b-1f6f-46e7-980d-854c74d30a7b","resolution":{"observed_at":"2026-08-06T10:17:27.518793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.08277","last_updated":"2025-08-01T02:24:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:12:54.674294Z","submitted_at":"2025-08-01T02:24:19Z","title":"Objective Metrics for Evaluating Large Language Models Using External Data Sources"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2508.08277."}