{"as_of":"2026-08-07T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2586297f45df68ce9ecb43249f0f8d35376d2d7e5d4be3e9ab6bd4f56b54e818","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T01:39:12.423063Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11601/citation-record","integrity":"/paper/2605.11601/integrity","json":"/paper/2605.11601/citation-record.json","paper":"/paper/2605.11601"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5d6b0b6d-f158-43eb-ad6b-6cb96125654c","year":2021},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:5e85e63985e538042fe2e5b19851d046250a5cd4cbcfd85db8327ccbc0c7ff82","observation_id":"11c65e5a-641a-46a2-98be-7a67b21a0f15","resolution":{"observed_at":"2026-05-13T14:37:54.891762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repairing the cracked foundation: A survey of obstacles in evaluation practices for generated text.Journal of Artificial Intelligence Research, 77:103–166","venue":null,"work_id":"3eed40cb-8474-4d74-a245-1f4dbcf23109","year":2023},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:1434a9484a9af714b5c80d605b1fade749f7a85112f58cd41bd9bf4aad4eeaf1","observation_id":"050372c7-3fa2-47d8-b640-73eb50919aaa","resolution":{"observed_at":"2026-05-13T14:37:54.885680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"4746b04b-caa9-499f-b89e-fb2bc1f21c8c","year":2002},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:4cc4c20605d50517448a81aa8cf1124417dab806b267116d5b852abe6c5eb73f","observation_id":"3baf671e-ca0a-428f-8e6c-de1aee70fe4f","resolution":{"observed_at":"2026-05-13T14:37:54.894807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T22:50:11.508664Z","title":"ROUGE: A package for automatic evaluation of summaries","venue":null,"work_id":"5ad3cac5-729f-4b0e-b10e-2c532bb71ba3","year":2004},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:78b6f37c6845fbb1ec50f8f54ef0309332019e83beb1bab00f53ff0f6853c064","observation_id":"6384ec8d-6623-4bc6-b993-4fac83028723","resolution":{"observed_at":"2026-05-13T14:37:54.888812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":"f8636821-f81b-4500-b187-01d899003ef3","year":2020},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:03ffa6dc9f32bf086a62feecb359b83abda3cad41d96087faf898132048e67e5","observation_id":"cf400633-d312-40ab-8c2f-8b96449278ab","resolution":{"observed_at":"2026-05-13T14:37:54.897667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meyer, and Steffen Eger","venue":null,"work_id":"7ffe69fb-5a62-4de7-ae9e-6f6ecc132787","year":2019},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:b050e1ed72dc9707873e53a7832efdad316ca8ecd8754aec2a584ff6b391c6d6","observation_id":"9dc3ea84-4339-4abc-baa6-5cda3ac661af","resolution":{"observed_at":"2026-05-13T14:37:54.829689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bartscore: Evaluating generated text as text generation","venue":null,"work_id":"4ed254db-56d1-4112-b207-adfd749af3c5","year":2021},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:b6aefb72719dfcfffc41c233ba8d707e4a65e3b130b67ab314839daa45825194","observation_id":"afbbda74-6f10-411f-965a-5151887a4034","resolution":{"observed_at":"2026-05-13T14:37:54.825875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GPTScore: Evaluate as you desire","venue":null,"work_id":"02fada22-b454-47d8-ae30-cb78d2c36a8b","year":2024},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:a1716b800fcb170c41fdc6ca300bf56740eb7ae4270fff17d29641c4a7a123cc","observation_id":"5afaa97c-82ee-4334-9bda-fda8ae59170f","resolution":{"observed_at":"2026-05-13T14:37:54.882527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"G-eval: NLG evaluation using gpt-4 with better human alignment","venue":null,"work_id":"20bbee6b-44a9-43ea-94fd-0ad8f77fba38","year":2023},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:f2e91ee93023c50593bfc36ca24d5b3912b571795e15a8c8d82ebfe337ac689d","observation_id":"9dfb1fa4-4c78-4cc4-8814-4baf5d9e7375","resolution":{"observed_at":"2026-05-13T14:37:54.849917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a is b” fail to learn “b is a","venue":null,"work_id":"64020ece-92c8-4565-bb5b-a2c6678617da","year":2024},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:2ecb3dd32092b50aa21410e2c2fe538c47ba86404731aee8730616c374d99f24","observation_id":"eae08f61-9ef6-4480-af0a-c5652bce2211","resolution":{"observed_at":"2026-05-13T14:37:54.852938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simple and effective masked diffusion language models","venue":null,"work_id":"a7b1457a-b862-416b-a800-8929e777fe7e","year":2024},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:98b66203003f3b73ee258c5e9df90f57a7fdb2cb5f8f9149069553dd0fbdd74e","observation_id":"81e17690-3cee-4072-8106-e7abba8b5f9b","resolution":{"observed_at":"2026-05-13T14:37:54.844565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language diffusion models","venue":null,"work_id":"27ac1193-6951-40db-9511-bc739159c0a8","year":2025},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:a28c3f88dc325ae9d03c54d51d2fd8be8987e59004272167baff433604fea967","observation_id":"38c3b285-7f6c-40dd-b50e-2992b123ca92","resolution":{"observed_at":"2026-05-13T14:37:54.856377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.15487","doi":"10.48550/arxiv.2508.15487","metadata_source":"pith","pith_arxiv_id":"2508.15487","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dream 7B: Diffusion Large Language Models","venue":"cs.CL","work_id":"a8a49dbd-ad10-4c79-b1aa-3ad5173887ad","year":2025},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"cited_paper":"/paper/2508.15487","citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:893084a043cd6cd2a7baf40f08703fc5da7b8502007ebe7f60b92213fa8725e0","observation_id":"9eaaf188-9cb0-426b-9669-0006618f970d","resolution":{"observed_at":"2026-05-13T01:42:03.849581Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BART: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":"50e91bc3-a35b-42e7-8259-4c1b218297d4","year":2020},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:f4c89a0948bf6d030ec4f33ea36ed077e080fdf6704f60770362da7c27c8bf61","observation_id":"574b3959-f25d-4f72-b95d-047df4ff795d","resolution":{"observed_at":"2026-05-13T14:37:54.818688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Summeval: Re-evaluating summarization evaluation.Transactions of the Association for Computa- tional Linguistics, 9:391–409","venue":null,"work_id":"cb47dccf-8c26-4ca9-8a13-fae4613a7f97","year":2021},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:d58b17eb0b729388fdfbdf7a5253408fba5986a8e2c6f02bace7bfbec975d4f6","observation_id":"77b032d3-3143-4049-8d13-3f7b5232d14c","resolution":{"observed_at":"2026-05-13T14:37:54.822530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Newsroom: A dataset of 1.3 million summaries with diverse extractive strategies","venue":null,"work_id":"15903f68-cdd8-4ca5-a7bd-af0636807bf8","year":2018},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:a9e383330dc7ac88ac2923895c07d31a6ead487cfd4d06e3c47f41fb606e5c9d","observation_id":"59ece68f-7ebd-4418-8005-7c51466fbda8","resolution":{"observed_at":"2026-05-13T14:37:54.838142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re-evaluating evaluation in text summarization","venue":null,"work_id":"cc148f68-7e4b-4e63-998b-4cdba38f53e0","year":2020},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:0b1cc1be7fb800099a34f1fe74a0c9a6018cf76b802764170f4a853ff1b0b245","observation_id":"f516807a-2f75-4f74-8146-d6daf2cb642a","resolution":{"observed_at":"2026-05-13T14:37:54.840729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5e9e4f9f-06c4-4d33-ba63-e98d0015a475","year":2019},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:7eeee352662a2fdb1e2e01f2e1d6a10f456bce71be987bc89d32e28852368c52","observation_id":"40d661dc-dcaa-4730-84a4-6f607075f04a","resolution":{"observed_at":"2026-05-13T14:37:54.835302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Asking and answering questions to evaluate the factual consistency of summaries","venue":null,"work_id":"a71c7917-4be5-46f0-a358-b9a99ef2d7d4","year":2020},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:1f1867b06088bfaff87467414a06aa9f07413ff127597bee1bef372e3d7abdf7","observation_id":"ae2363d4-aa42-4dc2-9ae6-0ebceaa105fb","resolution":{"observed_at":"2026-05-13T14:37:54.847342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Results of the WMT19 metrics shared task: Segment-level and strong MT systems pose big challenges","venue":null,"work_id":"6b29ad13-e15f-4f55-b523-a2c81aa34698","year":2019},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:577d2764630bea8f367caf27c5cb4bbe45f996abc55635c7462643b230be69a3","observation_id":"860e02bc-7165-411a-b973-49d87b310ef9","resolution":{"observed_at":"2026-05-13T14:37:54.871913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Phrase-based statistical language generation using graphical models and active learning","venue":null,"work_id":"9ac9ee42-6694-4715-85f8-62e680ad5f8b","year":2010},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:aadf021de3ffc6fc1209305ccca415f621dae5c39aabace464ae729280603bdc","observation_id":"98af3e25-7848-407e-a5c4-7ce52e2b1ad6","resolution":{"observed_at":"2026-05-13T14:37:54.874743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semanti- cally conditioned LSTM-based natural language generation for spoken dialogue systems","venue":null,"work_id":"003a3c9d-ca55-41db-9647-ae5bed2f9598","year":2015},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:81fd490646892506339be6ec011b82dd466670c7eb4bc6303e83074456da0af1","observation_id":"eed99294-7860-4422-8c27-fd7a09c5e875","resolution":{"observed_at":"2026-05-13T14:37:54.877480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"METEOR: An automatic metric for MT evaluation with improved correlation with human judgments","venue":null,"work_id":"ff3122c1-b9e9-4fce-b839-c38ecf7fc8ee","year":2005},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:d6d21fff71cefb69ba282b91291dfe89680cb30e46bede5d9a1adeeb983a1f78","observation_id":"e5380966-3549-4b60-ac67-a9f545763262","resolution":{"observed_at":"2026-05-13T14:37:54.880105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards a unified multi-dimensional evaluator for text generation","venue":null,"work_id":"e8e19f79-f598-4374-bdba-41925711ffd1","year":2022},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:31d78507ba2944e7a9ffdaed1770e961b4ff22e1d8067339d05f828f16d278c5","observation_id":"94c68239-2ade-4960-aaf8-37639a326921","resolution":{"observed_at":"2026-05-13T14:37:54.866061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AlignScore: Evaluating factual consistency with a unified alignment function","venue":null,"work_id":"58c3ba99-84ff-40a7-81ed-b92f4a4ae276","year":2023},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:88806743bfacca8d5b9ae610a338f374b26d006e7351f40d4ba865aff8e0a8f5","observation_id":"ad641a0f-89ac-476e-96c3-c6c6f7d4feb8","resolution":{"observed_at":"2026-05-13T14:37:54.832527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QuestEval: Summarization asks for fact-based evaluation","venue":null,"work_id":"1f0c0e03-7e4f-49e3-8cb0-6084ff3001ed","year":2021},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:9d90cc8c841e49f4439f307355327e2e7e3fa36dc4ef5519ae9fc58d152d8f56","observation_id":"563c3c3f-4efa-4f5d-a4d3-a8bca64bb0c4","resolution":{"observed_at":"2026-05-13T14:37:54.859870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The comparison of regression variables.Journal of the Royal Statistical Society: Series B (Methodological), 21(2):396–399","venue":null,"work_id":"707b8fe3-1fcb-4a10-980b-7a336eb808b9","year":1959},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:e3f1acaa6fab5afd2272f1ce19b52c6379071c5b0985e4d967b273c6b56d22eb","observation_id":"75720381-d888-473f-9fb2-4a51cfa64bd0","resolution":{"observed_at":"2026-05-13T14:37:54.863047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"timestep","venue":null,"work_id":"aa2b4131-8d80-404b-bdb5-e6c49effb0a6","year":2022},"citing_paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:12.423063Z"},"links":{"citing_paper":"/paper/2605.11601"},"observation_digest":"sha256:e350080bb00dac3de2b1bcfdcb4d463906d02f1b35f76300fccc4583b629437f","observation_id":"809694c5-48e9-48ae-967a-aa90b35b6ef8","resolution":{"observed_at":"2026-05-13T14:37:54.869118Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11601","last_updated":"2026-05-12T06:27:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:27:36Z","title":"DiffScore: Text Evaluation Beyond Autoregressive Likelihood"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2605.11601."}