{"as_of":"2026-08-10T04:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c0d4f05f295a7e4ba081c7e67a245ba66b0a9bbc68bf62555966d5c7a6a5e3bd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:11:58.311715Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":198,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T13:03:18.765496Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2308.07201"},"observation_digest":"sha256:3563f2b5c180c5b4bbcfceb2f0eabdf18c15b937e14bb1fa5322bcd50ac8c941","observation_id":"a2a8a936-2901-4bf7-aed2-d32891c2bd79","resolution":{"observed_at":"2026-05-13T13:03:18.831146Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2405.19088","last_updated":"2026-04-15T02:26:56Z","snapshot_observed_at":"2026-07-06T18:21:57.091728Z","submitted_at":"2024-05-29T13:51:43Z","title":"Cracking the Code of Juxtaposition: Can AI Models Understand the Humorous Contradictions","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-24T00:52:52.056076Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2405.19088"},"observation_digest":"sha256:15f6fc57472ef23f27f067daa5a784b475521bef68fb764192dcd9c0083349bb","observation_id":"efb345bd-5e0a-46eb-a688-8598dcdaefd9","resolution":{"observed_at":"2026-05-24T00:53:40.707687Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2503.23137","last_updated":"2026-04-15T02:38:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-29T16:08:51Z","title":"When 'YES' Meets 'BUT': Can Large Models Comprehend Contradictory Humor Through Comparative Reasoning?","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-22T22:38:35.969273Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2503.23137"},"observation_digest":"sha256:5d897301dabb2ec29ee5e6317804c4c6b26122ae1dd218ba97782056b26432c1","observation_id":"9cec52b8-d6d1-4973-9769-01f4e119bf6b","resolution":{"observed_at":"2026-05-22T22:42:13.667706Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-07T11:11:58.311715Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03310","last_updated":"2025-06-03T18:50:22Z","snapshot_observed_at":"2026-08-09T13:29:47.612489Z","submitted_at":"2025-06-03T18:50:22Z","title":"The Reader is the Metric: How Textual Features and Reader Profiles Explain Conflicting Evaluations of AI Creative Writing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:11:58.311715Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2506.03310"},"observation_digest":"sha256:9fcdeddce93bf9f3684c5c4235b7e34ced7bdafba5901a04551a463d0b501359","observation_id":"143a904f-2d5f-4f5a-9e60-0ef3fc36568d","resolution":{"observed_at":"2026-08-07T11:11:58.311715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-07T04:56:45.220857Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09367","last_updated":"2025-06-11T03:27:50Z","snapshot_observed_at":"2026-08-09T00:54:46.611217Z","submitted_at":"2025-06-11T03:27:50Z","title":"COGENT: A Curriculum-oriented Framework for Generating Grade-appropriate Educational Content","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:56:45.220857Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2506.09367"},"observation_digest":"sha256:468b1ad2f7f43cd57abca5f8b010cd98971757adc9776d290a058b2d9436c60f","observation_id":"ce75d046-338e-4a26-8104-92b995978220","resolution":{"observed_at":"2026-08-07T04:56:45.220857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-07T00:23:21.956909Z","title":"ArXiv, abs/2006.14799","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.17294","last_updated":"2026-06-30T08:31:07Z","snapshot_observed_at":"2026-08-07T00:15:53.880399Z","submitted_at":"2025-06-17T07:04:51Z","title":"From Multimodal Perception to Strategic Reasoning: A Survey on AI-Generated Game Commentary","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:21.956909Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2506.17294"},"observation_digest":"sha256:e11ff6e8aa309c60ac1eb6cdd20c275f0f37cd6da30e2c7ab09b7e9bbed1f131","observation_id":"c300e68f-6016-4616-baa5-125b9b337477","resolution":{"observed_at":"2026-08-07T00:23:21.956909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2510.27106","last_updated":"2025-10-31T02:06:37Z","snapshot_observed_at":"2026-08-04T23:39:36.848150Z","submitted_at":"2025-10-31T02:06:37Z","title":"Rating Roulette: Self-Inconsistency in LLM-As-A-Judge Frameworks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T03:32:53.109030Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2510.27106"},"observation_digest":"sha256:24a4eecda708a28d580411d5817e158d1e8dc984355191621fb3841a6958e63a","observation_id":"50479774-0e37-4d24-9f6f-4533ae249535","resolution":{"observed_at":"2026-05-18T03:35:50.545027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-03T11:07:09.410983Z","title":"DeepSeek-AI, Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shirong Ma, Peiyi Wang, Xiao Bi, Xiaokang Zhang, Xingkai Yu, Yu Wu, Z","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2601.07648","last_updated":"2026-05-27T13:07:42Z","snapshot_observed_at":"2026-08-03T11:07:08.279581Z","submitted_at":"2026-01-12T15:27:58Z","title":"What Are We Measuring in NLG? A Meta-Analysis of Evaluation Trends 2020-2025","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T11:07:09.410983Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2601.07648"},"observation_digest":"sha256:ba59c8747f0c42a700e6cd961eada9ee653a263bfede23cc0753d3ea47e06ee8","observation_id":"007b65bd-009e-47b0-a59b-d46d02cf808c","resolution":{"observed_at":"2026-08-03T11:07:09.410983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-03T03:55:51.714813Z","title":"arXiv preprint arXiv:2006.14799","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2602.06625","last_updated":"2026-06-30T17:47:27Z","snapshot_observed_at":"2026-08-06T12:42:37.363282Z","submitted_at":"2026-02-06T11:35:32Z","title":"FairJudge: An Adaptive, Debiased, and Consistent LLM-as-a-Judge","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T03:55:51.714813Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2602.06625"},"observation_digest":"sha256:1e9adf70b953fe0942bf639540ae25fca365727affa6ac6bc72226a27baa705c","observation_id":"0e5a751a-a9a4-46ff-b9e6-e283b33d1e13","resolution":{"observed_at":"2026-08-03T03:55:51.714813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2602.09299","last_updated":"2026-04-15T23:56:38Z","snapshot_observed_at":"2026-08-08T05:40:45.883733Z","submitted_at":"2026-02-10T00:38:04Z","title":"Synthetic Reflections on Resource Extraction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T03:54:55.533944Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2602.09299"},"observation_digest":"sha256:fba2e1ffcea1a59cdc86479a96e98c87dbd7c763afe07dac5b34d5596e2ba1f9","observation_id":"88c2bb92-11a6-43dc-9004-87cb3914fba4","resolution":{"observed_at":"2026-05-16T03:57:15.853158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2603.13683","last_updated":"2026-07-31T13:23:46Z","snapshot_observed_at":"2026-08-06T08:27:28.683771Z","submitted_at":"2026-03-14T01:37:23Z","title":"Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T12:13:24.420641Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2603.13683"},"observation_digest":"sha256:762de4c6539ba2f66f8f9ace69fd5234c5318fc340e2d34b595a81deb020052c","observation_id":"617c7367-66b1-45de-9ff0-84e8271b4aa0","resolution":{"observed_at":"2026-05-15T12:15:34.545671Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-03T02:35:45.191487Z","title":"Sumanth Dathathri, Andrea Madotto, Janice Lan, Jane Hung, Eric Frank, Piero Molino, Jason Yosinski, and Rosanne Liu","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2603.13683","last_updated":"2026-07-31T13:23:46Z","snapshot_observed_at":"2026-08-06T08:27:28.683771Z","submitted_at":"2026-03-14T01:37:23Z","title":"Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T02:35:45.191487Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2603.13683"},"observation_digest":"sha256:8389d2002f5c6b3bb63462bf246eb45ecbbe4b0afb1601fc3f8a3465753f9c17","observation_id":"a7868629-76f9-46c2-b2f2-abefed8d414a","resolution":{"observed_at":"2026-08-03T02:35:45.191487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.05900","last_updated":"2026-04-07T14:05:17Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:05:17Z","title":"AICA-Bench: Holistically Examining the Capabilities of VLMs in Affective Image Content Analysis","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-10T19:22:08.306946Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.05900"},"observation_digest":"sha256:c287683a5248def09571cf4499cf8f51d56d6464a932d3a014283d9b5471e25a","observation_id":"7cba6b9d-5c4e-493e-bfd5-284663c2206d","resolution":{"observed_at":"2026-05-10T23:05:48.300289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.10741","last_updated":"2026-04-19T17:04:51Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:30:44Z","title":"Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:42:35.824427Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.10741"},"observation_digest":"sha256:c4944a74ae68365b08d3eb49ca483a8319031aecf13eb82c02d07e78fe3346a7","observation_id":"773ab666-1d23-4a4b-97ab-a14db984d069","resolution":{"observed_at":"2026-05-11T10:01:00.374583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.18955","last_updated":"2026-04-21T01:05:52Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T01:05:52Z","title":"Assessing Capabilities of Large Language Models in Social Media Analytics: A Multi-task Quest","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-10T03:20:12.777878Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.18955"},"observation_digest":"sha256:5072f8b7283a1cd8cc020732021991a6d3fa5e57099006ed9a5f1c396acd71ca","observation_id":"859b8115-85cd-4cde-98e8-3dd14d3159fd","resolution":{"observed_at":"2026-05-11T12:41:01.810530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.25482","last_updated":"2026-04-28T10:39:17Z","snapshot_observed_at":"2026-08-07T22:24:17.819786Z","submitted_at":"2026-04-28T10:39:17Z","title":"From World-Gen to Quest-Line: A Dependency-Driven Prompt Pipeline for Coherent RPG Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:22:33.542081Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.25482"},"observation_digest":"sha256:ba82a7500c50b11aa0699e380a342325070221ee9402d88f777c5f950b643676","observation_id":"3d0da929-fb2c-439d-8cba-fe3d48bdc309","resolution":{"observed_at":"2026-05-11T23:46:23.304340Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.04665","last_updated":"2026-05-09T22:09:59Z","snapshot_observed_at":"2026-07-06T23:17:23.641984Z","submitted_at":"2026-05-06T09:11:10Z","title":"Paraphrase-Induced Output-Mode Collapse: When LLMs Break Character Under Semantically Equivalent Inputs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T16:26:54.068997Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.04665"},"observation_digest":"sha256:32bdfa4e526730bfbc045a347f85b5d571e3ce3f22a5cec1ac25cad0e6e6b029","observation_id":"015d2145-0090-4c70-8c2a-e1b952ffb4b4","resolution":{"observed_at":"2026-05-11T18:16:07.273886Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.04665","last_updated":"2026-05-09T22:09:59Z","snapshot_observed_at":"2026-07-06T23:17:23.641984Z","submitted_at":"2026-05-06T09:11:10Z","title":"Paraphrase-Induced Output-Mode Collapse: When LLMs Break Character Under Semantically Equivalent Inputs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T02:13:48.672711Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.04665"},"observation_digest":"sha256:ac6a0d3f3d1d4326a605291d76f053a4eeba38e62408d726f6d1436d62853daf","observation_id":"f9c2670c-78e1-4163-ab12-bf5469935630","resolution":{"observed_at":"2026-05-12T02:16:16.112644Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.23244","last_updated":"2026-05-22T05:25:00Z","snapshot_observed_at":"2026-08-01T14:10:27.190441Z","submitted_at":"2026-05-22T05:25:00Z","title":"Convex Optimization for Alignment and Preference Learning on a Single GPU","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-25T05:01:31.560963Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.23244"},"observation_digest":"sha256:2368316f3b0f4d976e3f40eafb89acd1b62ebcd61aa91b87848365949c9d4921","observation_id":"b47a783a-d4fc-442d-b115-fc96af605418","resolution":{"observed_at":"2026-05-25T05:05:23.148540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.29897","last_updated":"2026-05-28T13:21:36Z","snapshot_observed_at":"2026-08-07T16:01:17.484753Z","submitted_at":"2026-05-28T13:21:36Z","title":"ExCAM: Explainable Cultural Awareness Metrics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T07:42:43.805674Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.29897"},"observation_digest":"sha256:b823ec27fa074acb8fdd88ea04038ead206d5cc99b4148cd702619c14eece16c","observation_id":"e88dd9d5-af7c-4532-8131-fb9a56f46150","resolution":{"observed_at":"2026-06-29T07:43:13.260618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.07936","last_updated":"2026-06-09T12:36:24Z","snapshot_observed_at":"2026-08-07T22:03:51.528110Z","submitted_at":"2026-06-06T01:55:56Z","title":"Illusions of the Gold Standard: A Large-scale Analysis of Human Evaluation Protocols for Long-form Text Generation","version":2},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-06-27T20:20:08.996005Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.07936"},"observation_digest":"sha256:204e0fadc9bc74d3aca6a9d2e0dd5831d330fce080563e9a9a58a0a0a7ad8c98","observation_id":"bbd39bfd-7cfe-46dc-b98d-a3dd669da1f9","resolution":{"observed_at":"2026-07-02T20:37:22.704121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":226,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:01e88c202d4a2c201acb68241e15313b8858744eefdefceba60159f595e7e397","observation_id":"24c20b2b-7a21-4c61-8d33-96d4d2031529","resolution":{"observed_at":"2026-06-30T22:15:05.717285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.19057","last_updated":"2026-06-17T13:26:04Z","snapshot_observed_at":"2026-08-07T01:21:32.666151Z","submitted_at":"2026-06-17T13:26:04Z","title":"Quantifying and Auditing LLM Evaluation via Positive--Unlabeled Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T19:04:45.062426Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.19057"},"observation_digest":"sha256:a30ed9dd134be5cf19ae6d68c80337ead8b4ea953659f52efcfc27a868398335","observation_id":"7692ee91-fc88-446a-b53a-8d491efa1769","resolution":{"observed_at":"2026-07-04T02:49:24.839875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":2},"reference_index":198,"source":"arxiv_source","source_observed_at":"2026-06-26T09:19:50.623741Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:f3d5a05859f912cda9ce30165d030e99d779a6d225401aa181735bfe5d4b85bd","observation_id":"f1743dbb-a58a-4bba-a85e-423bbb92f935","resolution":{"observed_at":"2026-07-04T09:59:44.750686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":3},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:19.195007Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:c09ce05860a5d8afc97eac42682a534709b6c5e3b6dba5940dd24ba3550fe211","observation_id":"b4d60861-c9df-42a0-8558-524570f03689","resolution":{"observed_at":"2026-07-01T18:55:59.679519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2607.00274","last_updated":"2026-06-30T23:48:15Z","snapshot_observed_at":"2026-07-07T00:05:59.073754Z","submitted_at":"2026-06-30T23:48:15Z","title":"SEFORA: Student Essays with Feedback Corpus and LLM Feedback Evaluation Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-02T18:48:09.531329Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.00274"},"observation_digest":"sha256:b2a1d1c48305b5028b1df82d2a1bf47b02f69e8f10ebedbd5bbda316fc0f960b","observation_id":"aea004cf-30af-4fc3-9326-98ba3f2ff614","resolution":{"observed_at":"2026-07-02T18:57:16.346686Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-07-11T17:13:44.985215Z","title":"Celikyilmaz, E","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.04563","last_updated":"2026-07-06T00:31:31Z","snapshot_observed_at":"2026-08-10T00:28:30.687831Z","submitted_at":"2026-07-06T00:31:31Z","title":"Fidelity-Diversity Metrics for Text","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T17:13:44.985215Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.04563"},"observation_digest":"sha256:9fd9f6d03646056bc76aa7e1484c385d4b60ae209f6b2fdc6f4012599122ed80","observation_id":"0c3d5759-7a87-45ce-a85c-37d305a1e334","resolution":{"observed_at":"2026-07-11T17:13:44.985215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-01T04:46:36.501877Z","title":"Preprint, arXiv:2006.14799","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.22456","last_updated":"2026-07-24T16:14:37Z","snapshot_observed_at":"2026-08-07T06:02:40.664351Z","submitted_at":"2026-07-24T16:14:37Z","title":"grapheme-kit: Grapheme-Level Metrics and Text Processing for Multilingual NLP","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T04:46:36.501877Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.22456"},"observation_digest":"sha256:ba61c08ed15a3142b03bf10511921e1cd5c71bfc1c302a97968bac486fb4745d","observation_id":"ca7c4a61-66e9-4aad-b528-250fd0392090","resolution":{"observed_at":"2026-08-01T04:46:36.501877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-01T01:52:41.469277Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25640","last_updated":"2026-07-28T12:26:55Z","snapshot_observed_at":"2026-08-08T02:49:45.524688Z","submitted_at":"2026-07-28T12:26:55Z","title":"LLM-as-a-Judge for Evaluating System Responses in Conversational Music Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T01:52:41.469277Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.25640"},"observation_digest":"sha256:8b25099e1c63b8fe89997b19cc06cf45cf585cb216d89fd01b44ea3fb9f2c9d0","observation_id":"d0aa5349-6573-4528-84e6-c435d6897b56","resolution":{"observed_at":"2026-08-01T01:52:41.469277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2006.14799/citation-record","integrity":"/paper/2006.14799/integrity","json":"/paper/2006.14799/citation-record.json","paper":"/paper/2006.14799"},"outbound":[],"paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2006.14799."}