{"as_of":"2026-08-08T07:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:157bf73a052cc06b5046925d8bdb756c092bec5f2a0ef56a5d3f5fa83938d90b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:27:34.047055Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T13:28:18.568194Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T13:03:18.765496Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2308.07201"},"observation_digest":"sha256:22072a665298fa39844016ebbefd3941104939e21030fceb771551716f5d9a47","observation_id":"4748c6e0-df3c-4d25-a780-8acaf550ed37","resolution":{"observed_at":"2026-05-13T13:03:18.843161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2505.16737","last_updated":"2026-04-23T08:31:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T14:52:10Z","title":"Secure LLM Fine-Tuning via Safety-Aware Probing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T13:07:09.402763Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2505.16737"},"observation_digest":"sha256:afecc6c57d1eabcbe1d18a0bd85f76b55d7392ef26fc66cc379de46282ac69a9","observation_id":"e641fbff-8315-4057-81d6-d7b574e2e94e","resolution":{"observed_at":"2026-05-22T13:11:35.885855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T14:50:39.845311Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17558","last_updated":"2025-05-23T07:05:09Z","snapshot_observed_at":"2026-08-07T21:43:16.805139Z","submitted_at":"2025-05-23T07:05:09Z","title":"Teaching with Lies: Curriculum DPO on Synthetic Negatives for Hallucination Detection","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:50:39.845311Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2505.17558"},"observation_digest":"sha256:f565d41a13619a726dd8a1dcdd2749defd4dccee912d58e92eaa7ed797ccd78c","observation_id":"c1d45d57-7267-4b9a-9917-1c0c43ed79b8","resolution":{"observed_at":"2026-08-07T14:50:39.845311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T14:35:03.812275Z","title":", Das, D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18464","last_updated":"2025-05-24T02:07:32Z","snapshot_observed_at":"2026-08-07T18:04:52.579875Z","submitted_at":"2025-05-24T02:07:32Z","title":"From Reddit to Generative AI: Evaluating Large Language Models for Anxiety Support Fine-tuned on Social Media Data","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:35:03.812275Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2505.18464"},"observation_digest":"sha256:d7d3f1f46b0f569f14c40eaa56d3b31822982b1000a3de720b350eb49b91dda7","observation_id":"8abaae69-2244-44d3-836c-e249d9e61625","resolution":{"observed_at":"2026-08-07T14:35:03.812275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T11:23:43.738463Z","title":"Bleurt: Learning robust metrics for text generation,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02696","last_updated":"2025-06-03T09:44:28Z","snapshot_observed_at":"2026-08-07T11:15:44.312106Z","submitted_at":"2025-06-03T09:44:28Z","title":"Shaking to Reveal: Perturbation-Based Detection of LLM Hallucinations","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:23:43.738463Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.02696"},"observation_digest":"sha256:75060ed8f8b5155d76684f98e2b76a6a75569d34242e2dce9979a1cfd053938b","observation_id":"cc69d0a9-6165-46c7-a44f-931163779e6d","resolution":{"observed_at":"2026-08-07T11:23:43.738463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T10:31:58.726456Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-07T21:42:43.455377Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.726456Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:0564f89da2ab354a979b78ee537b90abef6308811986c2c64f3959d746a80e39","observation_id":"7146a338-e57b-45a4-b569-ff02429e57e1","resolution":{"observed_at":"2026-08-07T10:31:58.726456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T05:42:38.740034Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.07440","last_updated":"2025-06-09T05:33:28Z","snapshot_observed_at":"2026-08-07T21:40:46.271523Z","submitted_at":"2025-06-09T05:33:28Z","title":"Federated In-Context Learning: Iterative Refinement for Improved Answer Quality","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:42:38.740034Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.07440"},"observation_digest":"sha256:f1dd470fe07c3e8ee9ab5bb7ea4879abad1d70af4466761874d46bce22611a41","observation_id":"15cac342-1ad2-4f07-87aa-8ba3e0230c58","resolution":{"observed_at":"2026-08-07T05:42:38.740034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T04:42:02.689211Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T21:40:47.909630Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.689211Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:0f246fcbe51f2c73ae64fd0a34e4eddfa47dc2d01e8d4a4e466dcb2a73296541","observation_id":"3d5da4d0-b840-4da3-a59f-969e4b5f2476","resolution":{"observed_at":"2026-08-07T04:42:02.689211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T04:29:46.327486Z","title":"& Parikh, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.21567","last_updated":"2025-07-01T19:14:32Z","snapshot_observed_at":"2026-08-07T21:43:51.478008Z","submitted_at":"2025-06-12T09:11:26Z","title":"BioPars: A Pretrained Biomedical Large Language Model for Persian Biomedical Text Mining","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:46.327486Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.21567"},"observation_digest":"sha256:4f7045b3595430138dd314b487df63bf50eb93ffd42cf3a67354c2503838a60a","observation_id":"c7b411a6-e578-450d-9441-c3438dc892d6","resolution":{"observed_at":"2026-08-07T04:29:46.327486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T20:39:09.350124Z","title":"BLEURT: Learning robust metrics for text generation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03033","last_updated":"2025-07-03T01:51:49Z","snapshot_observed_at":"2026-08-07T21:42:47.073261Z","submitted_at":"2025-07-03T01:51:49Z","title":"Preserving Privacy, Increasing Accessibility, and Reducing Cost: An On-Device Artificial Intelligence Model for Medical Transcription and Note Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:39:09.350124Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.03033"},"observation_digest":"sha256:512b3f7781199fb4eebe8bce16729e8f9472dab56c5953194135d122e691d524","observation_id":"531449bd-5594-4489-b6d9-a368e974c07b","resolution":{"observed_at":"2026-08-06T20:39:09.350124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T18:23:31.866770Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08459","last_updated":"2025-07-11T10:02:21Z","snapshot_observed_at":"2026-08-07T21:41:40.177971Z","submitted_at":"2025-07-11T10:02:21Z","title":"Diagnosing Failures in Large Language Models' Answers: Integrating Error Attribution into Evaluation Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:23:31.866770Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.08459"},"observation_digest":"sha256:916af0e84137ef6cb09da653c0775df215ac9e1be2507927f7464f9b600d1c5d","observation_id":"cf087154-cc14-41c2-9010-7e91381fee32","resolution":{"observed_at":"2026-08-06T18:23:31.866770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T17:38:26.260688Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10306","last_updated":"2025-07-14T14:09:36Z","snapshot_observed_at":"2026-08-08T04:42:24.582662Z","submitted_at":"2025-07-14T14:09:36Z","title":"Contrastive Pretraining with Dual Visual Encoders for Gloss-Free Sign Language Translation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:26.260688Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.10306"},"observation_digest":"sha256:d5aa5a8d3428ded923034f136e7b07b4acb6c3f4ed627dde5fbd29b7dbe3eaa5","observation_id":"96b25d36-b084-4fa1-b2d8-fd095ae79f24","resolution":{"observed_at":"2026-08-06T17:38:26.260688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T14:52:43.086257Z","title":"Bleurt: Learning robust metrics for text generation.arXiv preprint arXiv:2004.04696, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-06T19:59:57.844828Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.086257Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:e797e252d0519dc432765ac9eb83c244f556418d5c91740e1d542fb053374d5d","observation_id":"f2ea7918-8e3f-4ba1-b3bb-08b825cf6a36","resolution":{"observed_at":"2026-08-06T14:52:43.086257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-05T16:25:19.860298Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.18636","last_updated":"2026-06-10T06:33:48Z","snapshot_observed_at":"2026-08-07T21:41:25.682079Z","submitted_at":"2025-08-26T03:25:49Z","title":"LaQual: An Automated Framework for LLM App Quality Evaluation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T16:25:19.860298Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2508.18636"},"observation_digest":"sha256:1ca96b7961e1f008624f2c4b3c283ee3d348fc54096f6057b6c06ba3fd0c3e5f","observation_id":"a60ece5c-845a-4e46-bbb4-36f0a2e19cf3","resolution":{"observed_at":"2026-08-05T16:25:19.860298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-05T15:43:40.909985Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19580","last_updated":"2025-08-27T05:26:36Z","snapshot_observed_at":"2026-08-07T21:40:47.256343Z","submitted_at":"2025-08-27T05:26:36Z","title":"ArgCMV: An Argument Summarization Benchmark for the LLM-era","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T15:43:40.909985Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2508.19580"},"observation_digest":"sha256:6b80f94b216c0e48b5e1347c3d48c42c640b42adff8c51999b84dabb9dcf8953","observation_id":"ad36b03d-27b5-4a72-a015-b029487b2161","resolution":{"observed_at":"2026-08-05T15:43:40.909985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-04T23:35:04.226541Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09714","last_updated":"2025-09-08T11:00:18Z","snapshot_observed_at":"2026-08-07T21:41:24.128901Z","submitted_at":"2025-09-08T11:00:18Z","title":"How Small Transformation Expose the Weakness of Semantic Similarity Measures","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T23:35:04.226541Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2509.09714"},"observation_digest":"sha256:50773fd12d599d0afeafebc43cd14d1b5b3eb5ebd1e5f3c59a2e63cc526fe8ff","observation_id":"74ae44ef-0794-4b9c-ae4a-fddaf8dfc278","resolution":{"observed_at":"2026-08-04T23:35:04.226541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2512.15907","last_updated":"2026-04-21T01:06:33Z","snapshot_observed_at":"2026-07-06T22:39:23.633419Z","submitted_at":"2025-12-17T19:20:20Z","title":"TabReX : Tabular Referenceless eXplainable Evaluation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T21:24:44.941536Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2512.15907"},"observation_digest":"sha256:ef23c2ea0d4f4e5408def45074c54298d51bbc12118647a0d7ddbd8f3b23d067","observation_id":"eaf1a47d-1aab-4f24-9415-c1ccb5c31bf4","resolution":{"observed_at":"2026-05-16T21:28:34.066805Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2512.24366","last_updated":"2026-05-15T13:16:52Z","snapshot_observed_at":"2026-07-06T22:40:23.205898Z","submitted_at":"2025-12-30T17:25:15Z","title":"On the Factual Consistency of Text-based Explainable Recommendation Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T15:45:20.394551Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2512.24366"},"observation_digest":"sha256:af856fdf3cdad2bb8ae71892385fb9423dbfb3400d7fa271437b5d630a546bfb","observation_id":"cea93c32-3842-4d25-ac0c-82dba72e5fe8","resolution":{"observed_at":"2026-05-21T15:50:19.414438Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-03T06:46:26.342276Z","title":"Bleurt: Learning robust metrics for text generation.arXiv preprint arXiv:2004.04696, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2601.22025","last_updated":"2026-06-09T23:57:32Z","snapshot_observed_at":"2026-08-07T21:40:38.906811Z","submitted_at":"2026-01-29T17:32:34Z","title":"When Generic Prompt Improvements Hurt: Evaluation-Driven Iteration for LLM Applications","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:26.342276Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2601.22025"},"observation_digest":"sha256:5a4ecfdcea6b28a04ff20ebb050e5bb2977046051179df079264003a9ea5fd6d","observation_id":"c8b1f316-d9e5-45ad-af54-0cc5541e8488","resolution":{"observed_at":"2026-08-03T06:46:26.342276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.03666","last_updated":"2026-04-04T09:35:05Z","snapshot_observed_at":"2026-08-02T16:25:21.146703Z","submitted_at":"2026-04-04T09:35:05Z","title":"MMP-Refer: Multimodal Path Retrieval-augmented LLMs For Explainable Recommendation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T17:28:28.480792Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.03666"},"observation_digest":"sha256:4ba0e5cd1fed41fb17c2010b9a4a24e7819ecdfc022da849a9ff042e93acc5d9","observation_id":"b8193dd6-cd75-4ed3-bd60-ec4bec786bcd","resolution":{"observed_at":"2026-05-13T17:33:02.624066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.03724","last_updated":"2026-06-25T13:28:29Z","snapshot_observed_at":"2026-07-13T12:26:55.346804Z","submitted_at":"2026-04-04T13:01:45Z","title":"Rank, Don't Generate: Statement-level Ranking for Explainable Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T17:28:37.922342Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.03724"},"observation_digest":"sha256:15bc37fbfc130cb07c0005ba1d56253d8ea266e82e035a97bcf9ce75065fc7ee","observation_id":"d7e2c477-f15d-4e71-b780-edce5a8353b2","resolution":{"observed_at":"2026-05-13T17:33:02.593278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.10470","last_updated":"2026-04-12T05:49:37Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T05:49:37Z","title":"From Query to Counsel: Structured Reasoning with a Multi-Agent Framework and Dataset for Legal Consultation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:54:53.603591Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.10470"},"observation_digest":"sha256:d5aa3c09677221132c3692d187d6909f4d1b66c546e288c302d42d7562bf45cc","observation_id":"b0f3b587-3df3-47b9-9161-e0bebb062aa6","resolution":{"observed_at":"2026-05-11T09:36:12.965564Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.17200","last_updated":"2026-04-19T02:04:14Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T02:04:14Z","title":"Calibrating Model-Based Evaluation Metrics for Summarization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T06:36:55.334742Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.17200"},"observation_digest":"sha256:761b392805b08d956ba01e1e4a82d4b633053ccc65e90a8932eabf40e166653a","observation_id":"4be422e9-e4ab-4220-9a0c-38f850a9f6ab","resolution":{"observed_at":"2026-05-10T06:41:36.937721Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.20334","last_updated":"2026-04-22T08:30:15Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:30:15Z","title":"An Explainable Approach to Document-level Translation Evaluation with Topic Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T23:11:59.716468Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.20334"},"observation_digest":"sha256:7de1f4a131005be1c262c28c598bce5f1890e84dab444060dedf51fbf4d4921d","observation_id":"2cfb4fc8-9479-4ca2-945f-003181474048","resolution":{"observed_at":"2026-05-11T14:11:06.101358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2605.05902","last_updated":"2026-05-07T09:14:46Z","snapshot_observed_at":"2026-08-02T04:28:51.680521Z","submitted_at":"2026-05-07T09:14:46Z","title":"Evaluating Non-English Developer Support in Machine Learning for Software Engineering","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-08T09:13:24.365852Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2605.05902"},"observation_digest":"sha256:aa0f8e0a85811d6003c1a5b3bc309f51be0017e739c97213522bb88537f1224e","observation_id":"73d497f4-c305-4a16-b118-66c0be8c6b3f","resolution":{"observed_at":"2026-05-11T20:26:09.484138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2606.12198","last_updated":"2026-07-15T16:08:17Z","snapshot_observed_at":"2026-08-02T11:48:18.513417Z","submitted_at":"2026-06-10T15:18:32Z","title":"LLM-Based User Personas for Recommendations at Scale","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T08:07:27.059673Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2606.12198"},"observation_digest":"sha256:e95ca5ec5f0e15698226a39a39b18f49575948e076584f1e8ee1fd2da26e4517","observation_id":"2199a87b-f254-4d2d-8ad9-0e1e54d1157e","resolution":{"observed_at":"2026-07-03T13:28:18.569695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-02T11:48:20.628483Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.12198","last_updated":"2026-07-15T16:08:17Z","snapshot_observed_at":"2026-08-02T11:48:18.513417Z","submitted_at":"2026-06-10T15:18:32Z","title":"LLM-Based User Personas for Recommendations at Scale","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:48:20.628483Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2606.12198"},"observation_digest":"sha256:73b310dd439b2321d6120fd3b88711e9c29673c57436ed91452c82645298843a","observation_id":"be8025a3-ef3f-4b10-90b5-46bfdb523378","resolution":{"observed_at":"2026-08-02T11:48:20.628483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-08T04:27:34.047055Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02975","last_updated":"2026-08-04T00:24:06Z","snapshot_observed_at":"2026-08-08T04:20:49.460158Z","submitted_at":"2026-08-04T00:24:06Z","title":"TQLite: Multi-LLM Jury Guided Distillation for Real-time MQM Translation Quality Evaluation","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-08T04:27:34.047055Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2608.02975"},"observation_digest":"sha256:cd0be1f152b69588cc74ee30103550d5f73885e96ae193efdff79b822bd3fe4a","observation_id":"a3d58939-6ea6-4f89-91f3-e7be978f9b63","resolution":{"observed_at":"2026-08-08T04:27:34.047055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2004.04696/citation-record","integrity":"/paper/2004.04696/integrity","json":"/paper/2004.04696/citation-record.json","paper":"/paper/2004.04696"},"outbound":[],"paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:40:07.699138Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2004.04696."}