{"as_of":"2026-08-12T06:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a508a5db27fc81804f2509276e08511232931d8861973590962d5e753344aa1","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:53:12.394002Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.19906/citation-record","integrity":"/paper/2412.19906/integrity","json":"/paper/2412.19906/citation-record.json","paper":"/paper/2412.19906"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.280383Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.280383Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:185508a474919bce88ed55fccd933520347fd6438cedeed574bcafec340deb7b","observation_id":"09d6967d-e4b2-49a8-9014-2992e10679b6","resolution":{"observed_at":"2026-08-10T23:53:12.280383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.287039Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.287039Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:a5bd8f00bea938378713ea3a71a198375ba9f109ec4d8c2151bf96ff9c5b5728","observation_id":"edd8a681-df6b-4adc-b1df-dfdb9753f5ff","resolution":{"observed_at":"2026-08-10T23:53:12.287039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07201","snapshot_observed_at":"2026-08-10T23:53:12.292844Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.292844Z"},"links":{"cited_paper":"/paper/2308.07201","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:a798cc8f9e4a42aa563e50c4b187f2bed6a6bf671e2d137af75d7f77845a0062","observation_id":"62c29abc-1bbe-4b85-840a-51c642a2cad3","resolution":{"observed_at":"2026-08-10T23:53:12.292844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04335","last_updated":"2023-11-07T20:38:30Z","snapshot_observed_at":"2026-08-11T19:41:49.497092Z","submitted_at":"2023-11-07T20:38:30Z","title":"Sub-Sentence Encoder: Contrastive Learning of Propositional Semantic Representations","version":1},"cited_work":{"arxiv_id":"2311.04335","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.04335","snapshot_observed_at":"2026-08-10T23:53:12.638039Z","title":"Sub-Sentence Encoder: Contrastive Learning of Propositional Semantic Representations","venue":"cs.CL","work_id":"73b88866-aecf-4e13-83cf-bcf9061eccc8","year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.299906Z"},"links":{"cited_paper":"/paper/2311.04335","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:ed2e57d19eba32a1b13b73e98b91e6da31cb4b562e0449e9f6fe92c680795875","observation_id":"8fd6161e-92e6-4b54-886b-d21cd3bd188d","resolution":{"observed_at":"2026-08-10T23:53:12.645299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.305206Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.305206Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:42daec64e5171dcbf16be28847f2c2cc844716162c0f412efec0077179ddf0f9","observation_id":"f1aff3ac-44e7-48e3-8439-efadec54f4d7","resolution":{"observed_at":"2026-08-10T23:53:12.305206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01383","last_updated":"2025-05-14T06:05:53Z","snapshot_observed_at":"2026-08-08T11:17:56.985482Z","submitted_at":"2024-02-02T13:06:35Z","title":"LLM-based NLG Evaluation: Current Status and Challenges","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01383","snapshot_observed_at":"2026-08-10T23:53:12.310589Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.310589Z"},"links":{"cited_paper":"/paper/2402.01383","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:c023da6aa328a429c59563f17c89a4c4321eb5a6d826191fa88da74f213060ac","observation_id":"3b662229-9e95-4331-8a80-2d3f7095c050","resolution":{"observed_at":"2026-08-10T23:53:12.310589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02554","last_updated":"2023-04-05T16:17:32Z","snapshot_observed_at":"2026-08-10T04:48:52.341807Z","submitted_at":"2023-04-05T16:17:32Z","title":"Human-like Summarization Evaluation with ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02554","snapshot_observed_at":"2026-08-10T23:53:12.315657Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.315657Z"},"links":{"cited_paper":"/paper/2304.02554","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:ae4ebfdbbff3bab9dfd4a2dd01aaff2f9f68af9b81908f33380ceec2f97afabd","observation_id":"7cc52690-f493-4d43-a8c7-af83d051adaa","resolution":{"observed_at":"2026-08-10T23:53:12.315657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08960","last_updated":"2019-08-23T18:00:38Z","snapshot_observed_at":"2026-08-10T16:48:16.959873Z","submitted_at":"2019-08-23T18:00:38Z","title":"Neural Text Summarization: A Critical Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08960","snapshot_observed_at":"2026-08-10T23:53:12.320837Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.320837Z"},"links":{"cited_paper":"/paper/1908.08960","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:2c6eb5ad24ff56a9b22503b2fab443f876c2455db4314f1d0248f58f8e67c0d3","observation_id":"a4732058-63bf-414b-928e-1d96b5973fd8","resolution":{"observed_at":"2026-08-10T23:53:12.320837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.326455Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.326455Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:48f8221ede36d40e9c038dfe60880e1d2951f8dddce789b66c74462da9810aac","observation_id":"a3b42d6a-3b3e-48a3-82aa-5473911fb4f2","resolution":{"observed_at":"2026-08-10T23:53:12.326455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.331031Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.331031Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:bb132c9f6b7ad7cfd14e581b59f4b09e1373ec9dff1ffeb3cd2ed9a3dd914a9e","observation_id":"3e457e3e-7557-4615-9d31-cabd51a88449","resolution":{"observed_at":"2026-08-10T23:53:12.331031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14251","last_updated":"2023-10-11T05:27:50Z","snapshot_observed_at":"2026-08-01T16:29:58.693560Z","submitted_at":"2023-05-23T17:06:00Z","title":"FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14251","snapshot_observed_at":"2026-08-10T23:53:12.336116Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.336116Z"},"links":{"cited_paper":"/paper/2305.14251","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:b3b5e15135f2cb471c2ae469ab860fe704da0a4ee4ce0e628235962c6a4e0434","observation_id":"3bd7b191-c639-4401-9516-c0e4cd3135de","resolution":{"observed_at":"2026-08-10T23:53:12.336116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.341299Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.341299Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:7753a032eaba7c70c4099ce2f906a06d8378a104d40461b4291f2320092b7594","observation_id":"b108df9f-5809-4f25-a7ed-832b49fffc32","resolution":{"observed_at":"2026-08-10T23:53:12.341299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-11T03:52:23.089618Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-10T23:53:12.345574Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.345574Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:d685542e76bbf4ff9c80023b18f7723e51c13f15a1be3773e7dcb903773f0d64","observation_id":"eeea721b-332f-47bd-b9a5-6a3963aa821d","resolution":{"observed_at":"2026-08-10T23:53:12.345574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-08T03:32:23.667881Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-10T23:53:12.350512Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.350512Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:9c2a0b59400260848c02e326d6c3f6319d4e8242dc08cf47ec27f2014027760e","observation_id":"da518ba1-ade8-4527-b21c-ac1c2930abd0","resolution":{"observed_at":"2026-08-10T23:53:12.350512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-10T23:53:12.355340Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.355340Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:5b7bb1dc21ceb8479a602a295270298defbd46b3850beeb9a09338ba329bc899","observation_id":"de88caad-8600-4a18-ab27-baae8e9fa438","resolution":{"observed_at":"2026-08-10T23:53:12.355340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18802","last_updated":"2024-11-07T03:14:38Z","snapshot_observed_at":"2026-08-10T22:03:14.969503Z","submitted_at":"2024-03-27T17:48:55Z","title":"Long-form factuality in large language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18802","snapshot_observed_at":"2026-08-10T23:53:12.361255Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.361255Z"},"links":{"cited_paper":"/paper/2403.18802","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:e44961db5a628a7708061b762f5d99042c605aa7b3e9f191cfd9b6a73eae2ea5","observation_id":"eb5678ae-067b-4754-9ba4-46a0538a337e","resolution":{"observed_at":"2026-08-10T23:53:12.361255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18201","last_updated":"2023-05-29T16:54:24Z","snapshot_observed_at":"2026-08-12T02:32:06.342322Z","submitted_at":"2023-05-29T16:54:24Z","title":"A Critical Evaluation of Evaluations for Long-form Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18201","snapshot_observed_at":"2026-08-10T23:53:12.366205Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.366205Z"},"links":{"cited_paper":"/paper/2305.18201","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:8d5ce288dfdde08d9e226e21f3e1209c3bd99c9835ae342fab49cd2b65880fb0","observation_id":"dd22d5f3-01bd-43de-b093-86a43ce39373","resolution":{"observed_at":"2026-08-10T23:53:12.366205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.840154Z","title":null,"venue":null,"work_id":"f4e7064f-7315-4bc0-9359-ef444a62d80f","year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.371311Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:21edd64d3ab738cc1565d1e6243f550c5174f9119dc3014c932472589a1d3b68","observation_id":"94682877-b445-4ede-bdfb-2b6d20eecd08","resolution":{"observed_at":"2026-08-10T23:53:12.844890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:53:12.375481Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.375481Z"},"links":{"citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:bbabe4b69ee07c737760f7ed0e11ba563920a9c64c747cf27cf55412bc54da24","observation_id":"5e6210f7-ae7a-4871-848c-fbee5906f1e3","resolution":{"observed_at":"2026-08-10T23:53:12.375481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-10T23:53:12.379736Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.379736Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:da8ea8d64ce96feda45e5518296ad83bfc0c43845a5b66bb3352b965bbd8a551","observation_id":"0f7c81f3-6766-48dd-a70a-d1b1b8852a82","resolution":{"observed_at":"2026-08-10T23:53:12.379736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02622","last_updated":"2019-09-26T09:56:23Z","snapshot_observed_at":"2026-08-09T20:07:28.699866Z","submitted_at":"2019-09-05T20:26:44Z","title":"MoverScore: Text Generation Evaluating with Contextualized Embeddings and Earth Mover Distance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02622","snapshot_observed_at":"2026-08-10T23:53:12.384608Z","title":"Meyer, and Steffen Eger","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.384608Z"},"links":{"cited_paper":"/paper/1909.02622","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:d53da5ba5f91fdc2a7564c7d1ad6ab73c63376adea4968f0bb5366424955e89b","observation_id":"3782a619-4b3d-4e3e-bf73-ea13ca4d4df6","resolution":{"observed_at":"2026-08-10T23:53:12.384608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-10T23:53:12.389453Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.389453Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:9e92d5e71d59b9aa21088b4a0093172cc088c536e7e9d477d2c2877048c87b54","observation_id":"345d4e63-7724-4fbe-bc18-82ebe7f1010a","resolution":{"observed_at":"2026-08-10T23:53:12.389453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07197","last_updated":"2022-10-13T17:17:03Z","snapshot_observed_at":"2026-07-06T14:04:51.277045Z","submitted_at":"2022-10-13T17:17:03Z","title":"Towards a Unified Multi-Dimensional Evaluator for Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07197","snapshot_observed_at":"2026-08-10T23:53:12.394002Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.394002Z"},"links":{"cited_paper":"/paper/2210.07197","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:88512cfc8ad4138bfc78f397eb065313de3fc55b8240b37bece0418e0b19565f","observation_id":"4b9f8c6a-269b-46c6-a879-dd7dfe9903dd","resolution":{"observed_at":"2026-08-10T23:53:12.394002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2412.19906."}