{"as_of":"2026-08-07T20:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d57353d3208c2f23256b40e4a5aa77477e1f6be237acf800a611a038de2afd3","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:39:46.437057Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:43:28.645576Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:43:29.626729Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"cited_work":{"arxiv_id":"2506.01689","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.01689","snapshot_observed_at":"2026-08-06T14:43:29.626729Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","venue":"cs.AI","work_id":"06e99de3-85a3-4fed-b6f2-0a0d3a31584e","year":2025},"citing_paper":{"arxiv_id":"2507.18107","last_updated":"2025-07-24T05:37:08Z","snapshot_observed_at":"2026-08-06T14:36:17.487067Z","submitted_at":"2025-07-24T05:37:08Z","title":"T2VWorldBench: A Benchmark for Evaluating World Knowledge in Text-to-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:28.645576Z"},"links":{"cited_paper":"/paper/2506.01689","citing_paper":"/paper/2507.18107"},"observation_digest":"sha256:cadeb2936f841d938c9f26ff534a986c6b87e96bdd3787055075bd2437d37b1c","observation_id":"4130ca2c-7267-4061-9698-8a788c1bc156","resolution":{"observed_at":"2026-08-06T14:43:29.751683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01689/citation-record","integrity":"/paper/2506.01689/integrity","json":"/paper/2506.01689/citation-record.json","paper":"/paper/2506.01689"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.222036Z","title":null,"venue":null,"work_id":"5ddbcfef-899f-4ccf-9802-66c9e855f9dd","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:45.253734Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:eef18f8f035912c9ee24a11bd1af4f5a803e10663120b8b387902c47c7ee6fcd","observation_id":"b86177d9-ff2f-47ec-8484-167ded7dfe1f","resolution":{"observed_at":"2026-08-07T11:39:52.294739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.073572Z","title":"# Instructions Return 1 if the query would be better answered via a video","venue":null,"work_id":"9b78b9af-cf99-4293-a218-e1c4042ca7a9","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:46.163771Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:74c3dfa5dddb9d1c608c18669042269fa7599c9c72d638f828765618254d0067","observation_id":"51627db5-b688-460b-8bd0-8c325f8ead85","resolution":{"observed_at":"2026-08-07T11:39:52.148472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:47.502085Z","title":"how sun makes energy?","venue":null,"work_id":"a4540912-d3aa-46d4-94e2-a4fbc60b9fe9","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:49.905333Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:4369b493e56a1b903aa8f6697e68acc6e0b7063531bda3ee15d16b85ca361a03","observation_id":"940753fc-c80c-49e2-a904-4da2c1ac2652","resolution":{"observed_at":"2026-08-07T11:39:47.676238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:47.309307Z","title":"Pretend you are Spiderman and wish me for my birthday","venue":null,"work_id":"0c3eda54-c3f0-4650-b0c0-224fda19198f","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:51.028758Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:da92f23ea7a750c9eb10d4d7aa4692ace8ebf229d28331c0e9217135ef7ef020","observation_id":"d9f69d13-5522-4e00-8333-ac89e10fddf1","resolution":{"observed_at":"2026-08-07T11:39:47.435658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:51.851446Z","title":"generate a unique design of LED light for house","venue":null,"work_id":"d53383fc-cd65-4e2d-a97a-0ce41262e0d2","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:48.144699Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:0b2d4af9335cc1fb433a4b27bdd93e73d2c7eec21411fdd0117cee5c61ec186d","observation_id":"31449b22-1b9b-4933-b99b-85f1df142ddd","resolution":{"observed_at":"2026-08-07T11:39:51.935838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:49.599752Z","title":"How do i clean my water bottle if i can’t reach down into it","venue":null,"work_id":"1de210c8-3a7b-4cd3-b790-436dd2f287c9","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:49.613122Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:f01dca0a8561984fb2738a9cfe16fde2876135593e152ea478031548f20e166f","observation_id":"2df94ebe-c682-4b7d-b15d-02b492c8c77c","resolution":{"observed_at":"2026-08-07T11:39:51.728405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.967471Z","title":null,"venue":null,"work_id":"048d6911-3778-41c5-9cc5-d670fd0d4f5e","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:53.660326Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:42dd88c6b67daf018c6ab0e39dc107745dbf0500cecefcbaac7305c0e4903913","observation_id":"9212637f-098f-460f-b166-262e3e1893da","resolution":{"observed_at":"2026-08-07T11:39:47.127575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.891093Z","title":"Coherence This metric measures whether the development process or steps of the response video content are logical and consistent and whether the consistency is reasonable","venue":null,"work_id":"66b6fac1-fbae-48bb-8d9b-26e4072dd3bc","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.244006Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:4f5c1327d8a9bafa399bbc920f96d046bb5340eeb7304452b589218f0c4bab2f","observation_id":"0896a4f5-bd71-4999-b343-a67a6df6fbd7","resolution":{"observed_at":"2026-08-07T11:39:46.937115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.743792Z","title":null,"venue":null,"work_id":"7e02a711-5782-4405-8b21-fda0d483f70f","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.339930Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:925c70b75ccf7df885a0c1c75104f6735abbf9901c6fdfbdc8ad9b6c5d36f3a1","observation_id":"c8663f44-6434-4046-ad5a-5bc758cd39c6","resolution":{"observed_at":"2026-08-07T11:39:46.816856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.585056Z","title":"12 The prompt template for our LLM-as-a-Judge evaluation","venue":null,"work_id":"0959f632-af6f-4378-b619-c3c9739c0311","year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.437057Z"},"links":{"citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:9728dc1d946c176188a31df6bd5928edecf0253d8302843db00f47b18d347007","observation_id":"fde0b0e6-52e8-4c04-817d-9cd989f0ba61","resolution":{"observed_at":"2026-08-07T11:39:46.654283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T11:38:43.683263Z","title":"In NeurIPS","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:43.683263Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:47c1c17ea0ca7e870a05399da324eb2316cbc397290a95772cef3464ef173290","observation_id":"ee7d7d57-a076-4a88-bb9b-f47e28074631","resolution":{"observed_at":"2026-08-07T11:38:43.683263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T11:38:44.169705Z","title":"Explain how to tie a knot","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:44.169705Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.01689"},"observation_digest":"sha256:f7971dd0c2bdb1504e93af8102d269fe3f47b479fec016fce02e1a5be0c3e918","observation_id":"b5dc87a4-8b79-448f-a16d-428ddba39ba4","resolution":{"observed_at":"2026-08-07T11:38:44.169705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01689","last_updated":"2025-06-02T13:52:21Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:33:24.365181Z","submitted_at":"2025-06-02T13:52:21Z","title":"Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2506.01689."}