{"as_of":"2026-08-06T08:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86a7df09e371c9acc70f268ae7a07a308b9a203a467e38819735fdedc51aef49","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T06:04:21.699055Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.12899/citation-record","integrity":"/paper/2606.12899/integrity","json":"/paper/2606.12899/citation-record.json","paper":"/paper/2606.12899"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"From specialist to large models: A paradigm evolution towards semantic-aware mimo,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:b2f297007b49f310ecab9ec511ea398a1df77eebc196d825b9eb734b4ded4c37","observation_id":"78921f39-c812-4f68-ad33-1a817ac7faec","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Generative video semantic communication via multimodal semantic fusion with large model,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:c22154dd27d64c5899bfb815ce51dd0051a7048dc37c8c9673bff35c92845cfb","observation_id":"83fc7c3a-2e33-4c98-a820-a3aa62485245","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Wireless deep video semantic transmission,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:ee9db14d525b17b5edf20a8ed938505e0e1f1f20ffd4272fa2c6594abd14f64f","observation_id":"239aff9c-f7da-4d2f-b6b7-fa22a30e5e9c","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Multimodal semantic communication for generative audio-driven video conferenc- ing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:e651c2620e2fdb27ff740762f3991babc2cb8f37f864ae34ea0bb6dda91a8e77","observation_id":"2fc0c4f3-a7cc-47f0-8c5a-a3a43fd8e539","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Videoqa-sc: Adaptive semantic communication for video question answering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:11e5e18105ec99eef5fb93aa1d9159cb397dde4c63ac5b4dc336286ef0078b5c","observation_id":"a8deffd9-b4b6-4924-b8ce-dfa3383fabf2","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Token communications: A large model-driven framework for cross-modal context-aware semantic communications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:04717a1f3d0f3b8440ba7c0f2d66a6b1811c0f0dcc1a42f87d7cb3c0167b9418","observation_id":"8d3ccc5e-ac83-4c42-a60b-723a4fd339cd","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.15109","doi":"10.48550/arxiv.2512.15109","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large model enabled embodied intelligence for 6g integrated perception, communication, and computation network","venue":"ArXiv.org","work_id":"c4b14511-33cd-42b0-a279-39357fac6650","year":2025},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:3c32fc3c767d63f427f5e10c16dede68bfc2e1e9f814a778db6746da0d8b09f3","observation_id":"21b60e4a-2f12-452a-9a19-503064754e10","resolution":{"observed_at":"2026-07-03T16:08:37.717523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":"2402.17177","doi":"10.48550/arxiv.2402.17177","metadata_source":"pith","pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","venue":"cs.CV","work_id":"49aeafea-5763-4b8e-aff4-8fa617aacb1f","year":2024},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:add82d97804a6ee4eec88592266f09551b05ce8790441f9ff69f020f87e8e14b","observation_id":"0add877f-e306-488a-a3d0-50c3ef4f4ca0","resolution":{"observed_at":"2026-07-03T16:08:37.720232Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Latency-aware generative semantic communications with pre-trained diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:8375b701c17783247f1b0f36aa9403634248702cbd3117c3422618bcdac0a27d","observation_id":"c290b9d0-4801-4d78-bd4d-306337f9a4a4","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Nonlin- ear transform source-channel coding for semantic communications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:5b470b667ba45c11325212c4afaebb826fdfdd2c4a41d0ccb5eba0f15cf2d2fe","observation_id":"4616608a-7ff4-4704-aea3-62d5275a7267","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Tifa: Accurate and interpretable text-to-image faithful- ness evaluation with question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:77741356d8bfb394f1e4f2fdafdbefbcfda25e1c2a0e5e72c7ce0b8de32c202e","observation_id":"0c1c810f-3eaa-4d12-807a-d0c70a8e516b","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Unifying flow, stereo and depth estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:6bf77368a9da1627c14264d02c8df6016aa2bfbd961fa168c29d10a0f828ea59","observation_id":"50426aa5-3517-4dfd-ac71-a45308579799","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:0218c6ece5199b202c8603f756ad431b31cb56dbfe1ce370f4c131f658cc574a","observation_id":"bbfe3f8f-a111-452f-8c5d-c68857f44582","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":"2412.20404","doi":"10.48550/arxiv.2412.20404","metadata_source":"pith","pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora: Democratizing Efficient Video Production for All","venue":"cs.CV","work_id":"8b29ba7b-3d84-4281-85b7-9eaf905afd7f","year":2024},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:99e71777f7fc99a0d01a5e906c5faaaa1b6a4e4c8ad706ed57a48a19f21b5c54","observation_id":"44df08be-f599-42ea-a1f3-9c930eea6c06","resolution":{"observed_at":"2026-07-03T16:08:37.714736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:1f97b9fa88bf90fbb323691f1f8a5421be6d15c4a3967bf4ceec5c8f0d2ae6a4","observation_id":"28e14851-d7ee-4854-87c9-1b73009403ec","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:52288e8fb73033978c90b76e0d0df6278d0927c4054c37aed4b967d52cfdf898","observation_id":"2bd989a5-9e90-4f51-bec5-957bea0cca2e","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Advanced video coding for generic audiovisual services","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:6610aa3e71eb879c16125026592d0b8baa39a27a67a6640801eb5fef4f1d1495","observation_id":"deb367fc-007b-4440-887c-6167318a1eb3","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Overview of the high efficiency video coding (hevc) standard,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:92fe558c6e622db44252ece457376e35d1bd47b70808da6eea124086f1d9ee00","observation_id":"e7b91330-ba1e-48aa-bfb7-f256f64de775","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Pllava: Parameter-free llava extension from images to videos for video dense captioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:aef5663df6ef4746aa792ceeefd83f4e8528ba699af614d0ffd6a93ca9820784","observation_id":"ee33e238-b676-4561-bd8e-89d3d6f5576e","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Is space-time attention all you need for video understanding?,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:812321ace7f97b94ad51475c3a6f63ba4f5d9b3fc99a7603f13e0c319de1e1b0","observation_id":"49708279-affc-4bf3-8eb9-1ff1063ab2ad","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Depth anything v2,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:1270b248eca132a03239fe0878af852f44205a6522e85ce1cf1f19021b510fb2","observation_id":"511da301-28d9-4551-9d37-2115e72e3da3","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"Bertscore: Evaluating text generation with bert,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:4e9ba4a1170190599873c05894274d858c5acd4fce7841a892b175e0d036d69d","observation_id":"28a08cbc-4954-4e0b-9ed8-4e8ea66d4b7f","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:04:21.699055Z","title":"No”) andP(“Yes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T06:04:21.699055Z"},"links":{"citing_paper":"/paper/2606.12899"},"observation_digest":"sha256:ba672870458a6ffd237f7ff3137deccbb0a57dbfb525a8b7e000727176e47078","observation_id":"7257c769-7afb-4f19-b5c2-a96d422498c2","resolution":{"observed_at":"2026-06-27T06:04:21.699055Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.12899","last_updated":"2026-06-16T12:33:43Z","latest_version":2,"primary_category":"eess.SP","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T04:58:03Z","title":"LGVSC: A Large-Model-Driven Generative Video Semantic Communication Framework"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2606.12899."}