{"as_of":"2026-08-08T11:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23e08ba12654e31099d1e9a0dd63cad1911cdb424ed77c4b1e3fc4a5a3c6e8af","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T01:05:27.055045Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03046/citation-record","integrity":"/paper/2608.03046/integrity","json":"/paper/2608.03046/citation-record.json","paper":"/paper/2608.03046"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.548314Z","title":"It provides a compact global description of the clip","venue":null,"work_id":"216d7d39-51e6-41a5-a89a-3e65e10ae455","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.940126Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:f02f3f60a9b4147fcdf5622f98d66001ab8f0db07be2840c2e45679419ffb150","observation_id":"5de01d32-9009-48fb-8f96-fa5938e8e1da","resolution":{"observed_at":"2026-08-08T01:05:27.551649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.539011Z","title":"This is the main fine-grained semantic description","venue":null,"work_id":"5166b793-14f2-455d-bc09-88ef106f4087","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.943772Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:337ae4d2a28ce1d5e9413e25f224ddb927f936b84aa9c08c61cb347b22170910","observation_id":"7172e49e-6008-46c8-ae5e-efe5090fe61e","resolution":{"observed_at":"2026-08-08T01:05:27.542501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01492","last_updated":"2025-07-02T08:51:45Z","snapshot_observed_at":"2026-08-06T20:47:37.885961Z","submitted_at":"2025-07-02T08:51:45Z","title":"AVC-DPO: Aligned Video Captioning via Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2507.01492","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01492","snapshot_observed_at":"2026-08-08T01:05:27.182138Z","title":"AVC-DPO: Aligned Video Captioning via Direct Preference Optimization","venue":"cs.CV","work_id":"8b7b8e80-6767-498e-a92d-a3fc0720a761","year":2025},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.926438Z"},"links":{"cited_paper":"/paper/2507.01492","citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:3c5abce85d4c1d14494a8057e3a47fd441a595133927eda1d9dcf90c20577e72","observation_id":"4d026c89-1521-4c95-a135-b6cd914c956b","resolution":{"observed_at":"2026-08-08T01:05:27.188251Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.518592Z","title":"Containsonlygroundedsettinginformation;maybe null when the source gives no environmental evi- dence","venue":null,"work_id":"3c20e120-be61-4a05-9c75-19b1316a2931","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.951121Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:2140f78f04f03285d542fe8c47defea2c61114aae5bbdfa2e26891398013717f","observation_id":"db8caad0-32cc-41e3-9ee9-95af0c2c9a67","resolution":{"observed_at":"2026-08-08T01:05:27.522247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.508177Z","title":"Distinguishes camera motion from subject motion","venue":null,"work_id":"0726af28-0bcd-41a3-ae59-f388ba99ef62","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.955108Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:cd518272e8ae9c927e9ce371deb768665c6a90226623a7b3385e823706bad7c2","observation_id":"84f64399-986c-4eb4-be7e-6bafca23f52f","resolution":{"observed_at":"2026-08-08T01:05:27.512157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.497312Z","title":"cinematic","venue":null,"work_id":"fe415a8e-ac1e-4792-8a1c-afdfba5774bf","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.958852Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:a6a12dfc21a49003240cc8486c42851b6d8ff44f404f98042e110a8ed82d4196","observation_id":"66a6e288-96b8-4d1e-8ad0-7be77b453e5e","resolution":{"observed_at":"2026-08-08T01:05:27.500992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.528480Z","title":"Includes identity, count, appearance, or attributes onlywhensupported;maybenullwhennoprimary entity can be identified","venue":null,"work_id":"170f9570-e9ab-4d38-ad8f-fdf2db0604e3","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.947377Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:74b77399ca074eec876ff6101659d4cec76893365c67de4326a52a75614967e2","observation_id":"c262eb0d-72ad-4465-a9e2-1e937fbe3d91","resolution":{"observed_at":"2026-08-08T01:05:27.532500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.487896Z","title":null,"venue":null,"work_id":"c78abac4-5486-4b94-89c5-9cac24b81a07","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.962368Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:02dc92a42991ab047f7a10fd57d5323024118650dc89ca8085fc17b4e0fbb64a","observation_id":"76ca307e-db80-4f09-bd9f-f60c700f35c2","resolution":{"observed_at":"2026-08-08T01:05:27.491117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.478296Z","title":"The pot holds water that is boiling vigorously, releasing thick clouds of steam and forming large, rolling bubbles on the surface","venue":null,"work_id":"ddab6d9b-06bd-4652-8ea4-715408dc7a8d","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.966331Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:10341621742623c31208fa91195538182717b1832c3903260c68fb648265a361","observation_id":"ee5d9e49-ba54-4f0e-a2ab-c570432ca500","resolution":{"observed_at":"2026-08-08T01:05:27.481963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.467889Z","title":null,"venue":null,"work_id":"83e43e1e-4b35-4c40-80db-59b8fd8feafc","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.970097Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:b002a0db821111473604e8323e60dc179d137da2bdf579154ce7f8c4adea5391","observation_id":"76198249-fc92-44ee-ad07-25d9e76ee4bf","resolution":{"observed_at":"2026-08-08T01:05:27.471264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.458699Z","title":null,"venue":null,"work_id":"499d5126-b82e-4b0d-b64a-cb9c481b19cb","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.973768Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:0199d43d4aa89ec645c11a7262f79c562b3c1264e155118e04a85c3f586a40d8","observation_id":"36169eb2-36b4-423b-abd4-b7260b236066","resolution":{"observed_at":"2026-08-08T01:05:27.461892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.449158Z","title":null,"venue":null,"work_id":"02037b2c-f6d6-45e7-bc91-267813245368","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.977301Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:c49fa7affe9306dbdd4ebcde6dd3cbece1badf5fd19fdd49f92b2aa150727743","observation_id":"b5dd40bf-54e7-4c5a-9874-9eba9149186a","resolution":{"observed_at":"2026-08-08T01:05:27.452433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.439235Z","title":"Target behavior","venue":null,"work_id":"fdfd41f3-1bdd-4626-b389-9804e1630fb1","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.981006Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:00943caa6f9a069d21e50021dfd111e6ea62c455b336e306d6de9d6a8501ed4b","observation_id":"54e9c8e6-2ca0-446b-9e25-de7991d6a21d","resolution":{"observed_at":"2026-08-08T01:05:27.442628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.429530Z","title":null,"venue":null,"work_id":"740c664b-6c38-415c-8930-3000d89a4c74","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.984528Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:43449665343bb4ef255afe61b16b46f2c4bf40ec967ea36c17a0b27855ebef8c","observation_id":"4705d0e9-07b0-4b8a-9586-c392654b76c2","resolution":{"observed_at":"2026-08-08T01:05:27.432768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.419105Z","title":"The sequence begins with the hands rolling out smooth, pale dough into an even circle using a wooden rolling pin","venue":null,"work_id":"3394fa7d-ad27-43ec-af53-74c3f9e19aed","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.988252Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:8d401ef392042bf0c02910a3fc151c66d75d89ce010f2a916603f2535d287b0f","observation_id":"46fe6598-d86a-4aee-a102-98b0faf67db5","resolution":{"observed_at":"2026-08-08T01:05:27.423022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.409661Z","title":null,"venue":null,"work_id":"08cb773e-1fc0-48ab-8223-54477385b9ee","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.991865Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:3cf64cc808e5b30102c66b45d04f6ba571101a27e85234aacadc5d77aade6d27","observation_id":"3ccf55e6-17c3-48f2-91d5-32d410e7fca4","resolution":{"observed_at":"2026-08-08T01:05:27.412948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.399878Z","title":null,"venue":null,"work_id":"22c6f9d0-fd1b-4b69-bcef-d700677464bf","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.995588Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:e0a34618d0d58845c0e308ccf754c944d0a9be3dec9a93d4bcfa8604988a1079","observation_id":"b37a6860-b1c1-4580-9e2d-435797360dc5","resolution":{"observed_at":"2026-08-08T01:05:27.403452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.389126Z","title":null,"venue":null,"work_id":"abc82a9a-7b7f-4084-b00b-131236732c65","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.999108Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:1ec2c071f1d73a037971f8503785969935e68d43ae916e5fca68602cd0b7f9e3","observation_id":"885cdf38-4125-4fa6-88de-e2a1d9e84c05","resolution":{"observed_at":"2026-08-08T01:05:27.392519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.379614Z","title":"Target behavior","venue":null,"work_id":"9988d9c7-86c1-4798-bc85-36733be5c3f9","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.002570Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:09bb70669c3cf837e059a832f1dd09081fbb62cdbb8226a7b2f2fa2d93efde7a","observation_id":"c763e9f3-ec41-4d8a-8586-0bd47c63d505","resolution":{"observed_at":"2026-08-08T01:05:27.382900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.370083Z","title":null,"venue":null,"work_id":"baedb20c-b6c5-4eb9-9f81-2eeb3b90a2e4","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.006230Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:64c754e7f4f09a7e00c118aa093ef1c7773e53782cee8b903b2fb4144999fcc3","observation_id":"4113162c-e281-432b-aa9b-7d4944230098","resolution":{"observed_at":"2026-08-08T01:05:27.373401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.360025Z","title":"The handsshapethedoughintoatin,crimptheedgestocreatea decorative finish, and roll the material to an even thickness","venue":null,"work_id":"0599c249-fa66-475b-b841-9da211177e6d","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.009786Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:86ea7be015630d202ccb7d559b58cb171ce9d5765960364c3f55f9080a83996d","observation_id":"d0d106b6-52b2-4d1f-bcf3-c6a2e71385ce","resolution":{"observed_at":"2026-08-08T01:05:27.363689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.350596Z","title":null,"venue":null,"work_id":"a954b17c-a568-4908-af9f-2a6ece7a92b6","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.013378Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:fefa7e18740de22da8cb67553b3586d1eb69f403072ec08d36c8149081b923f8","observation_id":"47715f0c-c26c-40d0-8dc4-a41de6a5e7f6","resolution":{"observed_at":"2026-08-08T01:05:27.353915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.341095Z","title":null,"venue":null,"work_id":"bf450538-2740-4605-a5d6-2675e3e33604","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.016800Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:248339365495025b7945ad54b9accbb790eaa32f7c11aba06dbdbce7617328b7","observation_id":"04bc1058-a1b9-488b-8f31-b6d7e5e4eeb2","resolution":{"observed_at":"2026-08-08T01:05:27.344512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.331347Z","title":null,"venue":null,"work_id":"cfce83c7-1777-4140-88db-eb3e90d60437","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.020077Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:650b2757fa8ade450d295098cb998e23cecd26c70fc9eb9da75b09340b16684d","observation_id":"aaea0680-ac1b-4fde-8d28-baefe7c1d5f0","resolution":{"observed_at":"2026-08-08T01:05:27.334703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.321824Z","title":"Target behavior","venue":null,"work_id":"e0e252a8-f9f7-4149-8eca-a12d83c5934c","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.023827Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:990513dae536678a0fc29b175e618709142f10a78448e6b514629bdf62f3be95","observation_id":"0aa25972-001c-4358-9c44-0e9f6984ae42","resolution":{"observed_at":"2026-08-08T01:05:27.325115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.311326Z","title":"He is approached by a boy in a black t-shirt and jeans,whileasecondboyinablueandredlong-sleevedshirt runsinfromthelefttochallengefortheballbutcollideswith the man and falls","venue":null,"work_id":"d8b816e9-21e9-4f74-8fb3-bf9d5e76e185","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.027198Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:5b24ec5194b304ff35f0b450b65c1d23029e00d5e20475446b647ee67b2f7944","observation_id":"23114e08-b03d-420d-b656-5368a8e9a652","resolution":{"observed_at":"2026-08-08T01:05:27.314927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.301334Z","title":null,"venue":null,"work_id":"bc3dc869-f04f-4022-a219-2a0bd40d2f50","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.030730Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:7b6093d7ac68014fba07229a49c83680c498a7ea4cc07a20e0ad41e25268bc48","observation_id":"5201f187-ef1c-4059-bd97-816083d6fe05","resolution":{"observed_at":"2026-08-08T01:05:27.304672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.291137Z","title":null,"venue":null,"work_id":"286ba0eb-f7c0-4dfe-a77b-015b0289f21f","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.034169Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:5dfc602621ad53b37ff3728ca642bf496b36f89f48f260902fe015550c243907","observation_id":"24327987-37cf-4fbb-9d64-f6c85e5b546c","resolution":{"observed_at":"2026-08-08T01:05:27.294554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.279129Z","title":"Anchored PE caption: 1","venue":null,"work_id":"09d0fc76-a1c5-4ac2-96b5-3d47a365628e","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.037709Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:6d2ef25d37b7268bffd3de6f31f8feebc53256d7b75de6bc294c705d4cc87bdc","observation_id":"f9f11e3a-519d-4b51-bee1-c2500788e448","resolution":{"observed_at":"2026-08-08T01:05:27.283155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.267219Z","title":"A boy in a black t-shirt and jeans approaches him, followed by a secondboyinablueandredlong-sleevedshirtrunningfrom the left who collides with the man and falls","venue":null,"work_id":"84ed3f06-42b3-45b0-b626-4f8e9e7b5168","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.041004Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:d23bd1fd2634ef57607ba875f3a33f220ac6005a93b465751052f8aaca96f76b","observation_id":"fef809d7-d537-4ee7-a151-9885fa343131","resolution":{"observed_at":"2026-08-08T01:05:27.271150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.256121Z","title":null,"venue":null,"work_id":"bf9c02b8-743a-475d-922f-fd5f885cf07f","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.044362Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:e00c315293da67dfafcdbfc624435e992bb287076c62c697f6d892f07bc9ed17","observation_id":"fb07b8cb-cc4c-454d-b0c8-28fc4526c420","resolution":{"observed_at":"2026-08-08T01:05:27.259945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.245138Z","title":null,"venue":null,"work_id":"df6ca592-e8b7-49c7-835d-91194d9f9dc3","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.047816Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:4c1d959f59eb32a2f473fa2af279047bc655bbfa0f07d6aa03a7be8f918a294d","observation_id":"69913f63-2066-47b7-a630-d25f58d37b8d","resolution":{"observed_at":"2026-08-08T01:05:27.248747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.233862Z","title":null,"venue":null,"work_id":"839d69ae-a105-4332-b4d5-cd1887c60eb3","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.051675Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:4e4338b7da655f8a358f848d84a6aac09c4b225ff0508e912098e84220a2e824","observation_id":"f0b653cd-f2a7-4325-8aec-b72a04e9483c","resolution":{"observed_at":"2026-08-08T01:05:27.237597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.221727Z","title":"A man ... dribbles ... while three boys attempt to tackle him and se- quentially fall","venue":null,"work_id":"3860b21f-8862-4537-92c1-a69ca9476c81","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:27.055045Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:8e5596cfb6fbbec7dbaa5c876d445e7e8c4638f434e84f2319d076b8f80000b2","observation_id":"4acdaa7f-f63c-408a-945a-5638eac63143","resolution":{"observed_at":"2026-08-08T01:05:27.225808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:27.557498Z","title":"ScoresaverageallninePE-conditionedvideosorthreeNone videos","venue":null,"work_id":"7d94ca7e-a3fd-4d22-84e8-66f403d0bb4a","year":null},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.935585Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:7f278abda6fbe7471165adb1fff1661d216aa1bc31df5b210740b9596940390d","observation_id":"f891e532-c684-4e69-acae-f12f9d3a53bd","resolution":{"observed_at":"2026-08-08T01:05:27.560405Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00949","last_updated":"2024-06-10T03:16:09Z","snapshot_observed_at":"2026-07-06T16:42:00.138744Z","submitted_at":"2023-11-02T02:33:09Z","title":"POS: A Prompts Optimization Suite for Augmenting Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":"2311.00949","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.00949","snapshot_observed_at":"2026-08-08T01:05:27.199386Z","title":"POS: A Prompts Optimization Suite for Augmenting Text-to-Video Generation","venue":"cs.CV","work_id":"08ce8623-1564-435a-bbc1-e23301c51c47","year":2023},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.922041Z"},"links":{"cited_paper":"/paper/2311.00949","citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:633e480f9986dfb83e8331139887ed0ad25f565537768bfeab2123650eb2f24d","observation_id":"061561bd-1953-4453-8d1a-23126e61811a","resolution":{"observed_at":"2026-08-08T01:05:27.203741Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.20206","last_updated":"2026-05-14T08:53:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-23T04:45:09Z","title":"RAPO++: Cross-Stage Prompt Optimization for Text-to-Video Generation via Data Alignment and Test-Time Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.20206","snapshot_observed_at":"2026-08-08T01:05:26.916935Z","title":"InProceedings of the IEEE/CVF In- ternational Conference on Computer Vision, 15636–15645","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.916935Z"},"links":{"cited_paper":"/paper/2510.20206","citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:e50d355f95248d7b15fd8c90764a51ca378f45aae06dab2325be9270d3159e41","observation_id":"b9cd0adc-6cfe-46b5-a391-1bcc27891f41","resolution":{"observed_at":"2026-08-08T01:05:26.916935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T01:05:26.930647Z","title":"Wang, Q.; Shi, Y.; Ou, J.; Chen, R.; Lin, K.; Wang, J.; Jiang, B.; Yang, H.; Zheng, M.; Tao, X.; Yang, F.; Wan, P.; and Zhang, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T01:05:26.930647Z"},"links":{"citing_paper":"/paper/2608.03046"},"observation_digest":"sha256:c540e073ae1c093aabe1cecb6b1725b69017768b4db254d4f12617e3a7aa7a3b","observation_id":"79875c3a-01c0-43be-acad-6b125e9a1e8a","resolution":{"observed_at":"2026-08-08T01:05:26.930647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03046","last_updated":"2026-08-04T02:55:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:56:47.615651Z","submitted_at":"2026-08-04T02:55:10Z","title":"CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.03046."}