{"as_of":"2026-08-06T06:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7921fc0bb5d1b7fc496184894cff209db0750ca4206042f2f0be7005e92c63ce","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T12:26:21.580418Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:38:14.202168Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:38:18.190959Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2603.11698","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.11698","snapshot_observed_at":"2026-08-05T00:38:18.190959Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","venue":"cs.CV","work_id":"0bd94274-de47-433a-b7e1-c22b50aca291","year":2026},"citing_paper":{"arxiv_id":"2608.00617","last_updated":"2026-08-01T12:16:22Z","snapshot_observed_at":"2026-08-06T05:25:31.174168Z","submitted_at":"2026-08-01T12:16:22Z","title":"Diagnosing Under-Development of Irreversible Processes in Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T00:38:14.202168Z"},"links":{"cited_paper":"/paper/2603.11698","citing_paper":"/paper/2608.00617"},"observation_digest":"sha256:0bca439e6ab60f0047abf032ae357b05f48ec16d38a92c2abd70b0df8b0cabc3","observation_id":"b99516b5-90f2-4f9e-a68f-e5b2a9f35b09","resolution":{"observed_at":"2026-08-05T00:38:18.279057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.11698/citation-record","integrity":"/paper/2603.11698/integrity","json":"/paper/2603.11698/citation-record.json","paper":"/paper/2603.11698"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13428","last_updated":"2026-05-26T08:34:24Z","snapshot_observed_at":"2026-07-06T21:58:56.405149Z","submitted_at":"2025-07-17T17:54:09Z","title":"\"PhyWorldBench\": A Comprehensive Evaluation of Physical Realism in Text-to-Video Models","version":3},"cited_work":{"arxiv_id":"2507.13428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13428","snapshot_observed_at":"2026-07-08T07:14:45.185207Z","title":"InThe Thirteenth International Conference on Learning Representations","venue":"cs.CV","work_id":"7c164e09-5340-4f56-b63d-0e810f24f851","year":2025},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"cited_paper":"/paper/2507.13428","citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:27dbf9391ac87d413dace034be40b888d943a123964bb5ec587fff8ac9d380f4","observation_id":"6027a098-797a-4a30-9c13-b325f427c12c","resolution":{"observed_at":"2026-05-27T02:05:04.304229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09038","last_updated":"2025-02-27T15:10:51Z","snapshot_observed_at":"2026-08-02T17:18:33.867969Z","submitted_at":"2025-01-14T20:59:37Z","title":"Do generative video models understand physical principles?","version":3},"cited_work":{"arxiv_id":"2501.09038","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09038","snapshot_observed_at":"2026-07-07T15:43:53.802817Z","title":"Do generative video models understand physical principles?","venue":"cs.CV","work_id":"d9132ccf-02ed-4700-bf79-4e874794600d","year":2025},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"cited_paper":"/paper/2501.09038","citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:6222ecb24ea2a8b3c854f2b4dee56ac70dd54fc78ae4d691c26e611e1055f27c","observation_id":"732d2208-55bf-4a36-968e-6c311a204dd8","resolution":{"observed_at":"2026-05-20T12:47:06.031259Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9060.9980","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"the lemon largely remains undeformed","venue":null,"work_id":"4fd7ecc1-47db-4ef8-bc2a-45546ce57d2e","year":2025},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9bf61bd22957b1b7a59053ef893551d3fedd553d337ed2fb574b9ea47850348a","observation_id":"de417312-d423-4740-8153-4a8633386d0f","resolution":{"observed_at":"2026-05-15T12:30:00.385118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2613d32e-c715-4e06-9f49-5b62ff5be4bc","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:558733db5e4da7b12e2611f3321c115065244683c7afb9fd90563f72dcc9a263","observation_id":"a5337345-5da1-46b0-879b-044be162c464","resolution":{"observed_at":"2026-05-15T12:30:01.298441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Example: when scoring Action Alignment, focus only on the correctness of the action, independent of the object and other attr ibutes","venue":null,"work_id":"b4023262-d821-49ab-b03b-6b8c730b453b","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:62c4d4a6eb47b2d134fd2dfec0998277614710c425864b58df43d0003980f8eb","observation_id":"5330a732-ec5b-43cc-91d1-40348e1792be","resolution":{"observed_at":"2026-05-15T12:30:01.304214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluation Criteria","venue":null,"work_id":"b78f11e5-4cb2-4d4f-9f6d-1225048dd3e7","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:8fc5aa586944ccc725ad4ebbee0c8078f11fad49b7b08bb9eb9ea1c1e8cf431a","observation_id":"2e2b97b5-20b8-4aa6-8913-e0ee25608e46","resolution":{"observed_at":"2026-05-15T12:30:01.295277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Please select \"NA\" if the prompt does not specify a subject.)","venue":null,"work_id":"e06e35a6-3609-4b0e-8cb3-7c8675ec0d1a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:ef52c004398d4cd6c2e28ff62343d9513190b3ad0c703a2a46f58b6322e64197","observation_id":"7520434f-4cc4-4ac7-aa41-1645cd6015fa","resolution":{"observed_at":"2026-05-15T12:30:01.301437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d5feefb1-d7af-4023-9763-981463fb92ed","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:09bd2597599ac4bcccc4852b23ee4f8c3ab5a409ec1aec811b5291c9ab776652","observation_id":"70db3ec2-43b2-4d53-9488-97cf2ec32645","resolution":{"observed_at":"2026-05-15T12:30:01.283795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a36c3b84-62f7-4099-b4fe-6fe37564b813","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:1c7bdde75fc75c88ed63552ade54b98f60841516874cf8166292d45720c94a9f","observation_id":"fcc2bf99-bcd5-44c9-b492-f09cadb57274","resolution":{"observed_at":"2026-05-15T12:30:01.292416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c79f9d09-8389-40cf-ad1c-ca57acbb513f","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:173ca5ac0260d4cd520a6a5666e330e25c9bfa1b2ac15ef92f3d6e8eb4a7feb4","observation_id":"3f3f4717-a277-462b-a38c-18984e98aa54","resolution":{"observed_at":"2026-05-15T12:30:01.307298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d254fc7f-9cc5-462d-9b87-daa1a1ddad79","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:aea9f8f8dc2f404724508e833316c36ed124a16c842329d4840b1269d844fad3","observation_id":"cadf9bdf-1795-478e-873e-eb8a82334a84","resolution":{"observed_at":"2026-05-15T12:30:01.278521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1b Manipulated Object Alignment Is the manipulated object present and correct (e.g., carrots or tomatoes)?","venue":null,"work_id":"46248bc6-9e63-4c83-a271-1c70cb43bbf2","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:2c33bfa6208b32de34b8a0dba03e8127f36dfdc3f2a88fa656c049783266e42a","observation_id":"2953029f-c0ac-4a29-bb87-4ae310800694","resolution":{"observed_at":"2026-05-15T12:30:01.286978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"02803430-b599-4800-9cbb-ed42c9e211ef","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:db702ca14c6f080665f96d2cbc79c528a26b616a2b49f37b31412b6bdb30cae0","observation_id":"f9d760b3-72af-44d5-af16-ce2f8c3baa4b","resolution":{"observed_at":"2026-05-15T12:30:01.289524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"21d979c5-2f47-49e7-a02b-79f04facd5c9","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:c17bf83fb550a5b141aed2c29db0c4c7ce382b91df232f809257266a99c10d26","observation_id":"c698a246-0858-4b32-b93f-041307fcd0e4","resolution":{"observed_at":"2026-05-15T12:30:01.281121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e80478b2-806e-4ea6-a403-79a72dc75541","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:3a84aa606700d6d22327666a4253d09c294b73a4d36bcd89081133708f596874","observation_id":"e7980733-4332-4737-a016-f5d37477841d","resolution":{"observed_at":"2026-05-15T12:30:01.183073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"042632ad-7dc1-4a56-be39-8c5413c89ebc","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:79f6448079bf985e373c35d1a4c9a4ef67ac26c8240de8bedcc74e537f2b8ed3","observation_id":"f7d7f69f-dde1-46a5-8036-0d106c78a986","resolution":{"observed_at":"2026-05-15T12:30:01.232481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1c Action Alignment Does the performed action match the action in the prompt (e.g., slicing or roasting)?","venue":null,"work_id":"55a8b329-60b7-4749-bee6-df08d8896fe3","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:84bfb502f02f3e49301e5374b1c32a9eab5304ed729a615cc4085068d0baf6be","observation_id":"4551eb50-6574-4b9a-bb2b-72fdfa383515","resolution":{"observed_at":"2026-05-15T12:30:01.171966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2c28e228-2f95-4073-9bde-710106c6945e","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:ac27961fd922321dbe0958b5e8e3719d2f1dd6067ef18997ff61b67ab6c4da02","observation_id":"f48f9ade-bedf-4117-a6de-0f49a6c92941","resolution":{"observed_at":"2026-05-15T12:30:01.174977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b16a4f6a-fee0-463c-a315-0a4a2aa238d1","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:f3a6a2a6b0eb7a6562a2216d222c80a670c0b3a02cafba3cad3a8697026b8cc4","observation_id":"fd51a389-92be-400a-a1d4-0a4ed8da19ed","resolution":{"observed_at":"2026-05-15T12:30:01.180396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c93a8cfa-1811-4d6a-9235-76216fefdba0","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:0503c0bacdc93ebced69dc029d60063818b8548cd4a4fa23468828577a7174c2","observation_id":"1372da02-582d-44f0-bb00-ff782f59ff41","resolution":{"observed_at":"2026-05-15T12:30:01.168228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38e9a42a-ee19-4b78-91ec-bb9429d68b5c","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:724eb1b3821f74b60ef62518702fcbacf76a5b92587888c11aef977a3bb75ddd","observation_id":"20c80ad3-cd97-4ec8-a92e-2a06904e70ff","resolution":{"observed_at":"2026-05-15T12:30:01.164466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e077433e-b2d9-46c2-b358-ea234372842a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:0b5b1be95767557a751c33f6774403664d99b8f52706f54b08179e1c67be6a23","observation_id":"79cde6e7-4b4b-421b-b63e-0a98643bff9b","resolution":{"observed_at":"2026-05-15T12:30:01.177714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fba26849-9583-447c-ad68-0852086bbd5c","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:a1b618567aaeb5c3eedc907076d5b737f3968b23ba46e1c03ea48e0d708b06da","observation_id":"c106d10d-6869-450f-9b51-fe9773f855a8","resolution":{"observed_at":"2026-05-15T12:30:01.215815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9419d80b-350d-4587-9a45-64f18ce57210","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:a350233722f5c8580bcd2d4c37a94a7b4c247e583d56a9b89965105553b096bb","observation_id":"81fb2fc9-5748-419c-bfb9-133488ae8bf3","resolution":{"observed_at":"2026-05-15T12:30:01.238371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc4deb69-52c7-4a9a-9e44-bcde91e4e477","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:e23b5ec203523c9e137fd0ff681244437f5098d784c3a09ff4b3fe4aae5c6961","observation_id":"eb12bb9b-e0a7-4287-bed9-6ea2fcb3912a","resolution":{"observed_at":"2026-05-15T12:30:01.200387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17da9941-32b5-4a1a-bfe3-45aa218a98ea","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:87d6f8ba5c747ca2d979658a195f97a930780e81f6c6d12aebe77c07c3a2620b","observation_id":"850f5dfd-e679-4379-9345-f2ce9ddfa8b1","resolution":{"observed_at":"2026-05-15T12:30:01.260086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7fcad701-ddb1-4761-8f9e-785d513c575a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:41cd1a085fa91a4e175d34c9d05ed734d6278b5b7f3cd36a4a6b50534eda4718","observation_id":"723ec3c7-e062-4734-910c-dd37d35df61e","resolution":{"observed_at":"2026-05-15T12:30:01.252067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2b Object Change Continuity & Consistency Is the object state change continuous and natural, without any unnatural object appearances or disappearances?","venue":null,"work_id":"6d7a1a9e-64ef-4c41-ae17-38a57e41f440","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:a977cecc21f77a843a93943f32fbb3601dfb10625678139d584f250fd719706c","observation_id":"a8695ff3-1036-4cf9-876c-5a91637ebfee","resolution":{"observed_at":"2026-05-15T12:30:01.256723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a33cbf4-c218-4318-8fb9-fcd7b1f0df01","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:4d4a01c8d1ce76c9bc05234e1f55269bed9a29817eec5a8430c2a7388a08178e","observation_id":"8643faa8-155e-42e6-a0ed-a4ac504f5c07","resolution":{"observed_at":"2026-05-15T12:30:01.262919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"62ab7ac9-5ab7-4da1-8e68-c06d12241413","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9d3b6907c48290c125b96ce2cd7c5f095945c2cfb4465cc71056159ab8066de6","observation_id":"0d0f1b8c-57e5-4fd9-a48d-0239a903b29f","resolution":{"observed_at":"2026-05-15T12:30:01.272022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f9170ab-3989-4777-8b4b-a6566798f6eb","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:ccb5f27d82cc3cbd9199715f51dbc33584c0ef1f8fd60e382589b91f5897eca2","observation_id":"30b41169-e24f-43e1-9222-ef3536dc6a65","resolution":{"observed_at":"2026-05-15T12:30:01.248709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7742ba0f-1a56-4e13-bcd1-163c2f9e841f","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:e871f01a9c999cf163f9183605476410e6185d1d317a062949c41549c191a453","observation_id":"0e630db7-03dc-4f2a-8ff3-8ad837e4d586","resolution":{"observed_at":"2026-05-15T12:30:01.245185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3.SCENE 3a Scene Alignment Does the background and environment match the prompt (e.g., a kitchen or a market)? (Please focus only on the scene and environment","venue":null,"work_id":"c57a9841-f026-46a8-ad49-c3418917f4f6","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:6e8a810e6cf0a0e6bdbae5b5b8dffcbb0863416b6ec9f6ca677a4369870097b3","observation_id":"528092cd-4822-4b4a-9797-3c89a36641d2","resolution":{"observed_at":"2026-05-15T12:30:01.275556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1c428ff8-3cab-4911-9687-facba7cab7fe","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:f7301f631317747c5aa9f16fd31a6fa8afbe9ec3ab3a46c043f386f61571a0e1","observation_id":"37527e4e-0ed5-48d6-8b82-0689a081a449","resolution":{"observed_at":"2026-05-15T12:30:01.238142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8930c68b-4749-4bdc-8603-01ec0892259a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:206acebabe0bdbcdd88526e08e61948a423494379e362295d8bba2ad0c656910","observation_id":"c03688af-eb86-4178-af7f-d709d135e95e","resolution":{"observed_at":"2026-05-15T12:30:01.225165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6824921d-e17a-4373-ba17-5fdcc71a4010","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9e0cb8206b9d7341b60271389ff8e89dc44a644fd8316a8d3afb9696b0997360","observation_id":"3b86778e-a7e1-4298-9222-823d44929ad4","resolution":{"observed_at":"2026-05-15T12:30:01.222328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"451bb348-a9a7-4bb3-aeb8-79e54ef2f8ff","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:6fdfb69275b4116af79a0a73646d9b20f0710de76d63cc165fa99174a1a732c6","observation_id":"cf08ba01-9c02-4289-ba75-5fcfbe0f13b2","resolution":{"observed_at":"2026-05-15T12:30:01.241508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a056c940-199e-484f-8272-8d4e84e224e1","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:b7f21abbf402ad2182c023bb020957549d3a3250da20a8cf39b0ea7b2efa4028","observation_id":"fffc1aea-9067-4203-8759-50fd9c84d5f3","resolution":{"observed_at":"2026-05-15T12:30:01.268989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9cc76cd4-e14d-4856-b0b8-39ce86e122cc","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:e04fec50e0c72617cd3053d29d09e63f15d2f270fb7974ff08fc862983bf60d3","observation_id":"62981f41-ef3c-472d-8d02-ce28c4a40194","resolution":{"observed_at":"2026-05-15T12:30:01.228397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12012391-87a0-4d1f-9f5f-f9267c501a0c","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:70151f50cef7c1bd203eb1eb8edc72be33bd3b884bb39d8a2c37ace14b850332","observation_id":"13aafbcc-cf25-4577-b495-10e356e1b4a1","resolution":{"observed_at":"2026-05-15T12:30:01.205075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ceee1c0-91b2-4cf2-a509-1b26df45c5a3","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:41fc9aae899fd9102e66fa5ca1755e48b771dc409f1ce25482a4d911f71da460","observation_id":"3080e791-799f-4a51-a5cf-893a00ff33f6","resolution":{"observed_at":"2026-05-15T12:30:01.193616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"162ac1e2-e82f-44b4-94f6-b7fc370b406f","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:0110f036e580ae4b8e2db78cf474bbcd6d949671f51fdf7a593640ba37dc94bc","observation_id":"a41c6363-7990-494f-bd5f-685d5f835d37","resolution":{"observed_at":"2026-05-15T12:30:01.221092Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2bfdd8f2-0a5b-4520-8a8d-cade23e34035","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:1a0c8f24cb68b789a4f800e8186c4a2ec941f6028f41e07b89ca83f3375564fe","observation_id":"cbc0e15e-ed3e-4e90-9c09-65c2828c40ac","resolution":{"observed_at":"2026-05-15T12:30:01.265709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4b Aesthetic Is the video visually appealing? Are the colors harmonious and is the content rich?","venue":null,"work_id":"f9369013-9d31-49d0-ba0f-d2c3d420c0a4","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:82d15a77d9a1bd7ff9ffa742ee4798ff594f82f095e6cc7d736f9f973a2da7c3","observation_id":"02c4404b-844b-4291-b680-269016a9126f","resolution":{"observed_at":"2026-05-15T12:30:01.208377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c4c7e967-0441-4465-85da-84a63cd9b045","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:87200292509fcb233004a537a95ffb360cbb98f55bd18e0b9ee1b035c2d99335","observation_id":"1f59d184-b356-403a-9b96-d95519fe5d47","resolution":{"observed_at":"2026-05-15T12:30:01.202615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"138c3212-e2c0-45e2-b3d6-6ef444263fb7","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:53447b81e29acae50f8f847ad4e61ff2803822971f44eabe607c2868968b3334","observation_id":"5f5c2569-eed1-4683-a78e-0f1ffd496e07","resolution":{"observed_at":"2026-05-15T12:30:01.219591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"44f686c7-9c35-4d59-9139-c081b3788944","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9bc561384a7a2fa959559bb38802a34a2106413c04a26ccd78d72d639da277b3","observation_id":"059dc08e-7698-4a42-92e6-032cd5188768","resolution":{"observed_at":"2026-05-15T12:30:01.234484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eda71c7b-62b4-4c82-acc1-cf22d70ab41d","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:7d8884e4c3f103552964336e89c8dd469a06acd07ee624b5e9a0d19103543d77","observation_id":"24c9338e-a241-4673-988c-1f52c191b863","resolution":{"observed_at":"2026-05-15T12:30:01.232044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Figure 8: Task instructions and evaluation criteria in the human evaluation interface","venue":null,"work_id":"fb61d1c8-8f43-4905-83f3-3db9f6badcdf","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:ff1c73857d301d940fd41195897c28e0c0569017625b28affb7a7b14932ca1fd","observation_id":"352512ab-9d33-4604-91cb-18ca62fc90a6","resolution":{"observed_at":"2026-05-15T12:30:01.244607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2603.11698."}