{"as_of":"2026-08-12T21:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:864e4836f2986dc9bcc0941e325de96f21985c2e5b70ba56e47b4039389359f1","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:37:15.414734Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.14843/citation-record","integrity":"/paper/2605.14843/integrity","json":"/paper/2605.14843/citation-record.json","paper":"/paper/2605.14843"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.03520","last_updated":"2024-10-03T17:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T17:53:55Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","version":2},"cited_work":{"arxiv_id":"2406.03520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03520","snapshot_observed_at":"2026-07-07T15:43:53.689981Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","venue":"cs.CV","work_id":"27ed795c-abbe-4de1-9a7a-2ecf39c354f3","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2406.03520","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:5044706dcd64a6c1ef8914f094ed49dfeff9eb7378305ef6b0d70d0d6d40ac8e","observation_id":"953ab19d-e95e-4cd3-80c7-e3b857603b74","resolution":{"observed_at":"2026-07-01T14:25:46.370003Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.504147Z","title":"Bear, Elias Wang, Damian Mrowca, Felix J","venue":null,"work_id":"85dd00fc-cea5-40c3-ad41-a0c677285d1c","year":2021},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:068919807caa96ccbf9a1d08e42ed3d4afff9c7bb3d084e4d287ed334ed703e7","observation_id":"756842cc-3949-4241-91c7-66d89097f3b1","resolution":{"observed_at":"2026-07-07T16:33:56.505439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.488649Z","title":"The IKEA ASM dataset: Understanding people assembling furniture through actions, objects and pose","venue":null,"work_id":"88804170-d8bf-4a85-8700-e7566a64187c","year":2021},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:7b5136dca478eced6352a85e1acd317e8101c4eef85f21771a7715f24125df58","observation_id":"d8b40bb9-2f59-46f7-891b-27a29c356469","resolution":{"observed_at":"2026-07-07T16:33:56.489962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:02f030aa94086ca2cb5dc99d780de6a3b8ddcb6396864ee55449dd9edd3434d8","observation_id":"bf453636-181f-4301-a4bd-d5fa373e85d0","resolution":{"observed_at":"2026-07-01T14:25:46.364511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.492278Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"830d359d-8bb8-4922-a197-ba2973073b0d","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:dde4d8c14901a49de9cdd662645f32c76f8e08e7be57b5f00f281a59e33fdc45","observation_id":"7f626424-2891-4bf3-8b2b-ff64afc99f15","resolution":{"observed_at":"2026-07-07T16:33:56.493558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.509999Z","title":"Gapartnet: Cross-category domain-generalizable object perception and manipulation via gener- alizable and actionable parts","venue":null,"work_id":"36705f6c-07ad-4ad5-ba52-daf4f68438cf","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:7bc33588fe15ba18c7434f584b9171b61a5a8527f826008f48ec62481fe29b50","observation_id":"298e47d8-3bb9-446d-9c67-4f0bedef5da0","resolution":{"observed_at":"2026-07-07T16:33:56.511336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.511639Z","title":"Factorizing text-to-video generation by explicit image conditioning","venue":null,"work_id":"a064a264-6319-4a8a-b20a-3b726283430d","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:8b32459b2f2376645551d60dbc0a7608fd1b24e8852972de5745a7645a388480","observation_id":"f58e425c-1856-40c3-b01c-9baac2da732d","resolution":{"observed_at":"2026-07-07T16:33:56.513323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":"2307.04725","doi":"10.48550/arxiv.2307.04725","metadata_source":"pith","pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","venue":"cs.CV","work_id":"1f9d1d3b-a6d6-45a9-9f13-51393c03be8a","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:a32c8e75934782b7f4ec889b520785c26146fe0a6c0e5e80dcb22c4543d7a223","observation_id":"ee2b3255-c345-43e3-ac59-17cb72cdee40","resolution":{"observed_at":"2026-07-01T14:25:46.345183Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.509115Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"81a7a1bb-c175-4a16-b0b5-759e91dd3b62","year":2018},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:9ef1a9e54a4b8ba210baa08fc03fc6c99cad372ee20a3cf02390d37028e2495f","observation_id":"6f1b6db8-6cec-4c71-ac35-61ee8f75872b","resolution":{"observed_at":"2026-07-07T16:33:56.510897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":"2501.00103","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-07-09T07:56:04.699528Z","title":"LTX-Video: Realtime Video Latent Diffusion","venue":"cs.CV","work_id":"cee5c521-3ce9-466e-a035-1e42f89254f4","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:a127bae04433a916ddf70b0ce4d3153e64b75f97c4a98a3f001fefd18ea79290","observation_id":"60ad9850-d070-4c93-9a14-3f32e0d80110","resolution":{"observed_at":"2026-07-01T14:25:46.359392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-08-12T18:42:20.189117Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":"2601.03233","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-07-10T01:46:41.047035Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","venue":"cs.CV","work_id":"1334671f-ee98-4c53-a1d4-0805281f8d2b","year":2026},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:6fffe9690f3e9fe6d5da30ab36991a5fbe6b7bad67a88c83fae3d0338e917038","observation_id":"725a8bf4-1177-4834-85db-83136b274970","resolution":{"observed_at":"2026-07-01T14:25:46.373156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.513960Z","title":"Happyhorse 1.0.https://happyhorse.app/, 2026","venue":null,"work_id":"1ad8b2ce-3274-43cf-80d6-07038d3a976f","year":2026},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:f311960d20f704633da36ed1836604d0e04ac7d13e5c89595fcf81c9048eebf6","observation_id":"e60b12c8-914a-4670-9bad-e327723b87c5","resolution":{"observed_at":"2026-07-07T16:33:56.515888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:50.611559Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"2383dbc4-0e5d-40ed-a102-5aac37332eae","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:dd88a7b601bd9d21f64452ca1a8981320e03646722bd01e7993ea3627f1a4fda","observation_id":"96a5d453-8d48-4956-8cab-f90b7d41baae","resolution":{"observed_at":"2026-07-07T16:33:56.518399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18896","last_updated":"2025-03-15T19:13:28Z","snapshot_observed_at":"2026-08-10T16:25:26.683331Z","submitted_at":"2024-09-27T16:34:13Z","title":"S2O: Static to Openable Enhancement for Articulated 3D Objects","version":2},"cited_work":{"arxiv_id":"2409.18896","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.18896","snapshot_observed_at":"2026-07-01T14:25:46.371197Z","title":"S2o: Static to openable enhancement for articulated 3d objects.arXiv preprint arXiv:2409.18896, 2024","venue":null,"work_id":"d26c2115-ea6b-405b-9679-c479a6069efe","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2409.18896","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:54c8dda25b99f21de892ea9291c8021085836b8063cc452deae8a1ac1d1f2020","observation_id":"a6e78fe5-805a-430f-8f3d-5dcff62a9e3f","resolution":{"observed_at":"2026-07-01T14:25:46.372708Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.519277Z","title":"Action genome: Actions as compositions of spatio-temporal scene graphs","venue":null,"work_id":"6a97edbd-2a8f-4d66-8814-0740cf4be54c","year":2020},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:1c1d0b6139b37a3b6dbe34008f2e67b26526865ff05e3308b3979726a2941572","observation_id":"0c581323-82f0-4814-b666-b40f523b2964","resolution":{"observed_at":"2026-07-07T16:33:56.520635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.521269Z","title":"Lawrence Zitnick, and Ross Girshick","venue":null,"work_id":"a86a8e60-6f3b-4595-9c96-275923aa452f","year":2017},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:9d08aa6f9c4baf53459ef3791d7724a32482496b3c8e796ba470c58a613185f4","observation_id":"5d32cfa6-a199-4d49-b3c4-ab964d8f7877","resolution":{"observed_at":"2026-07-07T16:33:56.522872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.530228Z","title":"Klingai 3.0 series.https://kling.ai/, 2026","venue":null,"work_id":"5b437762-33c0-408f-a59c-9c96440ca903","year":2026},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:f45b628002cc79780c65486154d6bcca15d267cbb69e35fcbcb073c7daedc430","observation_id":"8b7080b9-8c22-4f6e-8f10-fd42b6dd13ac","resolution":{"observed_at":"2026-07-07T16:33:56.531421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:b5598783c77191fa91a80dc68058a3498cd73d26a308260e3e25a9a032f85975","observation_id":"f41a3100-1ccf-4472-9bc0-e4c7671d1586","resolution":{"observed_at":"2026-07-01T14:25:46.375099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.500348Z","title":"Differentiable physics simulation of dynamics- augmented neural objects.IEEE Robotics and Automation Letters, 8(5):2780–2787, 2023","venue":null,"work_id":"82cb0d16-a475-4119-a90b-ec3400ec7240","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:10e1c9bd380ee82b283bf4e36f3712ec8243128b5f79586374e566f6ba960111","observation_id":"189a7fb9-daf6-4636-9273-c1914da61013","resolution":{"observed_at":"2026-07-07T16:33:56.501644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20694","last_updated":"2025-02-28T03:58:23Z","snapshot_observed_at":"2026-08-07T17:41:02.221324Z","submitted_at":"2025-02-28T03:58:23Z","title":"WorldModelBench: Judging Video Generation Models As World Models","version":1},"cited_work":{"arxiv_id":"2502.20694","doi":"10.48550/arxiv.2502.20694","metadata_source":"pith","pith_arxiv_id":"2502.20694","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li, S., Wu, K., Zhang, C., and Zhu, Y","venue":"cs.CV","work_id":"33a5087c-1633-4d52-b891-f34d10b9e7c8","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2502.20694","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:963cd9333d5c0efaf738e48629f87aeb624740caf00b3131c0bc65b76a8adb4a","observation_id":"02e6cecf-68b9-47c3-8d70-7924e4915721","resolution":{"observed_at":"2026-07-01T14:25:46.354770Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.214081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.214081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.507904Z","title":"Physgen: Rigid-body physics-grounded image-to-video generation","venue":null,"work_id":"915d6d68-0b7a-4252-bf86-4157af8097c4","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:e77a2479fa8cc9ea71c5b7e33153c6560551765e544feed7aa697299edd41483","observation_id":"a6b80559-5144-4550-99ef-3cb248f91739","resolution":{"observed_at":"2026-07-07T16:33:56.509284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T09:04:46.752472Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":"6e757df9-4d94-4c48-b598-5f5b824a06e3","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:70f0c6a00482c5e21faa8d02fcf4056773df62e7c9e998963e2f267451a83052","observation_id":"93d6a351-88e1-4c4b-85cb-e50824eeedbe","resolution":{"observed_at":"2026-07-07T16:33:56.487338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.506882Z","title":"Fetv: A benchmark for fine-grained evaluation of open-domain text-to-video generation","venue":null,"work_id":"d7bdc75e-c51a-42fb-9c53-dcf7743b71d6","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:32f7f7f6ccf68b2586c6e07f84df30283330df654ed5050d92ddaf79e97335b6","observation_id":"2efa26eb-8574-48df-bb77-2709e5bba12b","resolution":{"observed_at":"2026-07-07T16:33:56.508461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.535930Z","title":"Ikea manuals at work: 4d grounding of assembly instructions on internet videos","venue":null,"work_id":"fcec9e13-baab-422b-8225-c9ffca044145","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:b829ab09a6b84c13183e44306ce2f653be36e07932346e7221b2e055e7fcb10b","observation_id":"bb9113fa-ccd7-4058-96c5-e91cc4eaf4f4","resolution":{"observed_at":"2026-07-07T16:33:56.537310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":"2502.10248","doi":"10.48550/arxiv.2502.10248","metadata_source":"pith","pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","venue":"cs.CV","work_id":"f9be7275-0997-4f96-bbde-dcd6ea138476","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:b4b00a173271427de8060872db346703c014d923418468c93387f3cf8e1305ef","observation_id":"b95885bf-e0f8-4cda-a132-16357f26e81a","resolution":{"observed_at":"2026-07-01T14:25:46.377582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":"2410.05363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-07-08T07:14:45.198485Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","venue":"cs.CV","work_id":"644e2886-7387-436d-ac11-d848af5fcc71","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:834caeb2fef088a9849956c785f97e9c0b63ec5c06e9073bf75a346f5f133421","observation_id":"92f45404-f5b2-479e-bc1a-7b961fa945ed","resolution":{"observed_at":"2026-07-01T14:25:46.382950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.523470Z","title":"HowTo100M: Learning a text-video embedding by watching hundred million narrated video clips","venue":null,"work_id":"9ce386bc-c1a1-42ef-a7de-af32797c3f6e","year":2019},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:8023a0d6d4a80ad16520ad47499fa9909c214e5e767a405c911689ec24fe5d47","observation_id":"e19fb5c3-6c6b-4384-9878-a6a4aa55e574","resolution":{"observed_at":"2026-07-07T16:33:56.524958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.525508Z","title":"Motioncraft: Physics-based zero-shot video generation.Advances in Neural Information Processing Systems, 37:123155–123181, 2024","venue":null,"work_id":"6c9140bc-ccb9-47fe-ab52-399b5d83f739","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:de5d14fa7651b8717018d57eb43d6e2c4a5c635878d8a181a225253975f3e3f7","observation_id":"536cb717-eb0c-4124-a96a-4db8fb183280","resolution":{"observed_at":"2026-07-07T16:33:56.527331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09038","last_updated":"2025-02-27T15:10:51Z","snapshot_observed_at":"2026-08-02T17:18:33.867969Z","submitted_at":"2025-01-14T20:59:37Z","title":"Do generative video models understand physical principles?","version":3},"cited_work":{"arxiv_id":"2501.09038","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09038","snapshot_observed_at":"2026-07-07T15:43:53.802817Z","title":"Do generative video models understand physical principles?","venue":"cs.CV","work_id":"d9132ccf-02ed-4700-bf79-4e874794600d","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2501.09038","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:46899f0efcb7a0f224ee78322d605b911c539da642116d9a2f9c931c26af300a","observation_id":"ec89bd95-34a7-4a29-b497-bcdae94bb4f1","resolution":{"observed_at":"2026-07-01T14:25:46.382681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.528102Z","title":"Video generation models as world simulators","venue":null,"work_id":"4cb2d015-d1d7-4e04-b777-25f8b270374a","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:d21f09400fc29ad024124da2aaced011ba12ca850ddcf53e9556611c466569cc","observation_id":"9ffc2441-cda6-4e3b-a1de-4f7c1af2a989","resolution":{"observed_at":"2026-07-07T16:33:56.529616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.531970Z","title":"Sora.https://openai.com/sora/, 2025","venue":null,"work_id":"00134881-e4bf-48d1-858f-e83d6da3ca3d","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:7b515c06b6e3065c88630c53e10e1173c97a38164dde4cdc9a6590a56fcc0a2f","observation_id":"16f49f46-fa48-4afa-b233-103ce09a874d","resolution":{"observed_at":"2026-07-07T16:33:56.533177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.12430","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:25:46.378665Z","title":"Dynamo: Dependency-aware deep learning framework for articulated assembly motion prediction","venue":null,"work_id":"45cedf83-732f-4ee3-8b99-7d29f6640fda","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:81887e821f7d2bb7ce3fe8b6ed7a39df4597144b64db61b39ff09e1616865e60","observation_id":"633d0c8b-74dc-4053-9001-06f4e5902e88","resolution":{"observed_at":"2026-07-01T14:25:46.380244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:53.186413Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"0c67bec8-6388-449f-9600-64c8ea9bc79f","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:36b73e4d3d4d56d8bc9f05f043fa457fb1411f941decdfe6c8103d2acb959500","observation_id":"4687307f-72c2-4d7f-9040-69b5b4051fcc","resolution":{"observed_at":"2026-07-07T16:33:56.535276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04324","last_updated":"2024-07-01T03:57:55Z","snapshot_observed_at":"2026-08-11T14:52:19.474879Z","submitted_at":"2024-02-06T19:08:18Z","title":"ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2402.04324","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04324","snapshot_observed_at":"2026-07-02T12:26:56.718648Z","title":"ConsistI2V: Enhancing Vi- sual Consistency for Image-to-Video Generation","venue":null,"work_id":"19dbbe7f-675b-4f8d-a42e-59fde7969cf5","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2402.04324","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:17d0a2aaa82e9654546fd00833ac52970924af4e68f22b0131e853cd6341493e","observation_id":"2c1768b2-3bb8-4674-a92d-a06b1c5d4d5e","resolution":{"observed_at":"2026-07-01T14:25:46.362561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.494175Z","title":"Interacting objects: A dataset of object- object interactions for richer dynamic scene representations.IEEE Robotics and Automation Letters, 9(1):451–458, 2023","venue":null,"work_id":"854c0415-beef-4294-9fb8-d7e2a5b798c4","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:2652f7a4fc96f8ef2676e64451505d7fbada27fbb12d3fa1cece58a1539fc072","observation_id":"8b677707-8b32-4b1a-a72d-c32e82a5ed69","resolution":{"observed_at":"2026-07-07T16:33:56.495883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:49a7762ed2cf8b66b4ad91c70ad6126861e50b727d005b63d4ab317bfc90ed60","observation_id":"070b8f06-1277-4c0b-8aa7-74b3509b440f","resolution":{"observed_at":"2026-07-01T14:25:46.365229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.498760Z","title":"Wan 2.7.https://wan.video/, 2026","venue":null,"work_id":"c70b6edd-93f8-4715-adf4-99ae5ea124a9","year":2026},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:06dd3c51a79593c05c7cb6f4a73a6bcbd18332bd7e664d77b129a468b1a3dc26","observation_id":"93d0cddc-4417-4f0e-b00a-b50f61ee8e23","resolution":{"observed_at":"2026-07-07T16:33:56.499866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08153","last_updated":"2025-03-11T08:10:03Z","snapshot_observed_at":"2026-08-10T19:42:40.509462Z","submitted_at":"2025-03-11T08:10:03Z","title":"WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2503.08153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08153","snapshot_observed_at":"2026-07-04T13:19:51.064913Z","title":"Wisa: World simulator assistant for physics-aware text-to-video generation","venue":null,"work_id":"faa75e3b-50f4-44b5-bfe5-65f0dc911f7e","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2503.08153","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:8eddeda6d00011bb509446cc5fb5bb49484a5a95753f74d5d4d9f09a18e53b30","observation_id":"23d69501-ee36-4ad5-a69f-380f24c44400","resolution":{"observed_at":"2026-07-01T14:25:46.370730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":"2308.06571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-07-11T01:57:50.025885Z","title":"ModelScope Text-to-Video Technical Report","venue":"cs.CV","work_id":"1b1baf78-58ec-44d0-b700-84dff57b2f1f","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:be2e2ecfe289e9d098cd3c9e37be7559bedf8d8bf693324528b5938ce0ea9ca7","observation_id":"ca4d06da-71f1-403e-b4b8-2c357645578d","resolution":{"observed_at":"2026-07-01T14:25:46.377873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.502002Z","title":"Shape2motion: Joint analysis of motion parts and attributes from 3d shapes","venue":null,"work_id":"b2a78271-8905-4331-a2f6-d22b60eae28e","year":2019},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:f70e75045fb66f167d10aca525edcbef222219e21a63b14047906791539ba85d","observation_id":"545f391b-722e-4470-a036-a2e5930caf37","resolution":{"observed_at":"2026-07-07T16:33:56.503837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.504548Z","title":"Sapien: A simulated part-based interactive environ- ment","venue":null,"work_id":"40e62122-a41e-4180-8f4f-4cbab09270cb","year":2020},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:8f32f5ea5a26cb9f86e1eb58fcbbe565f0026dfa456297698946017e06ed2a62","observation_id":"e3dd8277-ddd0-47e6-a0aa-a4edaa2095cd","resolution":{"observed_at":"2026-07-07T16:33:56.506238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T03:54:30.816534Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"9e43b340-459a-4be6-92cd-548457f6739e","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:d4ab390995774eafb59093caa36986eeb1a998d804a2f1b58eb9c17ba9d2a7a0","observation_id":"b74d689f-2638-44c1-9be3-d1d5177b09a7","resolution":{"observed_at":"2026-07-07T16:33:56.493744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.494303Z","title":"Phyt2v: Llm-guided iterative self- refinement for physics-grounded text-to-video generation","venue":null,"work_id":"e7e163ce-9a71-481a-b586-bdccc43cfd75","year":2025},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:1fa5c7451609b996ed4cbe132de74116dde7b62c311780f4ed6de287fae213de","observation_id":"86579e3a-43c5-48dd-be99-2f8b9a51a01c","resolution":{"observed_at":"2026-07-07T16:33:56.495664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14865","last_updated":"2020-06-26T08:51:11Z","snapshot_observed_at":"2026-08-10T15:01:46.975656Z","submitted_at":"2020-06-26T08:51:11Z","title":"RPM-Net: Recurrent Prediction of Motion and Parts from Point Cloud","version":1},"cited_work":{"arxiv_id":"2006.14865","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14865","snapshot_observed_at":"2026-07-01T17:15:50.894580Z","title":"Rpm-net: recurrent prediction of motion and parts from point cloud.arXiv preprint arXiv:2006.14865,","venue":null,"work_id":"562dc053-b732-441e-8260-ea057818cc45","year":2006},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2006.14865","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:deee65ac7f091d73ef8b3f33b0d34f7ceb23edf3a400ad9ce35eec13d3d56013","observation_id":"ee68f3b1-6f6d-4f7b-b83d-ad4d0b458c9e","resolution":{"observed_at":"2026-07-01T14:25:46.380395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.486806Z","title":"Learning interactive real-world simulators","venue":null,"work_id":"f4022b69-aa3a-4607-9d70-3402c84db921","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:9e73a46e00763eaaa9ce9d7309978301190b3fc4967050e96f65c19565ee9054","observation_id":"52d0ef61-5acb-4364-9816-dbbd4129e682","resolution":{"observed_at":"2026-07-07T16:33:56.488071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:5c0469e82e1aca4de5e9b0db9e13a5bc16c3c72a5ea718818494f6174eabdc82","observation_id":"ba0725f5-120c-4ff0-8463-01fd117c61df","resolution":{"observed_at":"2026-07-01T14:25:46.357329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:33:56.478702Z","title":"Ha-vid: A human assembly video dataset for comprehensive assembly knowledge understanding.Advances in Neural Information Processing Systems, 36:67069–67081, 2023","venue":null,"work_id":"547e4702-5af7-402e-ba4c-408176065bb7","year":2023},"citing_paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T21:37:15.414734Z"},"links":{"citing_paper":"/paper/2605.14843"},"observation_digest":"sha256:6df5d8362a9248a6d424353d9996e2bdca65c78c9762a3665d98d82239b2a707","observation_id":"622ee88e-45ce-48dd-a910-eb3a7ed00f26","resolution":{"observed_at":"2026-07-07T16:33:56.480240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.14843","last_updated":"2026-05-14T13:48:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T08:41:56.901343Z","submitted_at":"2026-05-14T13:48:17Z","title":"MechVerse: Evaluating Physical Motion Consistency in Video Generation Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":17,"verified_fuzzy":29},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2605.14843."}