{"as_of":"2026-08-09T01:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a2621329cd0d72564131c71d5f15aed46bfc0785fb64fa2bd718e7061cdb3b2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:14:59.569131Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:54:01.434942Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-09T00:14:59.569131Z","title":"Golling, T., Heinrich, L., Kagan, M., Klein, S., Leigh, M., Osadchy, M., and Raine, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03933","last_updated":"2025-02-06T10:16:27Z","snapshot_observed_at":"2026-08-09T00:09:34.598348Z","submitted_at":"2025-02-06T10:16:27Z","title":"HEP-JEPA: A foundation model for collider physics using joint embedding predictive architecture","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T00:14:59.569131Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.03933"},"observation_digest":"sha256:035a0911ae83ae1322b6018f8fd06850c2ecaf05ce449bc5e9dccd22888fbc83","observation_id":"ab95dbd2-51b2-4d76-b5d3-f2ec68c15207","resolution":{"observed_at":"2026-08-09T00:14:59.569131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-08T20:07:43.743498Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05169","last_updated":"2025-06-24T07:03:53Z","snapshot_observed_at":"2026-08-08T19:58:44.059965Z","submitted_at":"2025-02-07T18:53:03Z","title":"Flopping for FLOPs: Leveraging equivariance for computational efficiency","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T20:07:43.743498Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.05169"},"observation_digest":"sha256:ed409bc4634a826839289acd41bc570b7c074873c8a8ec7463d27fbb2a17a503","observation_id":"c9d461e5-a4b4-466e-8fa4-a76e70df02ef","resolution":{"observed_at":"2026-08-08T20:07:43.743498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-08T17:46:20.572357Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05857","last_updated":"2025-09-11T03:59:01Z","snapshot_observed_at":"2026-08-08T17:37:48.265283Z","submitted_at":"2025-02-09T11:28:57Z","title":"EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T17:46:20.572357Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.05857"},"observation_digest":"sha256:3f6a35094e3881aea3fe9050053b92972cd81c2a8d22824f0d71ac796715975c","observation_id":"666131fe-3f33-46f3-bc47-c1fc4814381d","resolution":{"observed_at":"2026-08-08T17:46:20.572357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T21:51:15.876843Z","title":"Learning and leveraging world mod- els in visual representation learning.arXiv preprint arXiv:2403.00504,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09356","last_updated":"2025-06-04T14:07:47Z","snapshot_observed_at":"2026-08-08T11:15:58.406521Z","submitted_at":"2025-02-13T14:21:03Z","title":"Galileo: Learning Global & Local Features of Many Remote Sensing Modalities","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T21:51:15.876843Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.09356"},"observation_digest":"sha256:e4769d98470b71ce99cc412c3ada84a11a507f5a3160867c9df3d2a0745dc089","observation_id":"50b6e713-4e3c-4b7d-976e-3493833bb0b2","resolution":{"observed_at":"2026-08-07T21:51:15.876843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T15:42:08.579604Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14235","last_updated":"2025-05-20T11:42:26Z","snapshot_observed_at":"2026-08-07T15:35:48.184634Z","submitted_at":"2025-05-20T11:42:26Z","title":"Toward Embodied AGI: A Review of Embodied AI and the Road Ahead","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:08.579604Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2505.14235"},"observation_digest":"sha256:a938d7c8357bef67fdd1ba3e3db2ef2b357cb44e06a01a147bca7fbe88db4fbb","observation_id":"f79ec40c-044a-4dbb-bf12-8ec53645cdff","resolution":{"observed_at":"2026-08-07T15:42:08.579604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T10:50:50.711002Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04363","last_updated":"2025-06-04T18:22:40Z","snapshot_observed_at":"2026-08-07T10:41:45.061614Z","submitted_at":"2025-06-04T18:22:40Z","title":"WorldPrediction: A Benchmark for High-level World Modeling and Long-horizon Procedural Planning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.711002Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.04363"},"observation_digest":"sha256:633d5cbbcbb0bb97e6eef94725ed7212c9d713a51e7dee0e5916c52f9795857e","observation_id":"3bb57699-b973-40f7-90e2-5082aa8596bf","resolution":{"observed_at":"2026-08-07T10:50:50.711002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2506.10137","last_updated":"2026-04-19T14:49:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T19:32:41Z","title":"Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T09:15:45.511104Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.10137"},"observation_digest":"sha256:499cad5d73b194e6fa957b778c24d9fbcfc2f638d253ab732860f92dc6a06f84","observation_id":"55e27c9b-9eed-403d-9abe-847c6b28278f","resolution":{"observed_at":"2026-05-19T09:17:14.031185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-06T23:34:35.739408Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-09T00:13:56.083722Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.739408Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:835b08c8087bf9bdb0395da462f2178eb652ec257dfb289b492e549b74d659be","observation_id":"fe9b8ed9-e92e-44c5-8d57-8c22feb906e1","resolution":{"observed_at":"2026-08-06T23:34:35.739408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-06T15:15:59.550313Z","title":"Learning and leveraging world models in visual representation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16477","last_updated":"2025-07-22T11:35:27Z","snapshot_observed_at":"2026-08-08T12:10:16.101475Z","submitted_at":"2025-07-22T11:35:27Z","title":"Adaptive Bayesian Single-Shot Quantum Sensing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:59.550313Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2507.16477"},"observation_digest":"sha256:5b12a975d5f391bf899bc867d0d8123633a5399274fc7ebb9c985f8ea31d41f0","observation_id":"2142393f-cdf3-4047-b9e9-62bba6d2dbd4","resolution":{"observed_at":"2026-08-06T15:15:59.550313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-05T21:02:04.066353Z","title":"Learning and leveraging world models in visual representation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09561","last_updated":"2025-08-13T07:29:40Z","snapshot_observed_at":"2026-08-07T09:03:01.626297Z","submitted_at":"2025-08-13T07:29:40Z","title":"Edge General Intelligence Through World Models and Agentic AI: Fundamentals, Solutions, and Challenges","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:02:04.066353Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2508.09561"},"observation_digest":"sha256:d7197b417ea2095e3b31b5f130a050a72d67e4bde64ac4a12d23c855cf2fd981","observation_id":"8c4b7613-9c3b-405e-9ea1-38a9af354aa6","resolution":{"observed_at":"2026-08-05T21:02:04.066353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2602.23058","last_updated":"2026-05-17T06:55:06Z","snapshot_observed_at":"2026-07-06T22:47:11.228912Z","submitted_at":"2026-02-26T14:42:53Z","title":"GeoWorld: Geometric World Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T11:39:15.308355Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2602.23058"},"observation_digest":"sha256:fd6b6e3093bee584256b37eee06552bef5bab845d3bb370fe1378c3baf19b238","observation_id":"d514b024-71e7-4bcf-ae08-9e502997257c","resolution":{"observed_at":"2026-05-21T11:40:03.305541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2603.07083","last_updated":"2026-04-14T13:41:32Z","snapshot_observed_at":"2026-07-06T22:48:13.053749Z","submitted_at":"2026-03-07T07:41:28Z","title":"Dreamer-CDP: Improving Reconstruction-free World Models Via Continuous Deterministic Representation Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T14:46:18.645009Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2603.07083"},"observation_digest":"sha256:62b526004a2d38cb1f4ad58df0eba1891104e51a92ae34287108a481bf135798","observation_id":"af72e11f-7161-4f5c-84ef-5a4d88bde945","resolution":{"observed_at":"2026-05-15T14:50:05.116144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-07-15T13:23:57.354325Z","title":"Learning and leveraging world models in visual representation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07245","last_updated":"2026-06-29T07:33:52Z","snapshot_observed_at":"2026-07-15T13:23:56.926410Z","submitted_at":"2026-03-07T14:55:00Z","title":"The Lov\\'{a}sz Local Lemma: Foundations and Applications","version":7},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-15T13:23:57.354325Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2603.07245"},"observation_digest":"sha256:0d5df9e3d28d25188657006abdcb5c896933fb460bbf1383395140c3fc77dd19","observation_id":"ea28cad9-d805-4107-88ef-2ed58f723149","resolution":{"observed_at":"2026-07-15T13:23:57.354325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-07-13T14:05:26.303000Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.01985","last_updated":"2026-05-29T16:27:50Z","snapshot_observed_at":"2026-07-13T14:05:19.455452Z","submitted_at":"2026-04-02T12:48:36Z","title":"World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T14:05:26.303000Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2604.01985"},"observation_digest":"sha256:0a9a7095d200f549a8841b881bcd3e4e426a7a6f72a4311e731735cc0dc21307","observation_id":"77608f92-3d42-4d3f-84fc-aca1fb80b64e","resolution":{"observed_at":"2026-07-13T14:05:26.303000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2604.06155","last_updated":"2026-04-20T15:01:48Z","snapshot_observed_at":"2026-08-06T08:19:07.908309Z","submitted_at":"2026-04-07T17:54:22Z","title":"Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:28:33.350491Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2604.06155"},"observation_digest":"sha256:fa703b23f83262bfdd26047e6b9afa30d0fa471dd8e144f87cb908f796201346","observation_id":"bfe5b756-c5e9-489b-b8cb-06e6f31b28ed","resolution":{"observed_at":"2026-05-10T22:55:49.618449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.03245","last_updated":"2026-05-05T00:26:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T00:26:57Z","title":"Text-Conditional JEPA for Learning Semantically Rich Visual Representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T17:58:43.650308Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.03245"},"observation_digest":"sha256:e8746a5f7525fc4977e5c14f50d016f7788de7e687720df44f798cdf1a46c7c5","observation_id":"2e316451-1292-403a-9c68-42a607d3890f","resolution":{"observed_at":"2026-05-12T10:51:30.669233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.05586","last_updated":"2026-05-07T02:11:26Z","snapshot_observed_at":"2026-08-07T18:58:17.371194Z","submitted_at":"2026-05-07T02:11:26Z","title":"AeroJEPA: Learning Semantic Latent Representations for Scalable 3D Aerodynamic Field Modeling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-09T15:53:39.074115Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.05586"},"observation_digest":"sha256:9b01b938b77d3f399df6d8530d4376c0fbc96b6f179953b6deec64d4044a58c9","observation_id":"97cf2300-0297-4178-aee3-a1a1c256227f","resolution":{"observed_at":"2026-05-11T16:36:09.268171Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.07199","last_updated":"2026-05-08T03:47:44Z","snapshot_observed_at":"2026-08-05T15:54:57.136857Z","submitted_at":"2026-05-08T03:47:44Z","title":"Three-in-One World Model: Energy-Based Consistency, Prediction, and Counterfactual Inference for Marketing Intervention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T02:45:08.315949Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.07199"},"observation_digest":"sha256:2f5a4c5c4f4e0376c02bdb7acab79b5ac33b458852c355cd2230ec7ba32f3052","observation_id":"0ac542cf-51b9-4b4e-ab99-c002c070c6be","resolution":{"observed_at":"2026-05-11T02:45:56.722986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.21800","last_updated":"2026-05-20T22:58:15Z","snapshot_observed_at":"2026-07-06T23:32:10.472558Z","submitted_at":"2026-05-20T22:58:15Z","title":"stable-worldmodel: A Platform for Reproducible World Modeling Research and Evaluation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T08:57:19.834179Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.21800"},"observation_digest":"sha256:af75d3e9141aa90f4b4c2d1a9dd26f3805d358c5021e9c80e13bc4fb4ef4f01e","observation_id":"e15ea76d-f0a4-4cbf-891e-a37ec1d21076","resolution":{"observed_at":"2026-05-22T09:01:20.317075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.26282","last_updated":"2026-05-25T19:06:51Z","snapshot_observed_at":"2026-08-02T12:16:30.744884Z","submitted_at":"2026-05-25T19:06:51Z","title":"Scaling World-Model Reinforcement Learning Through Diffusion Policy Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T22:46:27.179341Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.26282"},"observation_digest":"sha256:465a897584ec8585a071fd64d1d15837bc0f0f37bfb0e8a4227e19593e005454","observation_id":"06811cd5-d8df-4689-8b43-e50da9c52169","resolution":{"observed_at":"2026-06-29T22:54:01.436526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.26478","last_updated":"2026-05-26T02:35:08Z","snapshot_observed_at":"2026-08-02T15:14:06.593016Z","submitted_at":"2026-05-26T02:35:08Z","title":"Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T17:34:41.053725Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.26478"},"observation_digest":"sha256:bc4d8ba6f3d6722ace87e8780d14d20b46b2a04c954d783120f7b013e4226942","observation_id":"b0a6b739-b7b2-4d13-b0b2-535669071ff7","resolution":{"observed_at":"2026-06-29T18:03:48.594049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-07-11T22:20:52.422988Z","title":"arXiv preprint arXiv:2403.00504 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04011","last_updated":"2026-07-04T20:13:38Z","snapshot_observed_at":"2026-08-06T03:55:35.624754Z","submitted_at":"2026-07-04T20:13:38Z","title":"Separating Representation from Reconstruction Enables Scalable Text Encoders","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T22:20:52.422988Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2607.04011"},"observation_digest":"sha256:b1e542e7f7cc9c33ec5f32410ace8b6d5dcdeee5331153b92949a39f72a781c5","observation_id":"2574f0cd-bd8d-4b30-aaf4-6750e568f37e","resolution":{"observed_at":"2026-07-11T22:20:52.422988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-08T18:42:36.975241Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04378","last_updated":"2026-08-05T02:38:20Z","snapshot_observed_at":"2026-08-08T23:11:33.639984Z","submitted_at":"2026-08-05T02:38:20Z","title":"Helping Music Co-Creation Agents 'Listen' Well: Hierarchical Self-Supervised World Models for Understanding and Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T18:42:36.975241Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2608.04378"},"observation_digest":"sha256:6a95b0a4e965a3ca218e7a5f629ab5f41501757ffa278fc12bfe88b3adbe1d8b","observation_id":"ec1dd9e5-264d-4417-b06f-3f8a9553fca9","resolution":{"observed_at":"2026-08-08T18:42:36.975241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T23:47:03.495059Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05774","last_updated":"2026-08-06T09:09:16Z","snapshot_observed_at":"2026-08-09T01:11:07.607935Z","submitted_at":"2026-08-06T09:09:16Z","title":"SR-JEPA: Learning Predictive Latent State in 3D Scenes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T23:47:03.495059Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2608.05774"},"observation_digest":"sha256:aff6d60cddcdbb923eff4d665d5bf7393023ab3e65987b30e902290191be0b6c","observation_id":"d1c13e67-c5d0-4a44-868a-e50868c7a153","resolution":{"observed_at":"2026-08-07T23:47:03.495059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T13:26:05.346601Z","title":"arXiv preprint arXiv:2403.00504 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06174","last_updated":"2026-08-06T15:38:55Z","snapshot_observed_at":"2026-08-09T01:12:31.712404Z","submitted_at":"2026-08-06T15:38:55Z","title":"Support Operation Factorization: Compositional Readout of Frozen Vision Encoders under Controlled Interventions","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:26:05.346601Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2608.06174"},"observation_digest":"sha256:bfe932af1b2a83c47d16ae8befeccb0b7137c31f9e983de6bf5b4bde05b3adaa","observation_id":"700efa35-9b9f-459d-b5a9-e33df4471b86","resolution":{"observed_at":"2026-08-07T13:26:05.346601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.00504/citation-record","integrity":"/paper/2403.00504/integrity","json":"/paper/2403.00504/citation-record.json","paper":"/paper/2403.00504"},"outbound":[],"paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2403.00504."}