{"as_of":"2026-08-17T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9161a10c99f871d3c1710f70ae35ad16b1f73652d257973fbd4eb4ad51062fe","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:58:55.108117Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19272/citation-record","integrity":"/paper/2507.19272/integrity","json":"/paper/2507.19272/citation-record.json","paper":"/paper/2507.19272"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.050673Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.050673Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:cb05b54291d8dc80a9cd5fc37d31bfd08b35e82f238cb524fe7e0aade6ba3704","observation_id":"bfcf75cb-d43f-47e0-b9d3-8b10cf4c9290","resolution":{"observed_at":"2026-08-15T17:58:55.050673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.287354Z","title":"Is space-time attention all you need for video understanding? In Int","venue":null,"work_id":"9343f1ba-e1f6-4b68-aa5e-80ec04eb6cbb","year":2021},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.055634Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:05ff6f7ab222e50394a33465fc9715bf341427fc384f18f1ba76baa0b58b011f","observation_id":"8b660612-c5ce-4494-bfa4-5a2cba8a2f4d","resolution":{"observed_at":"2026-08-15T17:58:55.291087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-15T17:58:55.060038Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.060038Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:16b51530f22bf08d0da940a5882619ef5e0d9d056b58b5c5ede6913120e88bea","observation_id":"ed306bc6-73a7-48ad-8721-6ac96472f44c","resolution":{"observed_at":"2026-08-15T17:58:55.060038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.276277Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"41e7f98c-b860-482e-933f-b77176c4a02c","year":2021},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.064441Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:41b3ccfc5a384e69f659c090171d12cf11ab5b4ccea616ab224f18b5a1c0fefd","observation_id":"4f2b75b1-5241-4036-9008-5a474738a922","resolution":{"observed_at":"2026-08-15T17:58:55.280285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.265492Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"94ee18fb-f107-4cbe-8ea9-494a5a455022","year":2020},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.068785Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:33d7eef20e2159df49c5efb371878b4da0622d42b574cd3dea4829433cd42e27","observation_id":"aa7446f8-5aab-44ff-976e-f8f68f1426aa","resolution":{"observed_at":"2026-08-15T17:58:55.269239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.255166Z","title":"D., Azar, M., Piot, B., Guez, A., Pietquin, O., Kavukcuoglu, K., Larochelle, H., Lanctot, M., and Schmitt, S","venue":null,"work_id":"4efb612e-84e7-44b5-bc55-2042d95cc7db","year":2020},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.072458Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:0cd406c015e64c1f9e78ca13aa1132b792d3a29f437f4338cd1cca5d6e16071d","observation_id":"8e0f28cf-34e2-417c-b2bb-6cd6b7121538","resolution":{"observed_at":"2026-08-15T17:58:55.258755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.244436Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":"791bee3c-f1a9-4d0e-a69b-d22450e3d5fe","year":2020},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.076134Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:1bd979e9533b14edbc780660038765a519bdfba5aed54d300f0056e75217145c","observation_id":"2e0ea032-bb93-45ff-bd47-b3f46752b1af","resolution":{"observed_at":"2026-08-15T17:58:55.248426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.232151Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"97ac1452-d160-4ad2-afed-35ac788904ed","year":2022},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.079896Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:cdbaf44f6c56117571024580761f9593f32906b221ca4fd865226e0627544873","observation_id":"51d9fb25-86d2-4071-89c9-fc4618d8b646","resolution":{"observed_at":"2026-08-15T17:58:55.235878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-15T17:58:55.083303Z","title":"J., Pertsch, K., Karamcheti, S., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.083303Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:e2c9ec9ce9786b4719e90a1a69722c85449e841c6752dec463a2a15f7dd66b01","observation_id":"a2099768-c268-4881-98c8-8ccc683a90d9","resolution":{"observed_at":"2026-08-15T17:58:55.083303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.221057Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"73ca3cd8-157a-469f-ac24-69bf491a23d3","year":2014},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.086887Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:2a3428a9327baccd64e59acc3ebfa0f7815fbace8c5553ffcd79a2e2cf5c5de2","observation_id":"dde729be-0cd1-4fc8-8dba-540d12f3b92f","resolution":{"observed_at":"2026-08-15T17:58:55.224981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-15T17:58:55.090266Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.090266Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:98c7a7c51ec41b5dec317b08de6bc03affa51ce9c30b15481db94c8378754df9","observation_id":"f5658ec1-fdaf-4ff5-8ede-dde97edde8d1","resolution":{"observed_at":"2026-08-15T17:58:55.090266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.209579Z","title":"N., Carreira, J., Asano, Y","venue":null,"work_id":"065e3831-cc16-4d38-ae3a-7d5b6ad715d6","year":2024},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.094026Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:4961c787e0f8deb9686b9659cd73e1bd727febd2edcc943990bc4d84a802002f","observation_id":"5364f2c5-c786-426f-afe3-8582d461064b","resolution":{"observed_at":"2026-08-15T17:58:55.213746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11208","last_updated":"2025-04-23T07:57:34Z","snapshot_observed_at":"2026-08-17T16:25:44.238596Z","submitted_at":"2024-08-20T21:40:48Z","title":"PooDLe: Pooled and dense self-supervised learning from naturalistic videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11208","snapshot_observed_at":"2026-08-15T17:58:55.097437Z","title":"N., Hoang, C., Xiong, Y., LeCun, Y., and Ren, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.097437Z"},"links":{"cited_paper":"/paper/2408.11208","citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:db14fa76df74f18a5cccc7de21a9f62702c9b6aadbeb8412459c897a0a4ace83","observation_id":"009bef87-049d-404a-a877-e6bf31408bc1","resolution":{"observed_at":"2026-08-15T17:58:55.097437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.198631Z","title":"Masked feature prediction for self-supervised visual pre-training","venue":null,"work_id":"c1e1c002-4d63-4077-8741-6e319656db72","year":2022},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.101104Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:6d9f3b26761a46c70c3e3b80667f7ced57db58ad37013f78a266f4597785f223","observation_id":"998ef1dc-dc3c-43e8-8fb2-024b66cfdcc4","resolution":{"observed_at":"2026-08-15T17:58:55.202428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.186969Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":"e6980668-ef6e-496f-a3dd-be0eba5663f6","year":2017},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.104774Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:d18e30195fbb0868a7fd4c95bf84736373b742675f5a2a4629be7f0ea684387d","observation_id":"0665c5d8-5310-46c3-8930-89f9b8937e23","resolution":{"observed_at":"2026-08-15T17:58:55.191344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:55.174314Z","title":null,"venue":null,"work_id":"e10f55c1-917e-4cdc-91f8-bc09242b41a3","year":2022},"citing_paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T17:58:55.108117Z"},"links":{"citing_paper":"/paper/2507.19272"},"observation_digest":"sha256:1f1e72c9721f3ddfd9c3f4aa9ce11f04d8ffefd6f79497824c9e921ceeb5cd32","observation_id":"08047d75-6a29-49d1-9617-8335d43e76fd","resolution":{"observed_at":"2026-08-15T17:58:55.178854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.19272","last_updated":"2025-07-25T13:52:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T12:58:19.754976Z","submitted_at":"2025-07-25T13:52:31Z","title":"Video Self-Distillation for Single-Image Encoders: A Step Toward Physically Plausible Perception"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2507.19272."}