{"as_of":"2026-08-08T11:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bb62638d1fcf81e07a1cca648bf39705abc285fbd64271d56db1d35dca1f28c","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:31:31.198783Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21635/citation-record","integrity":"/paper/2505.21635/integrity","json":"/paper/2505.21635/citation-record.json","paper":"/paper/2505.21635"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:24.959654Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:24.959654Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b929062b28646908229c6da3b795ff11ae9f4bb55f1a48362bbc3e5b7fcec48e","observation_id":"5fd357de-3731-4840-bb5e-0aa24b0fd64b","resolution":{"observed_at":"2026-08-07T13:31:24.959654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.654320Z","title":"BEiT: BETR pre-training of image transformers","venue":null,"work_id":"d872b7fa-892e-4b01-bf39-3d250aa65db4","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.037549Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c3d081db525bcb4b81766d415ac940b83b24bdbfeb984f8ea7345d1f1a51f528","observation_id":"dc3d8099-e5cd-4c76-86d2-9818886a70de","resolution":{"observed_at":"2026-08-07T13:31:41.770579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.465911Z","title":"Revisiting feature prediction for learning visual representations from video","venue":null,"work_id":"9b4f1114-4075-4f21-9d92-2c4732644b46","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.131048Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:5b83f5b529b16a9ca894d713b7e680f327b10d4478be247ac75cd45e96bdae91","observation_id":"9b478194-a2be-470c-9f9e-40be4368986e","resolution":{"observed_at":"2026-08-07T13:31:41.540832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.233526Z","title":"Unsupervised scale-consistent depth and ego-motion learning from monocular video","venue":null,"work_id":"220c1f1d-22a8-41c6-9bd9-0ab439694c64","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.263015Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:5314ec2187db7b13ff8fdc449fb6697c9b7627dfec8e01fee37c8be967298b87","observation_id":"dc252626-206f-42fb-9343-e6b1a23c1fe0","resolution":{"observed_at":"2026-08-07T13:31:41.355144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11390","last_updated":"2019-01-22T18:55:34Z","snapshot_observed_at":"2026-07-06T07:30:18.170401Z","submitted_at":"2019-01-22T18:55:34Z","title":"MONet: Unsupervised Scene Decomposition and Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11390","snapshot_observed_at":"2026-08-07T13:31:25.335860Z","title":"MONet: Unsupervised scene decomposition and representation.arXiv preprint arXiv:1901.11390, 2019","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.335860Z"},"links":{"cited_paper":"/paper/1901.11390","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:0af067a9d82c1f63c9d21e26f0bab68f62c10ce070bd62be890acd94dd635dbf","observation_id":"2f8ad3a3-8f2d-4afa-ac96-247c37371926","resolution":{"observed_at":"2026-08-07T13:31:25.335860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.057406Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":"fe8c2ab3-9f88-4609-9558-690234b463f6","year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.453406Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:0fb2f922aa0e11bdd9cf9752ff873b1ecf36384fe7a8f344b2b8a16389efa40d","observation_id":"41674d50-5a4a-4e80-88f8-edada8952d27","resolution":{"observed_at":"2026-08-07T13:31:41.140108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:25.503315Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.503315Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:8a10b0a023f7f79cddad00512fa937f8c8c40c9b4a3521fecad2bbff628eec04","observation_id":"74d62430-3f13-4972-a054-7722a8dab393","resolution":{"observed_at":"2026-08-07T13:31:25.503315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:25.617462Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.617462Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:73078501b4f0a74ad12038e47852a3e422bc38aa734305fb23f23b3f5a32ee94","observation_id":"367d2663-6682-4574-8e60-9572d806d3dd","resolution":{"observed_at":"2026-08-07T13:31:25.617462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-07T13:31:25.660743Z","title":"Improved baselines with momentum contrastive learning.arXiv preprint arXiv:2003.04297, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.660743Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:1e3184b92fe44be499cc61b3d7cac81e5098a3230393192b4df16ba1ae85bd50","observation_id":"ca831bed-ee46-4602-af1a-45dbc4998aa5","resolution":{"observed_at":"2026-08-07T13:31:25.660743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.845255Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":"b510b272-1ce1-461e-b8d6-0ad107909572","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.699470Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:355f4d1e68ffc0545d540666f5307dd242b1bceb1020b7498f002084d74e84cf","observation_id":"987542f9-5d20-4580-a4df-e3f200263297","resolution":{"observed_at":"2026-08-07T13:31:40.915105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.633500Z","title":"OpenMMLab’s pre-training toolbox and benchmark","venue":null,"work_id":"67dab3bd-efa6-43c7-a97e-d0910d8d2d9a","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.768737Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:cfb813a0b5ea159d7be278ecca1549df2a841d13103e8fc643652330ab6e65cc","observation_id":"8c107250-60bc-4791-aa39-c279a28afb1b","resolution":{"observed_at":"2026-08-07T13:31:40.745501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.450741Z","title":"Vision transformers need registers","venue":null,"work_id":"8dabb439-40bb-48c4-a01f-43f263d85b58","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.820081Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:7c143e9c46e363c2290d82b351fad82890627aa84f5e76b57d46503221a001e7","observation_id":"1f827847-6e7f-4702-a208-5f1cce0cf65b","resolution":{"observed_at":"2026-08-07T13:31:40.545930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:25.848360Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.848360Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c9ee8ed7f54dbbd54d7afa77c4544111f25ca52e256afce7888552d3b67451c2","observation_id":"fb463561-fcb5-4078-b6e9-2564cc528622","resolution":{"observed_at":"2026-08-07T13:31:25.848360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.235784Z","title":"With a little help from my friends: Nearest-neighbor contrastive learning of visual representations","venue":null,"work_id":"2244704f-166f-4e38-a1d1-bbfe2a9dfe24","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.883256Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:9be0d35374ecdee5778c2b1eb343837cf220464d14ed923b7856f3ad5d746f33","observation_id":"182d59d3-822f-44dc-8dab-879747bc7c1a","resolution":{"observed_at":"2026-08-07T13:31:40.330063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.030942Z","title":"Depth map prediction from a single image using a multi-scale deep network","venue":null,"work_id":"dd9744f2-dac0-4e1d-9d34-fb4ffda84b73","year":2014},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.934891Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:242a1e6ea4b4ac941fc05fea24922164ae298a9125252186c20719375ae235be","observation_id":"130a40f6-3018-45ce-9c0b-d42fcb09ea9b","resolution":{"observed_at":"2026-08-07T13:31:40.127745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.811322Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"c9ef36c2-133f-425a-8515-e54261631515","year":2012},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.004386Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:83e64997346f10879e690f3b544a058d1ede7ba38d88d021c2c0f9e87906e741","observation_id":"cb2f33ba-6537-4fff-83d3-a2d553ddcdbd","resolution":{"observed_at":"2026-08-07T13:31:39.904187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.048537Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.048537Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:8e272dfa4682c85f4321167a3f188b38961e75851079265d2df34837ff74ed3e","observation_id":"2ef800fa-9091-4d46-8aa0-cf14202f051d","resolution":{"observed_at":"2026-08-07T13:31:26.048537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.620885Z","title":"Multi-object representation learning with iterative variational inference","venue":null,"work_id":"611715e3-aecb-488e-8a65-8822375a7741","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.100916Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:a9e96f66bff741e318b8f7f11f6f8a225d64cfe6ca83dd6b1d66e0c6c78f0edd","observation_id":"c348f0ff-0e14-4c36-a98e-0a3b59b18c23","resolution":{"observed_at":"2026-08-07T13:31:39.695669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.394596Z","title":"Bootstrap your own latent-a new approach to self-supervised learning","venue":null,"work_id":"6c1928f8-e0d8-4049-a2f2-2dbc95c300b9","year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.149515Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:833c4e055a8439529e5bd4f7742fc220885fe2b3540d8b08693fdbac7d4ea933","observation_id":"1453dc1b-d073-4fb8-913b-54b43d54dfbb","resolution":{"observed_at":"2026-08-07T13:31:39.498278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.204237Z","title":"Tan et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.204237Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:8c6898323884b0386e22a30f35d1b7676f21f8bed2fde62ebb852be761aab074","observation_id":"b63f46ec-d330-4df1-b2f3-4dee58d6c1c1","resolution":{"observed_at":"2026-08-07T13:31:26.204237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.255690Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.255690Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:8065f3b81ac5f5d0fdc91e343fec9e5d8fe369f8a7b897b282f2d5960958bff9","observation_id":"9d61bc25-3162-4c50-818c-440470da75bb","resolution":{"observed_at":"2026-08-07T13:31:26.255690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.309810Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.309810Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:12321efc84056dd132a0d625f11ab09d02aeddff9af949934bafc696df488eed","observation_id":"6c3f7287-38ea-4c0e-b515-4b2e0f83860c","resolution":{"observed_at":"2026-08-07T13:31:26.309810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.387778Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.387778Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:a77438b4b63ee3897def04aef0d2ab70332d53a8bf541486e883a7588f59da9a","observation_id":"f6b08049-a3e0-4e6f-8a0f-3146748cdcc3","resolution":{"observed_at":"2026-08-07T13:31:26.387778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.213021Z","title":"Development of perceptual completion originates in early infancy","venue":null,"work_id":"6c303591-3b7d-4de3-8509-b98609d7c462","year":2003},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.456219Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:f9b76c45d70118c09200fcda5a70c02d85d29408359a557cd81333ad42942b83","observation_id":"09e66b67-0716-46a8-8cd1-dc50a777bb47","resolution":{"observed_at":"2026-08-07T13:31:39.271530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.018706Z","title":"Discriminative clustering for image co-segmentation","venue":null,"work_id":"be03bbfe-def3-4908-9e7d-b917cbe2c681","year":2010},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.523767Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:3b14a5280f32b5ea85a5704a6b91d66e4038596e3315a99619e9ca56f8c8438d","observation_id":"efb7751b-a93a-4629-9f94-4d9072972030","resolution":{"observed_at":"2026-08-07T13:31:39.099997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.823496Z","title":"Multi-class cosegmentation","venue":null,"work_id":"017e150d-9b4d-4c51-b642-4df490bd1f3e","year":2012},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.614586Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:5f90fd021ac5ef329996773e9b7eefdccc9dd8f01d7aa5b000cece67c02e3933","observation_id":"9384502d-7bd8-4301-8a45-44e73897bda4","resolution":{"observed_at":"2026-08-07T13:31:38.910704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.646550Z","title":"Perception of object unity in young infants.Infant Behavior and Development, 11(2):161–180, 1983","venue":null,"work_id":"bcd70d9b-f083-41fb-bda6-553ec190f489","year":1983},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.681207Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:74977bc6bfaaf93f4a46fc52bad380b5c634c1ade91134693b4dfdd18ca5fec8","observation_id":"f01fd727-cb17-403f-801d-073de1e6a5b1","resolution":{"observed_at":"2026-08-07T13:31:38.721723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.460318Z","title":"Panoptic feature pyramid networks","venue":null,"work_id":"4234edb4-7f9c-419f-a72a-682a3af5cb92","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.779367Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:237dd6f6575bba4c7570d3a90837ec05c9fab583d3a80b0b38020fbf09986732","observation_id":"39d4670e-bed4-440b-8cc3-65324ed15106","resolution":{"observed_at":"2026-08-07T13:31:38.561060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.247676Z","title":"A new neural framework for visuospatial processing.Nature Reviews Neuroscience, 12(4):217–230, 2011","venue":null,"work_id":"bff9b50c-25c2-4897-8f40-35c39ebe39a5","year":2011},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.877509Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:7dcd986d59b9c11f5fcbd41d97355d2f16f14aa352067b8c7bc0d876b2a1e5c5","observation_id":"0b13f8de-d537-4522-a251-b8a0f0294a7a","resolution":{"observed_at":"2026-08-07T13:31:38.336543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.029737Z","title":"Segment and recognize anything at any granularity","venue":null,"work_id":"2ffde959-3cb8-4857-bb30-4e66e77d5d5d","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.000781Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:526b8cbfd4f85dc82f713f15c91776f2547bbdcd2ea5927940ec0e246ee15add","observation_id":"c72457b6-7742-449a-825b-e699bc331260","resolution":{"observed_at":"2026-08-07T13:31:38.137101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.816091Z","title":"BEVFormer: learning bird’s-eye-view representation from LiDAR-camera via spatiotemporal transformers","venue":null,"work_id":"1522906c-ba6a-4559-99f9-3bdc7b0cd5cf","year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.085881Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:2900078abdd33701f225f496e5ca0a9038a7f42bd0a5c6619d9dd21ce78c64d9","observation_id":"a3395514-81c3-4f90-abbd-7c1c1c3eb224","resolution":{"observed_at":"2026-08-07T13:31:37.901881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.672440Z","title":"V A-DepthNet: A variational approach to single image depth prediction","venue":null,"work_id":"ef730347-efe5-4110-98de-9dd3f1259ae4","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.168533Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:2ea10a50cb82329a838fc33ca12ba724891b5c645ebd212b0b714668e0bb1129","observation_id":"1b330a99-952b-41e5-a417-4677851be292","resolution":{"observed_at":"2026-08-07T13:31:37.740810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.228242Z","title":"Fully sparse 3D occupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.228242Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:6b0a960978ee73edfee6347d280cde1a5a1bdbaea4e1268859bd130ae3a4c789","observation_id":"1c10159c-a77b-40b3-8246-b3c3ce8315a6","resolution":{"observed_at":"2026-08-07T13:31:27.228242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.320898Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.320898Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:2ea193a093e47c0a55ab764864555c45478cfae159360de20067d2f14387cfa1","observation_id":"b361d8db-31cd-4ae9-9a13-2a22f523eb84","resolution":{"observed_at":"2026-08-07T13:31:27.320898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.402700Z","title":"Object-centric learning with slot attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.402700Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:91eeb2403a44b79e69310fa29b07eeb51dbdae59c76690df37699be26b9bed0c","observation_id":"c7162666-a6f9-4628-a487-d6296fb7958a","resolution":{"observed_at":"2026-08-07T13:31:27.402700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.510348Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.510348Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:29f886100f9f07b8c47e42a90a7358e02585eec6e929cb464f26cca3ca14272e","observation_id":"93be6318-245c-4d2f-a569-ed7dede62ad2","resolution":{"observed_at":"2026-08-07T13:31:27.510348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07376","last_updated":"2025-02-14T22:53:14Z","snapshot_observed_at":"2026-07-06T17:28:39.754296Z","submitted_at":"2024-02-12T02:16:59Z","title":"Unsupervised Discovery of Object-Centric Neural Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07376","snapshot_observed_at":"2026-08-07T13:31:27.621968Z","title":"Unsupervised discovery of object-centric neural fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.621968Z"},"links":{"cited_paper":"/paper/2402.07376","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:bac41a6bdbaf3fa9c01147d46aedc4199fb9ab02fc291c8e0c6215f38ef56084","observation_id":"4a069e75-9087-424b-a238-72006426dccf","resolution":{"observed_at":"2026-08-07T13:31:27.621968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.399679Z","title":null,"venue":null,"work_id":"a4f2f29b-418e-4973-ba12-54f7321750ed","year":1982},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.718498Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:4af0f809b41decda6af0956a96851f4875fa97af3086c671ce599c694d8ed63f","observation_id":"5dd5e13f-fbbf-4ac1-84c3-ebfcbe9f2daf","resolution":{"observed_at":"2026-08-07T13:31:37.534968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.226265Z","title":"Object exploration and object knowledge in young infants: A view from developmental psychology.Cognition, Brain, and Consciousness, 2001","venue":null,"work_id":"bc78c1f6-6d7a-4225-866b-f3be1773ec9c","year":2001},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.846082Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:ed72f9ff27486a9b7656d0132d152bcbabd26f0edccbfb34cf5ca2b151541d11","observation_id":"b30abedf-6f88-4f9c-a379-b930d45a8ea0","resolution":{"observed_at":"2026-08-07T13:31:37.299495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.996903Z","title":"DINOv2: Learning robust visual features without supervision.TMLR, 2023","venue":null,"work_id":"854cef13-5653-4eea-b09d-2ef16790709c","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.961306Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:889c145c559204547f4258518066325e3e3acb8f8db510c122508750e5a7ed91","observation_id":"0223579e-6e19-4af2-b1c3-b4514d2cc701","resolution":{"observed_at":"2026-08-07T13:31:37.101874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.844558Z","title":"Open X-embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":"e388568a-7ca9-4caa-b308-6b6e07265d23","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.093616Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:9ceea1e7be7816d8f63b15ff7f17571538f6c2206e65e8b1da67d1a5a81e2137","observation_id":"d5731c95-059d-4853-8bcc-8c31c362b2da","resolution":{"observed_at":"2026-08-07T13:31:36.911664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:28.179885Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.179885Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:349e4b2e2ae2df7e5afecee36fe6b2528574d40103f635d21025a3a6bb672470","observation_id":"15267dab-a6a4-4e56-b035-1b4ae27bb243","resolution":{"observed_at":"2026-08-07T13:31:28.179885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06366","last_updated":"2022-10-03T11:47:10Z","snapshot_observed_at":"2026-08-04T18:14:09.239336Z","submitted_at":"2022-08-12T16:48:10Z","title":"BEiT v2: Masked Image Modeling with Vector-Quantized Visual Tokenizers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.06366","snapshot_observed_at":"2026-08-07T13:31:28.288089Z","title":"BEiT v2: Masked image modeling with vector-quantized visual tokenizers.arXiv preprint arXiv:2208.06366, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.288089Z"},"links":{"cited_paper":"/paper/2208.06366","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c14affaebbc3b998d80aa4a727f7f3a3b6e90281f27d239e6f78db4b2b71d80a","observation_id":"955c7340-0723-4556-a397-3d843f9d872e","resolution":{"observed_at":"2026-08-07T13:31:28.288089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:28.384396Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.384396Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:8b719ff5d6fd66bd4b5d4996fe3419cb947ca3adf1fd0285ef0b702d3835ff47","observation_id":"7256f0b5-9b90-43af-aae1-89a95a0585ec","resolution":{"observed_at":"2026-08-07T13:31:28.384396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.663855Z","title":"NDDepth: Normal-distance assisted monocular depth estimation","venue":null,"work_id":"38417d23-9d49-4b63-8c3c-b2f6ed325b05","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.478170Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:573a37abd034fa10c0bf5d6ba6bbfc4634cbbb9419796431924a6e6998750207","observation_id":"5037b5c7-4e9a-43f3-a1b9-d3a46c9fbc6f","resolution":{"observed_at":"2026-08-07T13:31:36.729101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.509921Z","title":"IEBins: Iterative elastic bins for monocular depth estimation","venue":null,"work_id":"3a87a9c1-58ba-4936-a729-ef02c82273e4","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.579175Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:5e6a0f02580530a7e5cb1f5016ffd0820c8c1a7ea1064585dd85c24e371f73e3","observation_id":"5fd24125-f097-4c22-8dcc-393a096c37d6","resolution":{"observed_at":"2026-08-07T13:31:36.577751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.379748Z","title":"VideoFlow: Exploiting temporal cues for multi-frame optical flow estimation","venue":null,"work_id":"4bd6bad8-5499-4321-abf5-6a9578b7ee2b","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.661345Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:463a05005763e94f6ad2ec2708e62d8178d54551ddfaf3b969cca822956dc995","observation_id":"f270a981-92e5-4ecf-8658-7fcb3f16325a","resolution":{"observed_at":"2026-08-07T13:31:36.444296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.227869Z","title":"Localizing objects with self-supervised transformers and no labels","venue":null,"work_id":"9cb51ce2-8872-431e-ba92-60b8cddb572f","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.758526Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b87cd7be1c01609f0c0bb45b4139c493bbb7b4ac46dba26391ab48fca72ca2bf","observation_id":"6de36e87-8e12-4367-b9cc-f62b9f259266","resolution":{"observed_at":"2026-08-07T13:31:36.308055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.086534Z","title":"Locate: self-supervised object discovery via flow-guided graph-cut and bootstrapped self-training","venue":null,"work_id":"2a03b6aa-163c-4358-85c9-fdafc7df9a6c","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.826708Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:eb2a4e50801f781f9bd47406f579c2e4fcd69280b81ab172c82754d646ba9f44","observation_id":"49f39d0c-8684-4f13-a70e-45180f216b3c","resolution":{"observed_at":"2026-08-07T13:31:36.151687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.915024Z","title":"Selective search for object recognition.IJCV, 104:154–171, 2013","venue":null,"work_id":"7e803925-f0f4-4a47-abec-4a749deea9f1","year":2013},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.987102Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:08af84d8396814c7c9dd0847651237e2baf1e3ce9f09eccddbc50b234de5c44e","observation_id":"423b56ea-86e3-420f-973e-3e02bb38d5b5","resolution":{"observed_at":"2026-08-07T13:31:36.002078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.802767Z","title":"Two cortical visual systems.Analysis of Visual Behavior, 1982","venue":null,"work_id":"b672f0a3-4ac9-4f34-8a8f-77ff03b6f9b9","year":1982},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.109536Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:89d1cd4529e1c0f7c7afbe6ef4fd176097be193c80bd1d0fdd3d3b6ad18d2007","observation_id":"415edad0-0c63-4217-86d2-652538c6a744","resolution":{"observed_at":"2026-08-07T13:31:35.855718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.576766Z","title":"Object cosegmentation","venue":null,"work_id":"96a671f9-face-482c-ba67-f0ab79188352","year":2011},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.212078Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:3016b245185c686759275a34dc2bb462bff9a956a6bea007729649d4672380ef","observation_id":"2c989a00-2d3c-4693-a7a4-91c1859f5425","resolution":{"observed_at":"2026-08-07T13:31:35.687583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.384249Z","title":"Unsupervised image matching and object discovery as optimization","venue":null,"work_id":"884e98a3-bdc6-4eab-848d-56f6b54a7767","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.351351Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:7be294b032e6a1206c8ec53d53af921cf2798e3d3979189272ce1f085423e2d0","observation_id":"b967e307-cdea-4207-82d2-8c51ec60c8c9","resolution":{"observed_at":"2026-08-07T13:31:35.469892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.148239Z","title":"Large-scale unsupervised object discovery","venue":null,"work_id":"5afb0482-c031-423c-a9a0-7b8da430c56a","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.471213Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:a6d3dbb2e095df5e156ac045fedd9f3ae67aac596ccf8a1858cd85869f87b2f0","observation_id":"32692875-99c1-402e-8568-ee4243526bc6","resolution":{"observed_at":"2026-08-07T13:31:35.276939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.915020Z","title":"DCDepth: Progressive monocular depth estimation in discrete cosine domain","venue":null,"work_id":"7290ffec-c7fe-449f-9ef1-4e573f3e9ecf","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.601614Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:751183ace7ce0440f115dbd5d260e64271e644e36c4681a6bba53ade855a14f3","observation_id":"afac61fc-ddc4-4291-9f78-3d238a9f54a3","resolution":{"observed_at":"2026-08-07T13:31:35.032382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.717076Z","title":"Image as a foreign language: BEiT pretraining for vision and vision-language tasks","venue":null,"work_id":"42d94920-35d1-4e81-8ffe-6e876bf070c7","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.683893Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:cad0262e68797702ee378df091de6fcdfc48bc9b97a0dcd7c69a7e4ee819a9ab","observation_id":"31f7f0cf-56ce-4c84-a849-b2b93a012987","resolution":{"observed_at":"2026-08-07T13:31:34.808549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.387848Z","title":"Self- supervised transformers for unsupervised object discovery using normalized cut","venue":null,"work_id":"e6854624-19b8-4f26-8a1f-576fd734949e","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.787260Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:0a16bd5f9e442b22a63dfdb5bd150983be0cd7fcb1adeeefd5636e7db3d9438f","observation_id":"5eaa2410-9f72-413f-8eff-8f9dad482392","resolution":{"observed_at":"2026-08-07T13:31:34.540007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.068286Z","title":"TokenCut: Segmenting objects in images and videos with self-supervised transformer and normalized cut.TPAMI, 45(12):15790–15801, 2023","venue":null,"work_id":"36156608-9ae7-4d7d-b73e-0d60d16d05bc","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.913540Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:659a1cfcc5bd168348bf931808518db3899615d691397b7a5ea049aac8965323","observation_id":"4b457c8d-fac7-4b1e-9c77-e103d6702bee","resolution":{"observed_at":"2026-08-07T13:31:34.244426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.810056Z","title":"4D unsupervised object discovery","venue":null,"work_id":"eb05e683-9362-4375-9b48-4966f791cde4","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.012538Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:db74ef8bab211f80f7ad16976697dbba60a9cdca00877cb7882d2d22f1446171","observation_id":"88705376-2756-4163-ab9a-541f581f74ad","resolution":{"observed_at":"2026-08-07T13:31:33.933268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.545874Z","title":"Unsupervised object discovery and co-localization by deep descriptor transformation.PR, 88:113–126, 2019","venue":null,"work_id":"80aea961-e776-4525-b181-cc497325f69e","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.043731Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:64ea488b83a66a736be7a9d063f9be6c811f4a3dfee22791b1804c8269f3bf31","observation_id":"7bb5eaf4-9626-479b-995f-d229f2559e09","resolution":{"observed_at":"2026-08-07T13:31:33.684195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.205242Z","title":"CroCo: Self-supervised pre-training for 3D vision tasks by cross-view completion","venue":null,"work_id":"9f6d9f5e-9bdb-4001-a274-a7f6942c434d","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.149844Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c339bc9f4710e4d56c242c09c571df23d2cc7e51bc484475503fa3e9a209c56b","observation_id":"3dd73b52-c58f-4a10-a197-8a853dadcf1f","resolution":{"observed_at":"2026-08-07T13:31:33.374955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.040313Z","title":"SimMIM: A simple framework for masked image modeling","venue":null,"work_id":"c0d335a1-896b-43b0-b265-ab8496074b74","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.256971Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:30918ef4031260c82bea22f4304ad3248abdfe5938c2c8d29e65697dd91b94f0","observation_id":"df8c767b-2e57-486b-86f0-e3296d6309bf","resolution":{"observed_at":"2026-08-07T13:31:33.108156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.777740Z","title":"Revealing the dark secrets of masked image modeling","venue":null,"work_id":"7583fd96-3858-4ed0-bd2f-410b3bb52b74","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.370850Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:afbb60ee039d3992be2b33cd24f9e4d50059090b1bbe1b9c77d049c678a0842b","observation_id":"fe1cc001-7aca-418f-9289-aba28b6da36f","resolution":{"observed_at":"2026-08-07T13:31:32.925583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.511144Z","title":"BEVFormer v2: Adapting modern image backbones to bird’s-eye- view recognition via perspective supervision","venue":null,"work_id":"c074428f-301d-4b5f-b402-3f807e5dc194","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.458860Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:55e85a47519c54db180c1a0ea5c26b69c8e02e9863da155a6676c95cf02410b6","observation_id":"d7f8c352-7a2d-4d8b-836e-82cb678bf4b0","resolution":{"observed_at":"2026-08-07T13:31:32.646465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.312651Z","title":"Generalized predictive model for autonomous driving","venue":null,"work_id":"aaaaef0e-cd2d-414d-b3a8-221d6df740c2","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.554913Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:05cab6adc6c95a8dac41da3777719f0bdb8a00d2c4b1a261a7658f1d62877911","observation_id":"75038a03-2c63-4b52-bc6e-9734f133308e","resolution":{"observed_at":"2026-08-07T13:31:32.390655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:30.641934Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.641934Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:25bf00e492fb34f890a078952c6f92744281a6d6f1415784b61da7a34a4503f3","observation_id":"faf216ae-0164-46dd-840a-baa21141f8be","resolution":{"observed_at":"2026-08-07T13:31:30.641934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:30.722512Z","title":"Depth anything v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.722512Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:5787b51fbb42b35d9e7b35b1bf1fddd474a3baafaf6a177b804674d6493b3e73","observation_id":"bb1029cd-2a10-483f-a3fb-b382fcaca729","resolution":{"observed_at":"2026-08-07T13:31:30.722512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.072368Z","title":"Decoupled contrastive learning","venue":null,"work_id":"e8229cec-7f95-461a-be1c-5e975d499a20","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.799628Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:ac108063cb71942ecf8f598dc299e1d7e6acbd3752fc0f7f37955df39d649ad1","observation_id":"95c2c685-17f5-447d-b345-269e93f1073c","resolution":{"observed_at":"2026-08-07T13:31:32.166851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.909196Z","title":"Neural window fully-connected CRFs for monocular depth estimation","venue":null,"work_id":"458929e1-1b98-48e2-8421-8ef2f1ffc897","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.883842Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:654e1ef1caae577db39a37635b4fde2531dcefaf659195783e8487bd72477a21","observation_id":"41f6c796-563e-4b7c-9f7a-e7588c7f03e3","resolution":{"observed_at":"2026-08-07T13:31:31.985073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.761945Z","title":"HEAP: unsupervised object discovery and localization with contrastive grouping","venue":null,"work_id":"9b542068-9a8e-4d1b-8ba0-a93d09c6103a","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.983454Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:138345deca2c301545d2e56c90ce4b3a591865bd92884436c0d07bf256a50ea4","observation_id":"6f179519-cdaa-46ef-8ad0-accf16c48139","resolution":{"observed_at":"2026-08-07T13:31:31.817057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.572117Z","title":"Unsupervised learning of depth and ego-motion from video","venue":null,"work_id":"dac02906-92aa-4761-a7c9-d29baba338e7","year":2017},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:31.094408Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b5fd71950459847cbd8d03afaada8964925b3b14053bfaae66849033bbea170c","observation_id":"2c0d6bcf-db85-4edd-b1d0-dd3da009ce5c","resolution":{"observed_at":"2026-08-07T13:31:31.672593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.395434Z","title":"Edge boxes: Locating object proposals from edges","venue":null,"work_id":"343c00de-3a0a-4019-b397-8b73fbcbd63d","year":2014},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:31.198783Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:cc6dd59f3dd1680ed003d6df6bfa6e4eea8e0860475d358d382854e9a973003e","observation_id":"e1862ab6-e4e9-46f3-88c7-a4a386017214","resolution":{"observed_at":"2026-08-07T13:31:31.478858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:23:49.662599Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":50},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2505.21635."}