{"as_of":"2026-08-08T11:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4940ad813baf0974532b0866acf2fbe06604c3599702d578d57c90ea15288761","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:54:45.097397Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12336/citation-record","integrity":"/paper/2507.12336/integrity","json":"/paper/2507.12336/citation-record.json","paper":"/paper/2507.12336"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.817837Z","title":"Label-efficient se- mantic segmentation with diffusion models","venue":null,"work_id":"41b4e279-d0f1-40cd-a2e0-d56c3c943e74","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.760926Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:4f82cc1c275c0cb9dd36cd6a0193d593f655f5991689154e11a2c37a555d7530","observation_id":"600bfaa6-b442-4876-b188-23f368edbdb0","resolution":{"observed_at":"2026-08-06T16:54:45.821306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.809699Z","title":"unsupervised-disentagling.https : / / github","venue":null,"work_id":"2b29cf21-7a04-4bba-b428-6af068d37fe8","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.826904Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:7456b3c68d31cc929f1da3a83b6097642780949246ea9e8ed5f4b9fbd21d3357","observation_id":"a56347aa-ee60-4cfe-a49f-09c435b1d548","resolution":{"observed_at":"2026-08-06T16:54:45.812603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.800557Z","title":"3d pictorial structures for multiple view articulated pose es- timation","venue":null,"work_id":"e4f4d9b3-eb3f-4d30-ba49-a48601d4589f","year":2013},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.873751Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:87b74435f0bf5d427b8f561b4177e6c976d292ae730fd2e27d5af772e1600289","observation_id":"91fc554c-e12d-47e1-8737-607aab04a9e1","resolution":{"observed_at":"2026-08-06T16:54:45.803870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.790467Z","title":"Unsupervised 3d pose estimation with geometric self- supervision","venue":null,"work_id":"8ec8ee24-a370-4807-a035-ccf922126153","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.878514Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0a35a0dabdad0631a78861d2be581dc7a9e9fc5a3b3f37731bc151d7a21b9a47","observation_id":"844f2d6b-c060-4905-b83e-0fe415daca2a","resolution":{"observed_at":"2026-08-06T16:54:45.793536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.782403Z","title":"Unsupervised part discovery from con- trastive reconstruction.NeurIPS, 34:28104–28118, 2021","venue":null,"work_id":"2d97d598-0458-4899-bd39-0763b327ff93","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.882482Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:7d6e189976b75c8576ece23e793ea3f99a203021d07ed14be63d408b483e2851","observation_id":"36052c8f-7577-41da-90af-15ae7011cc7a","resolution":{"observed_at":"2026-08-06T16:54:45.785091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.774910Z","title":"Google scanned objects: A high- quality dataset of 3d scanned household items","venue":null,"work_id":"839a26e8-00cc-402a-bb3b-166a66b359cd","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.885869Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6794e374afac68b645386fc5b5a0bd0608009fe84c6f7bb0f13debd9a328eb9a","observation_id":"f2481b3a-a529-4c92-a5c4-b80712ff44ea","resolution":{"observed_at":"2026-08-06T16:54:45.777881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.766168Z","title":"Can 3d pose be learned from 2d projections alone? InECCV, pages 78–94, 2018","venue":null,"work_id":"0e583dc0-8240-436c-be5c-b01b59b39ecc","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.889276Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:e9077b8390dfda5876854fee5cffce1341d06da5b5907876773358b230304432","observation_id":"eab28200-bd8d-4084-b56f-1daa753bfe09","resolution":{"observed_at":"2026-08-06T16:54:45.769369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.757553Z","title":"Gaussian frosting: Ed- itable complex radiance fields with real-time rendering","venue":null,"work_id":"da123999-ecee-44fb-9863-0d0c4a1a7ec3","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.893051Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:ae0c069f4fce1675fcc2e72eaf43598a06a1ad05ca0871cf45b333c00ae682ae","observation_id":"d54cf6fb-050b-4094-bc2c-d6e0767d7f6e","resolution":{"observed_at":"2026-08-06T16:54:45.760380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.749862Z","title":"Deepfly3d, a deep learning-based approach for 3d limb and appendage tracking in tethered, adultDrosophila.eLife, 8:e48571, 2019","venue":null,"work_id":"2c49afd2-ca8f-4c1f-84de-e66342a10bd5","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.896205Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:1a14ddeb3473569c7f670a00b0642aa74d4ac40835fe7720835422ba1a6ef0d3","observation_id":"274b67db-543d-4ca7-8106-dffbacf5e12f","resolution":{"observed_at":"2026-08-06T16:54:45.752957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.740896Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"f230099d-a618-4381-bc4f-9dbaa002a377","year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.898886Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:33a2fecc3bafcb6ea246a33668c027281a4ef12ae901ef32853f68c246fa8a21","observation_id":"1ead2554-ee4f-412b-80e3-650632d95b52","resolution":{"observed_at":"2026-08-06T16:54:45.743940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15812","last_updated":"2024-10-13T19:57:19Z","snapshot_observed_at":"2026-08-07T22:29:03.847587Z","submitted_at":"2021-03-29T17:59:10Z","title":"LatentKeypointGAN: Controlling Images via Latent Keypoints","version":5},"cited_work":{"arxiv_id":"2103.15812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.15812","snapshot_observed_at":"2026-08-06T16:54:45.144350Z","title":"LatentKeypointGAN: Controlling Images via Latent Keypoints","venue":"cs.CV","work_id":"4ca2a991-d48d-4d3e-9c00-43b20986b705","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.901429Z"},"links":{"cited_paper":"/paper/2103.15812","citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f82248741aea76d5930e472379070dbcb5138da9f3d33e75a9c3c6ee7062db9a","observation_id":"54fcd3e8-dae4-4f71-9f6a-b035b3d21d77","resolution":{"observed_at":"2026-08-06T16:54:45.150662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.733017Z","title":"Autolink: Self-supervised learning of human skeletons and object out- lines by linking keypoints.NeurIPS, 35:36123–36141, 2022","venue":null,"work_id":"30233abc-3e87-4e11-b7c8-2c408b8a5264","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.905205Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f227513de678e4098a76e6f8a020e84caf68c4a9cbfeb7193e7664434fdfca73","observation_id":"df32b6d1-7749-4d63-935c-ba7b7946fa91","resolution":{"observed_at":"2026-08-06T16:54:45.736161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.722511Z","title":"Ganseg: Learning to segment by unsupervised hierarchical image generation","venue":null,"work_id":"b28c963b-be15-4db7-95b5-6a8d89ad91c6","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.908585Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:d5d49cf44a729b3533d2dea52c6c7796d9e9d668362b3be3be44d37f4ecd0b5f","observation_id":"5a3d6d6d-2511-482e-a719-4ee8c0424311","resolution":{"observed_at":"2026-08-06T16:54:45.726236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.713158Z","title":"Unsupervised semantic correspondence using stable diffu- sion.NeurIPS, 36:8266–8279, 2023","venue":null,"work_id":"d3df90f7-6168-4904-a46d-c7b63b298995","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.911971Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:ebf7c21df8c1aae5a24cef4853dde4307519e709d56658a4cf38495283a35a1f","observation_id":"41567217-3815-41f1-abcf-cdb86b6d935e","resolution":{"observed_at":"2026-08-06T16:54:45.717283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.703018Z","title":"Unsupervised keypoints from pretrained diffusion models","venue":null,"work_id":"e8364f40-30bb-4541-adcc-caf993408519","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.915205Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:e5e8dbaf5407428ef4f40bda2b4ded87838dbda4f4f580d5fbd04c262a6dfa39","observation_id":"a3577097-3702-4626-ab48-dae2db58132e","resolution":{"observed_at":"2026-08-06T16:54:45.706991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.695405Z","title":"Unsupervised 3d keypoint discovery with multi-view geom- etry","venue":null,"work_id":"dcc2f29e-26b4-472a-842e-b5f5830c54fa","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.918245Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:d59a8cf87f1517a5d5719fd0a92f687c60c1c8ab8bfdc8d6b59afe7359c7b45b","observation_id":"f9798236-834f-4033-ae46-13253b24ec01","resolution":{"observed_at":"2026-08-06T16:54:45.698498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.686154Z","title":"Scops: Self-supervised co-part segmentation","venue":null,"work_id":"d8669053-ea00-4fec-8667-90a3ef1f670a","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.921165Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c7f97a6481ae21e72189519442f1e2babe430bb8ca65645ee3ab8f4506dd8663","observation_id":"b574b38b-5442-4500-a556-c6deb4c01004","resolution":{"observed_at":"2026-08-06T16:54:45.688999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.678565Z","title":null,"venue":null,"work_id":"828ec624-0208-4c3d-8ea3-6ed0570084f7","year":2013},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.923837Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:21ba22dab0f2edc7452f84393236f5367f8e13001ee14398ef044a67843fc55e","observation_id":"aa31817a-d1a5-4f58-ac3f-be68e8a61804","resolution":{"observed_at":"2026-08-06T16:54:45.681249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.668983Z","title":"Weakly- supervised 3d human pose learning via multi-view images in the wild","venue":null,"work_id":"3935d736-0b6c-4611-8e60-38faf65f4c11","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.926823Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:882d1e727b687c89864c0bc33fb4f00782c6c2050e36c355bb25e4f80f4d9c60","observation_id":"9854f9a4-1bd3-4070-b1e1-687b91c1a027","resolution":{"observed_at":"2026-08-06T16:54:45.671955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.659946Z","title":"Learnable triangulation of human pose","venue":null,"work_id":"279be3f4-f2db-47c2-a52e-09ef307fa641","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.929591Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f49c8cdba13f9f038c069f3381badf855cd752ea0c2065aed77d3432a2cf9656","observation_id":"eeff1846-3b49-4258-aa67-3b7605f73bb8","resolution":{"observed_at":"2026-08-06T16:54:45.662666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.652064Z","title":"Unsupervised learning of object landmarks through conditional image generation.NeurIPS, 31, 2018","venue":null,"work_id":"2502e023-b39d-4e64-b49c-f4574b11ef26","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.933136Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:545af820eaee306fb61af556982bd908c633adbe2979bf92720eb155e862d991","observation_id":"5a892b0b-fe1a-46f5-8c9f-17e71e718d30","resolution":{"observed_at":"2026-08-06T16:54:45.655513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.643721Z","title":"Rupp, Evyn S","venue":null,"work_id":"68f96a26-867d-42f1-b0af-fd4efcc85213","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.936293Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:87624627c7f27b86b641b31cc646728e22b577886c60bdd1f41dc65f4a38c893","observation_id":"b0af075e-7ea8-4dde-8586-d9e0d531db5e","resolution":{"observed_at":"2026-08-06T16:54:45.646736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.635681Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM TOG, 42(4), 2023","venue":null,"work_id":"393182bc-4799-4975-a687-72f24d088932","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.939791Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:052f1a6e59c1169d37ffe4029912e701e4d7e53430f6b9f5a299f8c3a16c1507","observation_id":"efa7cf98-ac30-4166-8a1f-21216d781585","resolution":{"observed_at":"2026-08-06T16:54:45.638824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.625850Z","title":"Novel dataset for fine-grained image categorization","venue":null,"work_id":"0f65bb0a-4d6b-4c97-b839-41350962ede1","year":2011},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.942428Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6a949571dc3ca19c12b1e995a86a71a41dc6e2c1ebbb574c668b958b9ec2db6a","observation_id":"bf304c4c-30c0-4511-9546-e7a1702d92a6","resolution":{"observed_at":"2026-08-06T16:54:45.628923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.616641Z","title":"Unsupervised keypoint learning for guiding class- conditional video prediction.NeurIPS, 32, 2019","venue":null,"work_id":"0a0399d0-fd0e-4660-a181-f85f2c49ea6e","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.945601Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0d6eae37734f8be45edd2ba39250c955cd0e4b0273a37e3258ccf0cdf563e76c","observation_id":"1eb1494a-687d-41c8-96cd-e95cb775958e","resolution":{"observed_at":"2026-08-06T16:54:45.619585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.607117Z","title":"Self- supervised learning of 3d human pose using multi-view ge- ometry","venue":null,"work_id":"c0e62dec-3085-40ef-a80d-b18b3fcfeaa1","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.948158Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:33a53e070f8c977a481fcc76be847570935badf362b7889fb151e3f1049dbb3b","observation_id":"64b70b43-a181-47af-ab8a-1c8d0bcb164c","resolution":{"observed_at":"2026-08-06T16:54:45.610119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.597326Z","title":"Eschernet: A generative model for scalable view synthesis","venue":null,"work_id":"5ea29bd6-b9ea-410a-8496-6e41bbf2ad35","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.951318Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:2cee03e47d347cbfef9d9310f5372572f074d7bca67190b7c47021d805f5f541","observation_id":"b384d3b2-7602-4b12-9d02-c96c35418558","resolution":{"observed_at":"2026-08-06T16:54:45.600074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.589104Z","title":"Unsupervised learning of object keypoints for perception and control.NeurIPS, 32, 2019","venue":null,"work_id":"11a63cc6-1738-4f0f-bb97-a0551b4a64d3","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.954067Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6cd16c86df8f584074fc342963da4c7b3374f50a159094ec351acf3940b8e582","observation_id":"34e5675b-3c36-4e2a-8d34-fb4c18478d80","resolution":{"observed_at":"2026-08-06T16:54:45.591908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.580622Z","title":"Self-supervised 3d human pose estimation via part guided novel image synthesis","venue":null,"work_id":"cb59b6bf-df1d-475c-81d9-4ad4de8ec73d","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.957370Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c283f8dea1ea89faa2f312c5f214121db3d73a13d9b3f7566ec641a5e41c9e30","observation_id":"18f04a20-a92e-49ac-ad3a-a723f861d62d","resolution":{"observed_at":"2026-08-06T16:54:45.583844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.570790Z","title":"Kinematic-structure-preserved representation for unsuper- vised 3d human pose estimation","venue":null,"work_id":"53a079d9-5e04-43f0-9153-73679ec0e8bf","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.960444Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:a5f6fc6d87d2b1ef088fe0aa035d8b9b3d5b6b51dfd30e9ca1ed33854f432551","observation_id":"596efd4c-4baf-4a88-9453-df52a74ee341","resolution":{"observed_at":"2026-08-06T16:54:45.574338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.561197Z","title":"3d human pose estimation from monocular images with deep convolutional neural net- work","venue":null,"work_id":"bd447a35-97ab-4bf7-b2e5-86503c286faa","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.963133Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0a8ee7f2df654c00e05f5fe239446f4b78f48b51c5330900dca240688049a699","observation_id":"f6b4721b-20ae-4a63-b5bd-41a08743730c","resolution":{"observed_at":"2026-08-06T16:54:45.564747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.551835Z","title":"Geometry-driven self- supervised method for 3d human pose estimation","venue":null,"work_id":"7257f056-c7eb-4c05-9bbb-ebb4e18909a2","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.966162Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:202198ae7acb5d5ec6876898a37b4a3b971a5b2129ca879667d779437d33d75f","observation_id":"ffb7d838-3b25-4dd6-987b-e4f091692e68","resolution":{"observed_at":"2026-08-06T16:54:45.556078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.540666Z","title":"Multiple view geometry transformers for 3d human pose estimation","venue":null,"work_id":"cfdaf475-08f5-4504-900f-bf735a9f7ec4","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.968704Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:4a2abb9096fecc2268765da5a640c193251555e6493ca918d9939c4e55da4918","observation_id":"60ac9225-19b1-4ff3-a237-9ea90428a6f9","resolution":{"observed_at":"2026-08-06T16:54:45.544885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:44.971852Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.971852Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b857b82e3cfaa9c37d2757b94bcea55374ca1c7a2699a01ab4324cf88f4ddf9f","observation_id":"b31fc2c3-a719-425e-bfbb-40cad54f7603","resolution":{"observed_at":"2026-08-06T16:54:44.971852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.527184Z","title":"Unsupervised part-based disentangling of object shape and appearance","venue":null,"work_id":"e30744a1-4a2e-4658-87fe-89e8f2759592","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.974996Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:056c7ea3cef18a5c066427675012a647ecc533e7a1ffe2bbc32dcb43c77be888","observation_id":"44385957-820a-4f83-9afe-8ae671b128d8","resolution":{"observed_at":"2026-08-06T16:54:45.530317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.516905Z","title":"Diffusion hyperfeatures: Search- ing through time and space for semantic correspondence","venue":null,"work_id":"74f93e35-550d-4c96-ba52-9d8438e5dfe4","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.977622Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:fad47555d2f8c4ed0f7c2b23c56948ce067f182d4fac056a86599c00d13e8b18","observation_id":"a02c7071-d310-4259-9103-fbfb83de62b7","resolution":{"observed_at":"2026-08-06T16:54:45.520619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.507110Z","title":"A simple yet effective baseline for 3d human pose estimation","venue":null,"work_id":"bdc96f8d-3d68-4628-8f83-d5411efee2ff","year":2017},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.980222Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b2defbb5583896283630c3c6d4f3d0ac38f1a9594741864235f23f56ba7465e5","observation_id":"bac6a18f-d167-46db-9317-bd4a6c637c5e","resolution":{"observed_at":"2026-08-06T16:54:45.510939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.495874Z","title":"Unsupervised learning of object structure and dynamics from videos","venue":null,"work_id":"08188045-c801-4806-8045-b4d2472e84f1","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.983110Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:53c28459bdb7d6376de051da2ad79b021f4453c2c191c26cea9b5f2ed70e6752","observation_id":"851966a6-239e-484d-811a-587075e8182b","resolution":{"observed_at":"2026-08-06T16:54:45.498967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.483862Z","title":"V2v-posenet: V oxel-to-voxel prediction network for accu- rate 3d hand and human pose estimation from a single depth map","venue":null,"work_id":"fac72af7-928d-4656-862a-4e6612e6150c","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.985454Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f1acb56ca72b1199fa090076de43b73a3a2f08e462c178d4a15c5a76932639be","observation_id":"aabd093f-9add-42f7-93f7-dfbc8f90c007","resolution":{"observed_at":"2026-08-06T16:54:45.488856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.473679Z","title":"Emerdiff: Emerging pixel-level semantic knowledge in diffusion models","venue":null,"work_id":"7cc69520-6a5e-405a-9b0c-66834b381435","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.988472Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:1e1ecb35a2ee7c3a81326f5ea3c2893fe8dfca4eb4fd50c61b42f69c665ca809","observation_id":"5d368dd7-c1c1-4293-9745-3a5e693f3059","resolution":{"observed_at":"2026-08-06T16:54:45.477544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T16:54:44.990978Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.990978Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:ba8c3d850d0fcb439f2302d36d97f1b19ae4f246f5b51658e2603251202b43be","observation_id":"2fc7eda0-fcd4-4d5e-b824-d2aeed2388c2","resolution":{"observed_at":"2026-08-06T16:54:44.990978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.463938Z","title":"3d human pose estimation using convolutional neural networks with 2d pose information","venue":null,"work_id":"138675af-171c-403b-8f2f-82cf5195fb35","year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.994325Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b7690073289289b001e3d00f7f57a1f555ba10c990891243c00cebc013d8912d","observation_id":"c140a581-430a-4590-8f19-5aaea3705803","resolution":{"observed_at":"2026-08-06T16:54:45.467251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.454557Z","title":"Harvesting multiple views for marker-less 3d human pose annotations","venue":null,"work_id":"a3d02c5b-7044-4fc8-b968-3fe6f1feb6b4","year":2017},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.997756Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b07ae87787698b26b71c8b9137b27acdd3923b224d1a39b4923eec99a0bb1dcd","observation_id":"9413047f-9248-43e3-8bcd-d1bdd27af813","resolution":{"observed_at":"2026-08-06T16:54:45.458527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.444690Z","title":"Perazzi, J","venue":null,"work_id":"719fd8c8-575a-400c-a1d7-bf82de44de85","year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.000829Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:2301ea9f27e4fad003507fa6dcbe0b40b4d9ada805940c71e6d84f03abf29286","observation_id":"d20b204d-0601-490f-9645-811e857ce7fa","resolution":{"observed_at":"2026-08-06T16:54:45.448240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.436061Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"077a1e44-1e71-4c01-8049-dd5804e07308","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.003364Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:a150a21c8137d1fe3408cd4ed6132fe1893bda11fde393612921dadeb5c1c3da","observation_id":"591942a7-0a4f-4386-bdae-7d4055fd426f","resolution":{"observed_at":"2026-08-06T16:54:45.439671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.006445Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.006445Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:dee968a28496c1bed9a78a86ac7a3afc8e23f9e6cd2b3781710789d4af15596e","observation_id":"a825af59-3fb4-4662-8f2b-2519804d65a3","resolution":{"observed_at":"2026-08-06T16:54:45.006445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.422232Z","title":"Black, and Silvia Zuffi","venue":null,"work_id":"68fa7a06-359e-42b5-9e76-0ef4c2076918","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.009363Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:909d6b062c464b3f0d70bc2034178086027b0817d62598ef7fe174ff671de1b4","observation_id":"49e0a8df-5db6-4515-a4a2-5529c1aa9de2","resolution":{"observed_at":"2026-08-06T16:54:45.425397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.011770Z","title":"3d human pose estimation: A review of the literature and analysis of covariates.Computer Vision and Image Understanding, 152:1–20, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.011770Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c01854a859f5a199a7ca7223f5d162edeb02e4b2fa3687c5a3a2fcfa3409e40c","observation_id":"e2a1e5e6-d668-49cf-8c5b-8a509a03daa3","resolution":{"observed_at":"2026-08-06T16:54:45.011770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.409426Z","title":"Animating arbitrary objects via deep motion transfer","venue":null,"work_id":"0d74e9c2-4a23-43b9-9cb2-16ab6a666339","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.014128Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c6f4568a42b233ef77131a78ce675aeec8ed4a4c7db04958b31e35451d110374","observation_id":"bfd79a7b-ec8e-4569-bd22-c4267b321098","resolution":{"observed_at":"2026-08-06T16:54:45.412315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.400260Z","title":"First order motion model for image animation.NeurIPS, 32, 2019","venue":null,"work_id":"2e58e02e-ce76-4634-a699-0219dbb57081","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.016754Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:a33f67b63ee440f3bff2285b8dae7bcb7b2ced05bcab48c39026116e1c553757","observation_id":"ab4ec296-3e85-44a8-9d18-062f15d1e648","resolution":{"observed_at":"2026-08-06T16:54:45.402908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.392106Z","title":"Motion- supervised co-part segmentation","venue":null,"work_id":"0a7931c7-577b-49c2-8f18-96a3331b1c82","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.019617Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:527de4508657945b08ad74a48bd29568d142ea9db8422b1778a20bec0f2297f9","observation_id":"c15a96c3-6bb5-4934-8f5e-c54fc4e6ffe3","resolution":{"observed_at":"2026-08-06T16:54:45.395884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.382583Z","title":"Self-supervised 3d human pose estimation from a single image","venue":null,"work_id":"8c9a1795-72bd-4e79-b93c-688ce7453e3c","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.022288Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:77c9016ce7a9e0e9f4923a6e77b87666e359140abcc7ceb293cc0c07ed2af77a","observation_id":"f68c458b-6e67-4a63-85cc-7b439dfe5e7a","resolution":{"observed_at":"2026-08-06T16:54:45.385782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.372757Z","title":"Self-supervised keypoint discovery in behavioral videos","venue":null,"work_id":"49706c84-cdad-4469-ac69-beb1231cde11","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.025133Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:85cfc9904655f48f0eecdf6af28d01dc521e3d55f04f531fcd15258610b9d92e","observation_id":"721cdcb6-2295-44d5-94ff-c8ea84630cdd","resolution":{"observed_at":"2026-08-06T16:54:45.376627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.362714Z","title":"Bkind-3d: Self-supervised 3d keypoint discovery from multi-view videos","venue":null,"work_id":"7fd5e64f-82d9-4332-a657-2457f9e69f6b","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.028152Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:5ef5986558650ed073466792eafba97f830a62feeecc6afab57864151edacf77","observation_id":"af504f8a-a416-4dc5-ac2d-b05a1440762b","resolution":{"observed_at":"2026-08-06T16:54:45.366527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.353833Z","title":"Integral human pose regression","venue":null,"work_id":"6c1540a5-f827-4d38-9834-e49d824b36d4","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.030867Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:1bc444d023fec6c98499fc00d97e665319f62e4837081bd39656eac00f3e6529","observation_id":"7fd008ec-ee94-4201-bc65-ca409eb9c00e","resolution":{"observed_at":"2026-08-06T16:54:45.357250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.342807Z","title":"Discovery of latent 3d key- points via end-to-end geometric reasoning.NeurIPS, 31,","venue":null,"work_id":"7a93cc57-c2f6-49b9-8d89-cd14e3531b32","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.033297Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:25a712b12d7edef8a3adcc72a7065c993a2e93cd11469d33b3fc91d2f2957262","observation_id":"dd104d49-819d-40c9-b5a7-54dabd0288ce","resolution":{"observed_at":"2026-08-06T16:54:45.347170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.332498Z","title":"Emergent correspondence from image diffusion.NeurIPS, 36:1363–1389, 2023","venue":null,"work_id":"984e880d-2b61-4e75-8814-3b8866a64ebd","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.036297Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:bd58d27f4a51773106c358fdfc0346945de5e20ae650ec9bf16b56173197dd7a","observation_id":"bc2fa0d7-8a49-4765-a0a7-7f66070dba6d","resolution":{"observed_at":"2026-08-06T16:54:45.336175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.321553Z","title":"Unsu- pervised learning of object landmarks by factorized spatial embeddings","venue":null,"work_id":"c8eaa7b4-d1a2-4256-a4dc-b027594b594d","year":2017},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.039548Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:2489e849fde99c7b80ecedf3ae578887b24ba319bd238d268a87dd1f7b16d84e","observation_id":"91656dec-4012-4137-bfd8-cf67df1e2c2c","resolution":{"observed_at":"2026-08-06T16:54:45.325428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.311932Z","title":"Metapose: Fast 3d pose from multiple views without 3d supervision","venue":null,"work_id":"fb9abc86-16b6-4687-b7d9-ebebae897224","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.042211Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:79b7e91bc1199729b634870810dc0ec2d46a059503d0931f73010a662e59e772","observation_id":"b89a981e-d746-4314-9e97-fa5e25161cec","resolution":{"observed_at":"2026-08-06T16:54:45.315232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.301980Z","title":"Sv3d: Novel multi-view syn- thesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":"59648c19-6fa2-4f76-a1b6-dfbcd5f49905","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.046203Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:470cd179d9080927ce7583aa1e5604e65641dfa807bfd23661737d674a152460","observation_id":"63e342aa-fc6a-4d00-b68b-f8d2a812d9c0","resolution":{"observed_at":"2026-08-06T16:54:45.305541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.292140Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":"849f5f2d-6407-4129-892e-d7f4c8769181","year":2011},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.049716Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0ac8ea142ca9ef47102d74e4173542512eea87c85f99b0d858c52919170a759c","observation_id":"1a125d26-3771-4533-8778-936fc61b7d64","resolution":{"observed_at":"2026-08-06T16:54:45.295937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.281144Z","title":"Repnet: Weakly super- vised training of an adversarial reprojection network for 3d human pose estimation","venue":null,"work_id":"b2c5bd64-b91c-4c90-8f13-a55a1e98940c","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.052432Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:47def0cb6478f72dfa334f3483c24fb78c5b46fb218cf631761aba896f210749","observation_id":"b26de1b1-02ce-42f6-b951-c5c034c9a3ec","resolution":{"observed_at":"2026-08-06T16:54:45.284901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.270993Z","title":"Canonpose: Self-supervised monoc- ular 3d human pose estimation in the wild","venue":null,"work_id":"2fb8a60c-27c9-43b2-a6b0-dc0c2826ecc4","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.055865Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f69e325862f94b6e91a19ec1b934488849d7f6c1df753cae10237ba4399cb59b","observation_id":"a8848561-c257-4137-9cf7-467a52a70ac0","resolution":{"observed_at":"2026-08-06T16:54:45.274565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.260546Z","title":"Ele- pose: Unsupervised 3d human pose estimation by predict- ing camera elevation and learning normalizing flows on 2d poses","venue":null,"work_id":"4f93cbd0-a905-4d86-b45f-9bce6b6f04c0","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.059156Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:837947f28782d7f3498c7450004b73105a831106b369f90439f5265d91835b8e","observation_id":"affb6c32-f5ef-43b0-a070-4e6fa3ecb18f","resolution":{"observed_at":"2026-08-06T16:54:45.264644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-04T13:49:28.484746Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-06T16:54:45.062047Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation.arXiv preprint arXiv:2312.02201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.062047Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:e74c21f96f68a97462c50d19ecad65d3f8b13605e5b336f5a6f3e457783d869f","observation_id":"3e1064d6-d90e-4dc1-922a-104f28967448","resolution":{"observed_at":"2026-08-06T16:54:45.062047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.249982Z","title":"Open-vocabulary panop- tic segmentation with text-to-image diffusion models","venue":null,"work_id":"b44d88b0-0e6d-43a3-a99d-466cd32ac31c","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.065262Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0003b1183e0e4fce97bf1c4671b9bb8313ad66a4ace529cf19ae90ce2460c60f","observation_id":"5264f4eb-6b99-4a26-a353-f153729a5b9a","resolution":{"observed_at":"2026-08-06T16:54:45.253973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.240910Z","title":"Diffusion model as repre- sentation learner","venue":null,"work_id":"be91bff6-414f-41bd-b412-512a653c4c58","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.068499Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c89b90d7f5a7a6693098309793fdb639897c583aaf98120f75bf0bf73b2abcce","observation_id":"dfac2994-69da-4bce-bfc3-04f362a99600","resolution":{"observed_at":"2026-08-06T16:54:45.244528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.233070Z","title":"Mask-as-supervision: Lever- aging unified mask information for unsupervised 3d pose es- timation","venue":null,"work_id":"375aec11-3e3d-41f3-b273-00c9258c46db","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.072751Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:65f4fa661301fe6870898def9287913fa60a1177d300a68a51d28e22a6aa76b3","observation_id":"29c4137e-caed-40cd-867d-6b3a125643b8","resolution":{"observed_at":"2026-08-06T16:54:45.235942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.223256Z","title":"Ap-10k: A benchmark for animal pose esti- mation in the wild","venue":null,"work_id":"f84ff903-76e8-4529-bf36-6191f8eec7e9","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.076116Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:1212d8385f7e728ba4c36321855c4920415c25bd44dab120b374104cd9a072d5","observation_id":"95d7ff62-6b01-49aa-a068-6ea0996e394b","resolution":{"observed_at":"2026-08-06T16:54:45.226919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.214818Z","title":"Exploring diffusion time-steps for unsupervised representation learning","venue":null,"work_id":"02bee228-9e39-4b6a-aadc-2b028f33b08b","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.078911Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:84ca1db83fdb908928b3298757cca5ce077352b15728a28fa49fc8df50143d14","observation_id":"da73eaae-1110-43d0-880a-181b3d0f5292","resolution":{"observed_at":"2026-08-06T16:54:45.217885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.204207Z","title":"A tale of two features: Stable diffusion complements dino for zero-shot semantic correspondence.NeurIPS, 36: 45533–45547, 2023","venue":null,"work_id":"ce414bf3-9726-415f-ae3f-a3458c44b013","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.081650Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:1f0c3d75f665a3b7626a1adc698315497552934f2ef4d2b2f9ed8b4e44b20d66","observation_id":"f50187fe-0b96-432e-a1f1-37d3aee1b44b","resolution":{"observed_at":"2026-08-06T16:54:45.208565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.193623Z","title":"Unsupervised discovery of object land- marks as structural representations","venue":null,"work_id":"538c6fdc-73af-44e0-a514-9d07114cb137","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.085492Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:33da0bcde5ed83c036e97a4b3d647cbcfdacbfbb84fc87fd3d24324bf06c7ac6","observation_id":"23496463-1b56-4a9b-bf2e-fc177785679f","resolution":{"observed_at":"2026-08-06T16:54:45.197348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.182375Z","title":"Triangulation residual loss for data- efficient 3d pose estimation.NeurIPS, 36:12721–12732,","venue":null,"work_id":"b439a603-262a-498b-8fb2-80c755632c53","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.089326Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:26a646219604daf78369e290be016c0beedc0d350aa15f943b2ade494e44b52b","observation_id":"30a528b8-8bd1-460d-8a10-b837aee164a8","resolution":{"observed_at":"2026-08-06T16:54:45.186324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.171217Z","title":"Towards 3d human pose estimation in the wild: a weakly-supervised approach","venue":null,"work_id":"257414da-2b1c-4a64-ab06-5dc665777b28","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.092531Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b51ef005a4cbe2f493dc0ed74c9d786df7b3884a32908af35cbcad92d16a2aaa","observation_id":"e2d1843b-cbfa-4061-ab6d-ec5267190eb6","resolution":{"observed_at":"2026-08-06T16:54:45.174846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.160194Z","title":"CUB-200-2011 comparison Baseline reproduction.Most unsupervised 2D keypoint methods [12, 13, 15, 35] report their performance on the CUB-align protocol introduced in [35]","venue":null,"work_id":"6824921d-7446-4d74-b25c-ecd9dcc215a5","year":2011},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.097397Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:73d862295559a9ac4a8cd9e81d018f8bc10e99972812959ad0d5c3f9f5428c04","observation_id":"200838d0-504f-40ff-9c51-7f73371f357f","resolution":{"observed_at":"2026-08-06T16:54:45.164341Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T06:47:25.395811Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":67},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2507.12336."}