{"as_of":"2026-08-15T02:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5cb79a1ed3d452677eba6ba9279157b890888a1d71c323b4e33a45aa83497479","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:39:56.986948Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T00:56:18.867382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T14:21:06.803833Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"cited_work":{"arxiv_id":"2507.15365","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.15365","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"David: Data-efficient and accurate vision models from syn- thetic data.arXiv preprint arXiv:2507.15365","venue":null,"work_id":"3d582ee7-9484-43c5-85a2-c9f88339b2b7","year":null},"citing_paper":{"arxiv_id":"2604.21681","last_updated":"2026-04-23T13:45:32Z","snapshot_observed_at":"2026-08-13T21:14:45.925676Z","submitted_at":"2026-04-23T13:45:32Z","title":"Sapiens2","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T21:59:43.755956Z"},"links":{"cited_paper":"/paper/2507.15365","citing_paper":"/paper/2604.21681"},"observation_digest":"sha256:af6e36f059ecad05e8b0f2b40fdbeb7b43eebdbeec49b602a9062ba00b667e9b","observation_id":"f05e34a1-92cc-4dd1-88fe-0960ec2dcf81","resolution":{"observed_at":"2026-05-11T14:21:06.807155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15365","snapshot_observed_at":"2026-07-13T00:56:18.867382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09024","last_updated":"2026-07-10T01:09:06Z","snapshot_observed_at":"2026-08-13T10:06:22.795281Z","submitted_at":"2026-07-10T01:09:06Z","title":"Video Generation Models are General-Purpose Vision Learners","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T00:56:18.867382Z"},"links":{"cited_paper":"/paper/2507.15365","citing_paper":"/paper/2607.09024"},"observation_digest":"sha256:589e42009a1f596d48820fcc55595f323d373f2f598df68c2372620f413adcc5","observation_id":"df15b44c-68d9-4506-b5ad-15320431b80f","resolution":{"observed_at":"2026-07-13T00:56:18.867382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.15365/citation-record","integrity":"/paper/2507.15365/integrity","json":"/paper/2507.15365/citation-record.json","paper":"/paper/2507.15365"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.642234Z","title":"Black, Priyanka Patel, Joachim Tesch, and Jinlong Yang","venue":null,"work_id":"eb79b0ee-0a9f-43bb-8d3a-380fafe76113","year":2023},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.215791Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:624721e6fd0fe7dd3d971b71afcee5a6d2a5cf7adca197e3ffd34b6457b864dc","observation_id":"5fad716a-bec8-470a-9574-7cea7d2eceff","resolution":{"observed_at":"2026-08-06T15:40:04.645098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.634884Z","title":"Richter, and Vladlen Koltun","venue":null,"work_id":"bc9eeda8-4269-4983-99cd-e2b162425469","year":2025},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.259678Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:b3b4bde1e2fa677a6e86b0b6678b32f06f4a4c6daae6dd083fe26c255c395ab8","observation_id":"e132778f-0411-43fe-ae1f-70a11419bac3","resolution":{"observed_at":"2026-08-06T15:40:04.637325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.626367Z","title":"Find: An unsupervised implicit 3d model of articulated human feet","venue":null,"work_id":"cc4337e5-4ad8-4078-8899-a98297f8921e","year":2022},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.346227Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:16cca78ff913439d5010dd192ca32fbe4ba231ca744f454864e26c8eb6c345a8","observation_id":"44cf8f50-715c-4f92-ad52-f995dae3ac3f","resolution":{"observed_at":"2026-08-06T15:40:04.629145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.618435Z","title":null,"venue":null,"work_id":"21303a56-cc50-4220-b2af-cac6dd73ecd5","year":2011},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.428803Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:cc206c07761feaa886fae18e8555777b48c048837c63929f564d8db61c927ede","observation_id":"76d8751f-a950-443c-9bc0-eca6e2029a3a","resolution":{"observed_at":"2026-08-06T15:40:04.621024Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.609847Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":"0a27e316-6a6d-4da2-a478-4897276d9711","year":2016},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.495054Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:1ea82b9b4ea0d5c2b96af42facbc63db85158df276e5c07b5be74a7e35e79c2d","observation_id":"c76b02bd-81ed-4445-9c06-73c386b7825f","resolution":{"observed_at":"2026-08-06T15:40:04.612981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.602162Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"6894ecb1-6387-4d5d-bdc9-7babaa579f8f","year":2009},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.579639Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:57ccac99202cf1e541a8ae56ccc16fc3f65d414d897c367e1864a650048336e9","observation_id":"654e70ec-8199-4e5d-aae1-bee50acdc60d","resolution":{"observed_at":"2026-08-06T15:40:04.604721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.586468Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"9cd55fd0-fedc-4bc2-a850-97ff526c43be","year":2020},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.732275Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:d1e0bf6a6bc3eb69bb549978d8066540c3b79a813a759b6899ab4d5ccf1b1467","observation_id":"f733ba57-0540-452a-8dd6-428102205170","resolution":{"observed_at":"2026-08-06T15:40:04.589129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.578292Z","title":"Omnidata: A scalable pipeline for making multi-task mid-level vision datasets from 3d scans","venue":null,"work_id":"80ecd21f-2206-4166-9904-5bab6d1b305e","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.830361Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:76c60c5387676a1089edfc60fec6f70f8d041703785bf00b3bc1b87c756713fe","observation_id":"6495c1cf-05e7-447f-b908-3ab7868d354e","resolution":{"observed_at":"2026-08-06T15:40:04.581214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.570039Z","title":"Renderpeople","venue":null,"work_id":"c5232801-715f-4a77-8937-45d197594651","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.874595Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:d34ecba9789d1343af1ede56c67599f4e47abd62ac9e393e4eddb2119a88b149","observation_id":"fe6400cf-27db-4922-8520-23b9b680e9da","resolution":{"observed_at":"2026-08-06T15:40:04.572915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.560406Z","title":"High-fidelity 3d human digitization from single 2k resolution images","venue":null,"work_id":"6f2330fd-3f30-4928-931b-9f7360251133","year":2023},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.945141Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:a9605bb1aa4ee9f92df6c974bf2122ce6c7d60ea15ab04ef32e0b5f458867b38","observation_id":"274499d9-ade9-4013-a192-b91d345f2547","resolution":{"observed_at":"2026-08-06T15:40:04.564319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.551490Z","title":"Look ma, no markers: holistic perfor- mance capture without the hassle","venue":null,"work_id":"ab9ba81f-b1ca-488e-8d62-a891bba1f1aa","year":2024},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.016252Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:bd62a1329f58a5c3acafa4cba434592a9005a5d6f7da9149fdd4709d08e1df05","observation_id":"5787c614-2dc1-47f3-b062-72791496f114","resolution":{"observed_at":"2026-08-06T15:40:04.554519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.542995Z","title":"Context-aware image matting for simultaneous foreground and alpha estimation","venue":null,"work_id":"53a2a16f-469c-4f70-a61a-d893a2b44689","year":2019},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.094935Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:88c4a77c22eb872bf98f7479a2182b19041a0ba7af5d7909300d3e40e7742279","observation_id":"d1c5b114-ba07-4f76-b4b9-b5b0f5afcee6","resolution":{"observed_at":"2026-08-06T15:40:04.545835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.374854Z","title":"Learning high fidelity depths of dressed humans by watching social media dance videos","venue":null,"work_id":"a162011d-40c6-4347-9cf1-d9dba4a05845","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.157419Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:45c7edcefe594181b4d5598c5efe4db8b09958701a7d047fd1ca863db4eb3dfb","observation_id":"aa7c3958-323c-4222-8277-d426f3b5f312","resolution":{"observed_at":"2026-08-06T15:40:04.449295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.104882Z","title":"Whole-body human pose estimation in the wild","venue":null,"work_id":"210af4ef-65bb-48af-8e0a-07d627952982","year":2020},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.229936Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:f17d90ec85acd589505012976dcfcbc843aea3a6d22c2374100f316d4a770d64","observation_id":"56e39657-dd80-4405-908d-c48d6a3ed198","resolution":{"observed_at":"2026-08-06T15:40:04.257019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:03.883363Z","title":"Fairface: Face at- tribute dataset for balanced race, gender, and age for bias mea- surement and mitigation","venue":null,"work_id":"481258bd-ef4a-4a11-b7bc-599533a245ed","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.296225Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:1550321d5afb1a4f4c0bae0b35b5c5f170f3fde702015ef9241c93e3dacd3a2b","observation_id":"5e426d5c-e286-4a44-a79e-44e02b921071","resolution":{"observed_at":"2026-08-06T15:40:03.999341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:03.566155Z","title":"Modnet: Real-time trimap-free portrait matting via objective decomposition","venue":null,"work_id":"3073312a-c6cb-46a2-9499-1c39120a0548","year":2022},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.388872Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:3024672ef48731e55dc93b023c1785970aefe1582557aa90640fad1ff6bc2c63","observation_id":"dd60efe3-a235-48b3-87fc-fb47d30e44e4","resolution":{"observed_at":"2026-08-06T15:40:03.736862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:03.481257Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":"66ca9347-ec59-4d49-9082-b885b2b625b8","year":2024},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.486039Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:2bd0e87c47e16123a8d1415683d1603202d1f2f52aef21fe8a25c2f46ad90454","observation_id":"e2e7fa24-8035-4596-ac5f-72aa0fda1243","resolution":{"observed_at":"2026-08-06T15:40:03.498709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:03.361129Z","title":"Privacy- preserving portrait matting","venue":null,"work_id":"dad1cc57-9ed1-46f8-82b4-837b3e2ebf04","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.569972Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:54fdd54a2ed9a6fc02a6a21ccd41caca956c530bc359a2d7a6a062f8a52567ba","observation_id":"d7a36859-4e40-4cfc-87cd-0f3baa3deb6f","resolution":{"observed_at":"2026-08-06T15:40:03.428102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:03.240620Z","title":"Real-time high-resolution background matting","venue":null,"work_id":"95c4d31e-7fc8-4f65-8fa9-3c8e7161eee3","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.671888Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:def2d6f72db7fbd85896568badea911da9fb2df51358f9f19dcb0e6feee75865","observation_id":"5e5c92d1-26d2-45cf-9ce6-1bba6252b25e","resolution":{"observed_at":"2026-08-06T15:40:03.296136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:03.079362Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"eddbf75e-8b10-43a8-b9d8-cc9b287030a3","year":2014},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.743035Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:cd0e5a6c3573d6668f38ded4877979856c148ff481da8d977edb02a9211a11b7","observation_id":"37844dbc-2b7d-4cd0-8496-15693ad0c329","resolution":{"observed_at":"2026-08-06T15:40:03.171763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:02.875484Z","title":"A new dataset and boundary-attention semantic segmentation for face parsing","venue":null,"work_id":"79e24fea-943f-4c29-a1ec-df80fd90ad7a","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.806506Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:c58e045e59293b12e74ece7ee76542836f42986944f3beff88a7e55b14c83e25","observation_id":"1310717f-348e-44a1-ada3-e9f5ce2f1863","resolution":{"observed_at":"2026-08-06T15:40:02.991532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-06T15:39:54.878340Z","title":"Sgdr: Stochastic gradient descent with warm restarts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.878340Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:294494696052ffebe0c20a52eab4d40335f5e10facdb7ff28e8d7c5d1c587761","observation_id":"1e4acacf-842c-48b6-b09a-42b15f3c532f","resolution":{"observed_at":"2026-08-06T15:39:54.878340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T15:39:54.976360Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:54.976360Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:139a59dcfe7e014f731af79b7ef654f4ab1160a1facaeb184a485245569754c3","observation_id":"830c633c-d2fc-43da-99ab-4651cc28a259","resolution":{"observed_at":"2026-08-06T15:39:54.976360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:02.595642Z","title":"Rapid acquisi- tion of specular and diffuse normal maps from polarized spherical gradient illumination","venue":null,"work_id":"38434029-87cb-4754-8f1e-1ea25de7715c","year":2007},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.046160Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:813516aa1edc168f66db71c5856375c5429d0520372b2a55200e3cc77b89f1d6","observation_id":"a94ef7f9-4440-49eb-add1-431ca3677004","resolution":{"observed_at":"2026-08-06T15:40:02.717544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:02.339331Z","title":"Amass: Archive of motion capture as surface shapes","venue":null,"work_id":"a87d6817-5124-4c04-a8d6-ddc63a0a65e1","year":2019},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.155715Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:53aabddf4a46510c0e983b8d46c813d6bb15c296a48187e20d1cc0cd578205e9","observation_id":"8121f3f9-0adb-49c0-a5cb-e34fb32645a1","resolution":{"observed_at":"2026-08-06T15:40:02.473148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:02.115023Z","title":"Jewett, Simon Venshtain, Christopher Heilman, Yueh-Tung Chen, Sidi Fu, Mohamed Ezzeldin A","venue":null,"work_id":"4d7318ca-1e3e-469f-af4c-7502d0bf37f2","year":2024},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.199413Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:d1588aaeaae1ba85b92b5e22c1836e1d89d5e7a61c142f7973a2e4128a2271e7","observation_id":"4fb4f5b7-93c0-4119-af37-70d8d4c80f6e","resolution":{"observed_at":"2026-08-06T15:40:02.213488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:01.801897Z","title":"Kinect- facedb: A kinect database for face recognition","venue":null,"work_id":"5d7cfe12-6008-461c-b7af-c7c3e82285c3","year":2014},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.297028Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:9c9b2e1c93837c477f336839f363040877d08d4b5a67fcd4b50677ff993c5e35","observation_id":"72a2aad9-557d-492a-9271-5753083bde55","resolution":{"observed_at":"2026-08-06T15:40:01.982709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:01.599814Z","title":null,"venue":null,"work_id":"805cae26-c0c0-4c1a-bb54-b60b67a3916d","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.373874Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:012bc7ae84a1137164ad516dde3fd0eb59b293360147bec5cd46de0849b5adf8","observation_id":"d5329394-30bd-4bc9-90d1-67ff58bd7265","resolution":{"observed_at":"2026-08-06T15:40:01.677049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:01.298316Z","title":"Huang, Joachim Tesch, David T","venue":null,"work_id":"b231f6d5-eb16-4bd1-a000-fddd07cf312d","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.511448Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:c9d0705bd20483004411913e94e2c3cddeafa0582377a27522dd0b1481d4d2ec","observation_id":"93abc571-bec4-46bc-a460-9c2f839309f2","resolution":{"observed_at":"2026-08-06T15:40:01.355803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:01.016934Z","title":null,"venue":null,"work_id":"d946bd18-3a74-4dae-acb5-f0f0e270bf8c","year":2019},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.597441Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:ce416d94a0806b8642e74f8b6aa6647b9e0de5461dc6887ccde4b201a4c67208","observation_id":"8e67aa68-9f75-4bca-9c8d-b9f2ac6e4af9","resolution":{"observed_at":"2026-08-06T15:40:01.177605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:00.740065Z","title":"Eyelid fold consistency in facial modeling","venue":null,"work_id":"d80219c5-ab34-4e99-a686-d49f2607439a","year":2024},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.660365Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:39c0bd029ff4bf88c6d80c56e979a2ce57a66e52d5fd32c0749c139eb4ed63fd","observation_id":"bf7f3ce6-2455-4e1f-a80a-846abe6cf239","resolution":{"observed_at":"2026-08-06T15:40:00.899119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:55.736515Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.736515Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:3b32e854834f49b814a2b42ae31c719368a409fd970be7f7a3a641d080ec8911","observation_id":"86c8b7a0-9092-4fd7-97ae-4550dfc235c0","resolution":{"observed_at":"2026-08-06T15:39:55.736515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:00.585921Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross-dataset transfer","venue":null,"work_id":"6a4496c3-bd3c-4da8-9a6a-73b0aafc5500","year":2020},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.796393Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:2e45a9c1a2f13aaeb6ffc2638717712c563565bc68bda87db02af5da40605c66","observation_id":"7ad776ed-1147-495d-8455-7594d33cf133","resolution":{"observed_at":"2026-08-06T15:40:00.672650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:00.274122Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross-dataset transfer","venue":null,"work_id":"be356205-5df7-4538-862a-09c4229d4e5b","year":2020},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.845946Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:ed8b0a9eed785dd34947f32df2111c58a11df0887422aa943c6f795e47fed778","observation_id":"85241599-a11b-4615-bc71-2bd391af8abc","resolution":{"observed_at":"2026-08-06T15:40:00.431998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:00.078963Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"96f18015-a2de-45d6-aa74-3dae87e5f826","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.905611Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:1609796bf5ddec5c1488ad1508165a7540f44e735d552556c17d82bef4dddb28","observation_id":"5026df3f-ee0b-4807-963b-36e15f634e1f","resolution":{"observed_at":"2026-08-06T15:40:00.174179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:59.893935Z","title":"Em- bodied hands: modeling and capturing hands and bodies together","venue":null,"work_id":"66a95680-2ef7-4769-9de5-edd0aecafe28","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.962553Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:1114ae22a5ca6c86e36f1cb3bc7bc8c114a4fb5b1efcb8cd26f698af288bff6f","observation_id":"fa742155-1416-4751-b0b7-c2ef0d3e36ef","resolution":{"observed_at":"2026-08-06T15:39:59.971193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:59.724369Z","title":"300 faces in-the-wild challenge: database and results","venue":null,"work_id":"14619976-2bbc-4591-9ee5-c12b23d0caa0","year":2016},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.006867Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:f10b05ee493f86034042e0e7c178ba6025ec5057a0321c93fe4e4fbce3b8ee9b","observation_id":"782e8d01-ed58-42e6-9640-8d550042f430","resolution":{"observed_at":"2026-08-06T15:39:59.804964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:59.504754Z","title":"300 faces in-the-wild challenge: Database and results","venue":null,"work_id":"6b3a99e5-587d-4162-9f7c-50146da982b3","year":2016},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.069943Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:86515302717ad2fbc7711288a5e010d5c3ddae06919f06dba8f9df176a8cd144","observation_id":"e1a64569-00d0-4f9a-b657-566652a9bdd2","resolution":{"observed_at":"2026-08-06T15:39:59.574976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:59.317572Z","title":"Pifuhd: Multi-level pixel-aligned implicit function for high-resolution 3d human digitization","venue":null,"work_id":"401b7127-bb88-4669-b093-35437a912d47","year":2020},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.155144Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:90e1c07657738d5347b619952c173730652b5a2a67477a19178b9369812e05d1","observation_id":"f4c5439f-4702-451e-9638-23b90f01375d","resolution":{"observed_at":"2026-08-06T15:39:59.373523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:59.075249Z","title":"Learning to regress 3D face shape and expression from an image without 3D supervision","venue":null,"work_id":"e90547e2-d675-4dea-a799-fd25afd0c12d","year":2019},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.199600Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:fe3d34136c9027b7205eee02bbb33a8f96b698cfe28f86b6a5391f02c418489b","observation_id":"7ec4977b-ff4a-4f18-9b81-2e5274e2e00e","resolution":{"observed_at":"2026-08-06T15:39:59.219068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:58.835602Z","title":"Generalised dice overlap as a deep learning loss function for highly unbalanced segmen- tations","venue":null,"work_id":"841c6bc6-814e-4b63-99ae-7a135726ea5e","year":2017},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.242000Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:ebd43d80ef134c359135c054921f310c544d975701cb8bb97077bfaaba6cfc92","observation_id":"254cf0a4-8614-4cc0-b02c-f6840d9185c2","resolution":{"observed_at":"2026-08-06T15:39:58.969555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:58.606517Z","title":"Face mask extraction in video sequence","venue":null,"work_id":"7e8fd5be-4b63-43f0-8561-1993a20886c7","year":2019},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.365830Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:9157c06887ca74510437e3766d0e76d8904845fce6f32b369cb143d4c3fecec1","observation_id":"28ece497-24f3-4327-bbc0-f00187b85c4c","resolution":{"observed_at":"2026-08-06T15:39:58.754863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:58.361394Z","title":"Cashman, and Jamie Shotton","venue":null,"work_id":"b25c1e87-9652-4599-ad34-15b98ba765fe","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.412504Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:5c7c6cb72aaf1c97f7721a3f5ad187120e267def0849285487c5b03064119a0b","observation_id":"518ac9ca-ca47-48ce-83ba-ab47b26e8df4","resolution":{"observed_at":"2026-08-06T15:39:58.477973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:58.219675Z","title":"Icon: Implicit clothed humans obtained from normals","venue":null,"work_id":"1730d6c5-3877-4091-bfc2-448a3a14962d","year":2022},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.476450Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:2de558228a0cacba49dd83dd5b8bde50ea356e1cb247d9624d0cbfdbecf1fe38","observation_id":"4199941a-711d-4094-bae7-bd42cdcbcb61","resolution":{"observed_at":"2026-08-06T15:39:58.279740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:58.008789Z","title":"Econ: Explicit clothed humans optimized via normal integration","venue":null,"work_id":"2ee69dbc-f707-4f2d-a4fd-9665d6c7177c","year":2023},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.550319Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:422b4b06ea805bd066f7047b7bf21d1a37c2f1c154fac1903e24ef53346ee27f","observation_id":"5be326a0-b8d4-4940-97e5-eecb940c398b","resolution":{"observed_at":"2026-08-06T15:39:58.087761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:57.874092Z","title":"Depth anything v2","venue":null,"work_id":"1ae66f7e-5b06-4098-8566-ac639048b57c","year":2025},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.599418Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:776be8f3d596163a6596637a4049d5551f415ca10f513673a64e9ad3febb0cd8","observation_id":"f6a920e3-d164-461a-93c8-d400f68015c9","resolution":{"observed_at":"2026-08-06T15:39:57.915152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:57.799551Z","title":"Wider face: A face detection benchmark","venue":null,"work_id":"10dae1ad-32a7-4254-a04c-502644964c4a","year":2016},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.696415Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:066748903b008d18b7c61e11a4867fe1c98cf2640aab99c74194c581f2f043ff","observation_id":"ce8d9a97-7f9f-4479-ae6b-57873c5aa460","resolution":{"observed_at":"2026-08-06T15:39:57.865778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:57.629576Z","title":"Synbody: Synthetic dataset with layered human models for 3d human perception and modeling","venue":null,"work_id":"1059f77f-9d1e-4aa7-96a9-2bbdce9cabd3","year":2023},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.779941Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:b043483310fd8abe007bcb6a950556bca394c46d408f14f344a2b4a7367e3e54","observation_id":"2c856417-eb6c-4499-9f7d-c276e07c63a4","resolution":{"observed_at":"2026-08-06T15:39:57.723219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:57.421004Z","title":"Hi4d: 4d instance segmentation of close human interaction","venue":null,"work_id":"0f1c4523-5137-4627-8862-4734e950ad3a","year":2023},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.845640Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:fb8b70deb33fa55dd122dd09516dd7334508b690188465b66c7c7855ac795ba3","observation_id":"3a896012-5554-4e6b-9a62-d64f6d9b581d","resolution":{"observed_at":"2026-08-06T15:39:57.541174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:57.289465Z","title":"Function4d: Real-time human volu- metric capture from very sparse consumer rgbd sensors","venue":null,"work_id":"45363591-4c09-4097-8769-2c5d51b1aeaf","year":2021},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.931664Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:3679ff63ddf534968d4ca08bf1bbea3c76d2537d3126f78c1fceae3722600d7f","observation_id":"f0a04fa2-0d48-4b8f-98a8-0075fbbb9778","resolution":{"observed_at":"2026-08-06T15:39:57.369333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:57.124574Z","title":"Lightweight portrait matting via regional attention and refinement","venue":null,"work_id":"c3c7b599-c43c-4130-a2b2-4730c5857149","year":2024},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:56.986948Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:af105a2a434e48384305968267cb55c349b82303440399ef76bd404ab9f4d468","observation_id":"6dcf0b05-6a97-42e4-b052-ceb5c068562d","resolution":{"observed_at":"2026-08-06T15:39:57.183737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:04.594364Z","title":"IEEE, 2009","venue":null,"work_id":"e4db285c-de79-4f76-af8e-8cfefc33d700","year":2009},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:53.659404Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:20937ebf2f3e571b5c109890869a56ef8f4fe1d75f331315a364fd5cd55ee6df","observation_id":"b54f9ecb-2f3a-4264-9341-0e467701afdb","resolution":{"observed_at":"2026-08-06T15:40:04.597088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:40:01.441845Z","title":null,"venue":null,"work_id":"e7f5c63d-65cf-4bb9-a9c2-ca27e8512390","year":null},"citing_paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:55.462137Z"},"links":{"citing_paper":"/paper/2507.15365"},"observation_digest":"sha256:d01f1cfe213c566dd10a950c1f7104d333a94fa23e2380a5e72c63d229b8cdf3","observation_id":"74a7a153-a601-4e4c-ad6b-1542fd59a9d6","resolution":{"observed_at":"2026-08-06T15:40:01.514178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.15365","last_updated":"2025-07-21T08:17:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T15:31:21.700313Z","submitted_at":"2025-07-21T08:17:41Z","title":"DAViD: Data-efficient and Accurate Vision Models from Synthetic Data"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 2 inbound Pith citation observations for arXiv:2507.15365."}