{"as_of":"2026-08-10T12:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55a2444d5a466282a032e99d5fcee2673e2a49f0ede32e1ebd98471e729adc8f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T21:16:16.496425Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:48:32.980001Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-08T21:16:16.496425Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04847","last_updated":"2025-08-04T07:36:34Z","snapshot_observed_at":"2026-08-09T19:20:02.276094Z","submitted_at":"2025-02-07T11:36:36Z","title":"HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T21:16:16.496425Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2502.04847"},"observation_digest":"sha256:0c4426d2dedcc4c5175df706b2ea689f68eb4f42a760af91ea991b1b8c71e6df","observation_id":"caa24bc2-58d8-48b4-b717-e5cceb5bdbca","resolution":{"observed_at":"2026-08-08T21:16:16.496425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-07T14:51:41.572907Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17475","last_updated":"2025-05-23T04:58:20Z","snapshot_observed_at":"2026-08-07T14:44:22.376830Z","submitted_at":"2025-05-23T04:58:20Z","title":"PoseBH: Prototypical Multi-Dataset Training Beyond Human Pose Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.572907Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2505.17475"},"observation_digest":"sha256:dc641509391bcf0cf6a7b1f0745010f687ac88fa6dd5340bcbabe47231b8153d","observation_id":"4134d363-e3ab-498e-ad66-b05f272d8a05","resolution":{"observed_at":"2026-08-07T14:51:41.572907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-07T13:55:27.939782Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20582","last_updated":"2025-05-26T23:32:51Z","snapshot_observed_at":"2026-08-09T13:25:50.447124Z","submitted_at":"2025-05-26T23:32:51Z","title":"Total-Editing: Head Avatar with Editable Appearance, Motion, and Lighting","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:27.939782Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2505.20582"},"observation_digest":"sha256:efb4482d2c246c59f31b86f90b75478fc320a7d3ea1927cd41e61cc257089e0d","observation_id":"14e38772-f43b-48b1-a47e-406ecd8c8adb","resolution":{"observed_at":"2026-08-07T13:55:27.939782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-07T10:50:50.117287Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04351","last_updated":"2025-06-04T18:11:23Z","snapshot_observed_at":"2026-08-10T02:37:06.313239Z","submitted_at":"2025-06-04T18:11:23Z","title":"HuGeDiff: 3D Human Generation via Diffusion with Gaussian Splatting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.117287Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.04351"},"observation_digest":"sha256:987bf2b1170937a11eac738f24e90fae67c80d819d18602e06ff1c8aebd849de","observation_id":"062eb3d0-d154-444c-8b9b-5e2e1887a938","resolution":{"observed_at":"2026-08-07T10:50:50.117287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T23:42:33.980220Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16852","last_updated":"2025-06-20T09:01:17Z","snapshot_observed_at":"2026-08-07T20:50:35.287232Z","submitted_at":"2025-06-20T09:01:17Z","title":"Controllable and Expressive One-Shot Video Head Swapping","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:33.980220Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.16852"},"observation_digest":"sha256:f2b400d770eb93867b0bf8da9ca8e41569d8f843f9e821e56428b51e697bc622","observation_id":"e7518576-ac00-44e3-aad1-8dfeedd98dfa","resolution":{"observed_at":"2026-08-06T23:42:33.980220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T23:35:05.494749Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17206","last_updated":"2025-06-20T17:55:06Z","snapshot_observed_at":"2026-08-06T23:28:32.574410Z","submitted_at":"2025-06-20T17:55:06Z","title":"DreamCube: 3D Panorama Generation via Multi-plane Synchronization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:05.494749Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.17206"},"observation_digest":"sha256:f30698b5cceaf7b5af2862b1b5ab0d798d76ef73583654b075c1c35b222c4e04","observation_id":"816c7bcd-ba28-4ed8-8187-abb5b8b292a9","resolution":{"observed_at":"2026-08-06T23:35:05.494749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T22:33:30.636955Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.636955Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:1aab412afa68da036c9ce18dfe5165c94a9b308e906ea8ab9b79c0c73a085030","observation_id":"df1e7e3f-843f-4dd4-87b8-45e8c909f101","resolution":{"observed_at":"2026-08-06T22:33:30.636955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T19:18:16.473720Z","title":"Khirodkar, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08022","last_updated":"2025-07-08T12:33:02Z","snapshot_observed_at":"2026-08-07T14:10:51.842053Z","submitted_at":"2025-07-08T12:33:02Z","title":"CuriosAI Submission to the EgoExo4D Proficiency Estimation Challenge 2025","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:18:16.473720Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.08022"},"observation_digest":"sha256:4896fd81152e0c496beab090aa4789929d676e75c5439af6e10841a0bb390246","observation_id":"659b81d6-7980-4d5f-8377-d2320644712b","resolution":{"observed_at":"2026-08-06T19:18:16.473720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T18:05:52.105572Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09230","last_updated":"2025-07-12T09:59:31Z","snapshot_observed_at":"2026-08-08T23:17:10.616344Z","submitted_at":"2025-07-12T09:59:31Z","title":"EgoAnimate: Generating Human Animations from Egocentric top-down Views","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:05:52.105572Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.09230"},"observation_digest":"sha256:a055f3081dbc2f04e362fd3cd54fcbc12dd4aa957eeac525a19302ba7e78d6ac","observation_id":"19b506b2-4eb5-49ae-927e-1a82223fd318","resolution":{"observed_at":"2026-08-06T18:05:52.105572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T16:30:34.528734Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13344","last_updated":"2025-07-17T17:59:17Z","snapshot_observed_at":"2026-08-07T21:11:22.341718Z","submitted_at":"2025-07-17T17:59:17Z","title":"Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:30:34.528734Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.13344"},"observation_digest":"sha256:05cf280346208c4f4123395aa9612ed78f6aca2125bba809df6aba88d5402289","observation_id":"6ef0743c-0968-4fe6-b29d-cadef456ac28","resolution":{"observed_at":"2026-08-06T16:30:34.528734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T15:03:12.936155Z","title":"Sapiens: Foundation for human vision models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18655","last_updated":"2025-08-30T18:49:41Z","snapshot_observed_at":"2026-08-09T22:10:06.572982Z","submitted_at":"2025-07-22T19:42:34Z","title":"Part Segmentation of Human Meshes via Multi-View Human Parsing","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:03:12.936155Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.18655"},"observation_digest":"sha256:04c8a4fab2f5006ec113f45ff81293d8520479998292bdbc0c7a3ca9bc3e4e33","observation_id":"b280cab7-c547-4bc9-a41c-462ccaa37c3d","resolution":{"observed_at":"2026-08-06T15:03:12.936155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T23:49:54.834936Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04824","last_updated":"2025-08-06T19:07:39Z","snapshot_observed_at":"2026-08-05T23:49:52.979092Z","submitted_at":"2025-08-06T19:07:39Z","title":"Delay-constrained re-entry governs large-scale brain seizures and other network pathologies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:54.834936Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2508.04824"},"observation_digest":"sha256:b0d8dc7e65b3a5dbc676260ac575a30d662d1ea3d113335fe047efcac3653d6e","observation_id":"e306f04c-b886-48a6-9290-c1047cab6dcb","resolution":{"observed_at":"2026-08-05T23:49:54.834936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T21:55:44.834958Z","title":"InACM Trans","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.07905","last_updated":"2025-08-11T12:18:55Z","snapshot_observed_at":"2026-08-07T17:03:27.710583Z","submitted_at":"2025-08-11T12:18:55Z","title":"Generative Video Matting","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-05T21:55:44.834958Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2508.07905"},"observation_digest":"sha256:94b2fe90f35eb3109079a61f83c6104707c6f32dcd6c427170c35a60fb83fc31","observation_id":"02209304-27e1-4d7f-8908-97dfcb40cae8","resolution":{"observed_at":"2026-08-05T21:55:44.834958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T15:19:37.163455Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20210","last_updated":"2025-08-27T18:36:30Z","snapshot_observed_at":"2026-08-09T16:12:19.928163Z","submitted_at":"2025-08-27T18:36:30Z","title":"InfinityHuman: Towards Long-Term Audio-Driven Human","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:37.163455Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2508.20210"},"observation_digest":"sha256:f2175db4d20aab0172d2f817b599636d54ab45a13775ec276a71dd441a61541a","observation_id":"aefc38d3-8410-471e-ae5e-979f2c89fec7","resolution":{"observed_at":"2026-08-05T15:19:37.163455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T11:54:57.300729Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02141","last_updated":"2025-09-02T09:43:47Z","snapshot_observed_at":"2026-08-07T21:39:07.255616Z","submitted_at":"2025-09-02T09:43:47Z","title":"GRMM: Real-Time High-Fidelity Gaussian Morphable Head Model with Learned Residuals","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:54:57.300729Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2509.02141"},"observation_digest":"sha256:b418882a6c067cce357b51eafe43d2d56962d8606dc78ea74b5b06c394931716","observation_id":"fca705c6-4480-412b-a557-e8e826d19aac","resolution":{"observed_at":"2026-08-05T11:54:57.300729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T11:29:52.407904Z","title":"Sapiens: Foundation for human vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07994","last_updated":"2025-09-02T18:48:37Z","snapshot_observed_at":"2026-08-07T06:43:30.899251Z","submitted_at":"2025-09-02T18:48:37Z","title":"STROKEVISION-BENCH: A Multimodal Video And 2D Pose Benchmark For Tracking Stroke Recovery","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:29:52.407904Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2509.07994"},"observation_digest":"sha256:0558d3b93fa6e702afc649c61bf990247771a1bea3959860b192e58431db5ac0","observation_id":"90b452a8-e535-40ca-be4c-ed19577865d5","resolution":{"observed_at":"2026-08-05T11:29:52.407904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-17T20:22:46.220021Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2511.16719"},"observation_digest":"sha256:c8595e43b46e82deb286a28a13847acdcd2f49c68684436914c5b756ef0ec1fd","observation_id":"099940c9-e8a8-43ea-b9ca-db73581b73a9","resolution":{"observed_at":"2026-05-17T20:25:11.397091Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2512.09646","last_updated":"2026-04-08T15:03:02Z","snapshot_observed_at":"2026-08-03T08:11:41.374378Z","submitted_at":"2025-12-10T13:40:24Z","title":"VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T23:30:14.969895Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2512.09646"},"observation_digest":"sha256:bcfcbf6a5a2febb471a243564710847fe567d585586074c34b03e9326ceafce5","observation_id":"dfdef90a-a544-4d51-a081-eecaf0b00038","resolution":{"observed_at":"2026-05-16T23:31:22.021978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.02764","last_updated":"2026-04-03T06:19:12Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T06:19:12Z","title":"InverseDraping: Recovering Sewing Patterns from 3D Garment Surfaces via BoxMesh Bridging","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:53.260771Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.02764"},"observation_digest":"sha256:6a4248ea0432d2be349b866ce516f94452eefe344fd32c5aa69ca2ce9e3bb449","observation_id":"e69ec915-a80e-4e02-9723-a121158ab61b","resolution":{"observed_at":"2026-05-13T20:18:13.097908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.03305","last_updated":"2026-03-31T01:28:42Z","snapshot_observed_at":"2026-07-30T07:10:43.620755Z","submitted_at":"2026-03-31T01:28:42Z","title":"HVG-3D: Bridging Real and Simulation Domains for 3D-Conditional Hand-Object Interaction Video Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T00:14:36.537688Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.03305"},"observation_digest":"sha256:af8b6468eff6cb4eec2adf917dc0df9334095b47daaf2fe30c8c8dcab5a56b5d","observation_id":"759c3397-c114-4a79-ad84-dbe731f2562a","resolution":{"observed_at":"2026-05-14T00:18:30.120331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.20715","last_updated":"2026-04-22T16:01:04Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:01:04Z","title":"GeoRelight: Learning Joint Geometrical Relighting and Reconstruction with Flexible Multi-Modal Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T01:19:12.431761Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.20715"},"observation_digest":"sha256:94cf0dd4d15cd30ea4d9b9e0bffcda995939be464afe4193864616bad75931ff","observation_id":"91286b49-0ae6-4e2d-a812-95909ae48b8c","resolution":{"observed_at":"2026-05-11T13:36:10.152128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.22865","last_updated":"2026-04-23T09:01:27Z","snapshot_observed_at":"2026-07-06T23:09:10.050398Z","submitted_at":"2026-04-23T09:01:27Z","title":"MeshLAM: Feed-Forward One-Shot Animatable Textured Mesh Avatar Reconstruction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T22:06:58.480052Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.22865"},"observation_digest":"sha256:3b49b69484a003cec57f099d8c0547741304048f5819e4095db709d61aa7c9b4","observation_id":"9b6e0ef0-3ed2-466e-9441-c7cdc8af5759","resolution":{"observed_at":"2026-05-11T14:16:28.624552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2605.02094","last_updated":"2026-05-03T23:25:45Z","snapshot_observed_at":"2026-07-06T23:15:11.601042Z","submitted_at":"2026-05-03T23:25:45Z","title":"SignMAE: Segmentation-Driven Self-Supervised Learning for Sign Language Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T19:23:07.258575Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2605.02094"},"observation_digest":"sha256:7684a8349c083b3f88b6e4a448f372fe7b7d57d46d5083ffd75b3c08dddc340b","observation_id":"de71c350-fa05-417a-a583-34bfb38b363e","resolution":{"observed_at":"2026-05-09T05:55:30.827729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2605.16419","last_updated":"2026-05-14T09:03:22Z","snapshot_observed_at":"2026-08-02T06:25:17.450009Z","submitted_at":"2026-05-14T09:03:22Z","title":"Agentic Pipeline for Self-Synchronized Multiview Joint Angle Monitoring in Uncalibrated Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T21:33:29.195617Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2605.16419"},"observation_digest":"sha256:cb977702f70acefa780f196058b583ec3db42fef5207d94852dba636a2efbcc2","observation_id":"988a177d-061c-447c-aa48-b3054b09a0df","resolution":{"observed_at":"2026-05-20T21:33:45.707145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2605.21766","last_updated":"2026-05-20T21:57:31Z","snapshot_observed_at":"2026-07-06T23:32:10.472558Z","submitted_at":"2026-05-20T21:57:31Z","title":"BodyReLux: Temporally Consistent Full-Body Video Relighting","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-22T08:52:32.185764Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2605.21766"},"observation_digest":"sha256:05a1c8dfd1732e106c21a122990964999bbfc9061a490d43822cef39bf1f614c","observation_id":"eeb02796-ae3e-4c1c-aa43-2524eb78d273","resolution":{"observed_at":"2026-05-22T08:54:45.882987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2606.13655","last_updated":"2026-06-11T17:54:05Z","snapshot_observed_at":"2026-08-01T16:23:27.797500Z","submitted_at":"2026-06-11T17:54:05Z","title":"Flex4DHuman: Flexible Multi-view Video Diffusion for 4D Human Reconstruction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T06:54:11.233650Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2606.13655"},"observation_digest":"sha256:35217426f99eff915e7151f0e9603881e2a7a39bdafd4cad73713bd57180406a","observation_id":"1a233636-7f61-423c-922b-32cc3ff3f7a1","resolution":{"observed_at":"2026-07-03T14:48:32.982171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2408.12569/citation-record","integrity":"/paper/2408.12569/integrity","json":"/paper/2408.12569/citation-record.json","paper":"/paper/2408.12569"},"outbound":[],"paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2408.12569."}