{"as_of":"2026-08-09T05:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3bda7168569d7baaf524c55f8a740c24edb530b4dc4f7bd3547c8d6b18fd6be","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:50:57.511667Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09880/citation-record","integrity":"/paper/2507.09880/integrity","json":"/paper/2507.09880/citation-record.json","paper":"/paper/2507.09880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.200419Z","title":"Satr: Zero-shot semantic segmentation of 3d shapes","venue":null,"work_id":"ff436ca8-d375-4923-ba7e-8114f11d6d36","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.460134Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:fd1d4c1d3ea2d4c389074378f2cb141793d85649e09767e4188a023e0ff8a554","observation_id":"2c79de8e-7811-4397-8338-a93c0416e0fa","resolution":{"observed_at":"2026-08-06T17:51:00.203379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.192264Z","title":"CloSe: A 3D clothing segmentation dataset and model","venue":null,"work_id":"358fd99e-d3e9-45a7-b8cd-7c5a6f598be1","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.512779Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:003171544bfc6903e0772b6c0e5d65c921b9f2af4178ecde5f16047877f13d8f","observation_id":"4f822105-8fa5-4284-8094-c9af841523ec","resolution":{"observed_at":"2026-08-06T17:51:00.195196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.183718Z","title":"Cloth3d: clothed 3d humans","venue":null,"work_id":"6ad54a35-f80a-4b90-9662-629b5724d0c9","year":2020},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.575040Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7cabdbd373d55b90b254c5030a91296cc357822131bd0429e06159e3622f07c5","observation_id":"db419e4c-f0cb-4d38-8cdb-208c83d4778a","resolution":{"observed_at":"2026-08-06T17:51:00.186760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.174718Z","title":"Bedlam: A syn- thetic dataset of bodies exhibiting detailed lifelike animated motion","venue":null,"work_id":"4a39226c-5b91-4b78-ab9b-9b1d77a1f74d","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.631732Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a154faecf966613f58289c85340af955e04307ddb50efe87671749ad739ecc10","observation_id":"88634c70-5064-4ba3-a72d-dae97d0fa37d","resolution":{"observed_at":"2026-08-06T17:51:00.178329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.165370Z","title":"Humman: Multi-modal 4d human dataset for versatile sensing and modeling","venue":null,"work_id":"88c75c8b-c5cc-4e88-8bb6-2b0d13fe7c88","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.671765Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:de180cdec0f25fe263c718a07baac2d6e458d4105d1f1add287c9731177a86ac","observation_id":"0828cac7-da62-41ed-ad7e-d9eeb71f625d","resolution":{"observed_at":"2026-08-06T17:51:00.169043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.155856Z","title":"Tightcap: 3d human shape capture with clothing tightness field","venue":null,"work_id":"01814f5a-4d68-4a3d-b073-909b94cc65a4","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.721616Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7fdf0cfea925a750aee481c6cafa9209ddf1b81e824e2ec491dfc4e3ee5ca695","observation_id":"6c8f1de8-ef8f-4e7d-a8eb-839590a42726","resolution":{"observed_at":"2026-08-06T17:51:00.159465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.147335Z","title":"Decoupling zero-shot semantic segmentation","venue":null,"work_id":"ab1c6f3b-55dd-4e19-b3ff-629a3df14787","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.763998Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7b8c12e0f358eba8fa10cb898fdd68f2ee6e6995845fe7392e7fe3e3a274b52c","observation_id":"f249864c-39d3-422a-830b-1d3507fbd996","resolution":{"observed_at":"2026-08-06T17:51:00.150416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.137564Z","title":"Scaling open-vocabulary image segmentation with image-level labels","venue":null,"work_id":"6f69c5a1-f796-41cd-8c8a-edaec48d7ea4","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.811858Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:4b3fae819838eef73f5f82fc3949de89a6602b2272d35dad3b05aba1a11f3f5c","observation_id":"196ddc8d-1809-480d-9fcd-a4871ae8e14d","resolution":{"observed_at":"2026-08-06T17:51:00.141665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.128635Z","title":"Graphonomy: Universal human parsing via graph transfer learning","venue":null,"work_id":"f7897e44-1bb5-4d3b-ae86-8b9351bad91e","year":2019},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.868087Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:5847a208801b9e5ae4276fb36fd459607754efb9763b5ac81c27dbcdc383257c","observation_id":"6e6012ee-62be-4f62-a66d-2accc3d4e61e","resolution":{"observed_at":"2026-08-06T17:51:00.131954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.118510Z","title":"Drape: Dressing any person","venue":null,"work_id":"c44e13df-9f2b-4436-9cc9-aed3d3de2afc","year":2012},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.914056Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:eedd1e27493362c3e71e8d45cf0aad394e66dad176db006a8f7e6470a805ff75","observation_id":"3ea92ba1-9442-4e9e-972b-5eef680cb6b2","resolution":{"observed_at":"2026-08-06T17:51:00.122518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.108962Z","title":"On using pointnet architecture for human body segmentation","venue":null,"work_id":"f9ceb0ed-29c8-4009-9377-e3581a3cfb72","year":2019},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.972834Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:cc71523e65d32b836d6116c99a1c25c951d20557c1f20c736ffb9091342f9bd9","observation_id":"13a2de3f-e3d5-4afd-b2d1-6bfa2ecb823b","resolution":{"observed_at":"2026-08-06T17:51:00.111983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.099628Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"0c77ad6d-8590-4273-b2d2-16447ab8f34c","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.004117Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:b38bf379008cf08ad352439f9498f967009e43a684120f9d89742b5cdd480dfd","observation_id":"7a6a7e2b-5a16-470c-b41f-ef6a60f42af0","resolution":{"observed_at":"2026-08-06T17:51:00.103366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.089646Z","title":"Collaborative vision-text representation optimizing for open-vocabulary segmen- tation","venue":null,"work_id":"795b62cb-e7de-49e9-92d6-57a664e72a9b","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.112765Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:2746315e59d8464415268a779a7728b40de447b8900ce92d05a6b52d90496685","observation_id":"a4480e1e-eb9a-4ef1-b6fb-896f64d4a68f","resolution":{"observed_at":"2026-08-06T17:51:00.093118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.080017Z","title":"Sharp: Shape-aware reconstruction of people in loose clothing","venue":null,"work_id":"b328aef5-cd60-4593-8ec2-4e5e4fdd2420","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.254340Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:2017767aaa5d9a56cc3dbb0dce4141d5588bf2d13e1bb0f95a967908831f4578","observation_id":"2f22b7f8-8743-4e28-91ee-3335ae6c97cd","resolution":{"observed_at":"2026-08-06T17:51:00.083932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:52.393601Z","title":"Panoptic studio: A massively multiview system for social motion capture","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.393601Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:cfd53d372b688c2c8a416128515c6e253d989984f1ab877daa5b415e76903671","observation_id":"ed8edc67-693a-4ff8-974e-65e80b6be7db","resolution":{"observed_at":"2026-08-06T17:50:52.393601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.066160Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"fb055a73-63e4-4580-82a4-63cda50753f1","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.509785Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ed0f61a3c7ef049b3e119c3e56a33068715a31c75a46746031122260e956c51f","observation_id":"3f4ccc78-6b2f-407d-a700-71ac3216cbf3","resolution":{"observed_at":"2026-08-06T17:51:00.069131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.057074Z","title":"Seg- ment anything","venue":null,"work_id":"10944c64-1253-481f-80ec-9d74b7ec5592","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.623449Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:b1d8ec64e6d092b49176da70b29cf1f3689f25b41f59a377f5e4bfd60a26b56b","observation_id":"c3b74b17-d313-4268-bf50-db3edc7ffc84","resolution":{"observed_at":"2026-08-06T17:51:00.060752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.048559Z","title":"Language-driven semantic segmentation","venue":null,"work_id":"f2b99822-813f-49e7-aec2-68caac346a4c","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.731998Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:bad7c9e053a89000487f47413c561efd8ad0e60a3e1c28e082b689ef71a4cd01","observation_id":"f35d2bfd-2763-40c8-93ee-3a44fd79ab92","resolution":{"observed_at":"2026-08-06T17:51:00.051550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:52.874715Z","title":"Grounded language-image pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.874715Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ed393244008efa47aaa9f7e95e8cddc1c428bce9b8a41588578b4880c46cc438","observation_id":"072c1ee0-ad73-47ac-bed0-a63285e3d746","resolution":{"observed_at":"2026-08-06T17:50:52.874715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.034852Z","title":"Open-vocabulary semantic seg- mentation with mask-adapted clip","venue":null,"work_id":"44642d18-7226-4980-ab0c-548b785018ad","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.961117Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ae85b89bb50864a1676c9ab61b47d767bda3a134c3ca45ebabd0789a18fba542","observation_id":"a7ab5bf6-a1ad-4852-9e63-aac77954c4e9","resolution":{"observed_at":"2026-08-06T17:51:00.037738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.026344Z","title":"Partslip: Low-shot part segmentation for 3d point clouds via pretrained image- language models","venue":null,"work_id":"7efedd6c-6e2b-4732-a5d9-75ad198042e2","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.050398Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:08168a594bf22798b1c7182be8f294a637876fc1a95d1d4ee1500bd648bf3a01","observation_id":"0230f9c1-b4bc-4cec-886f-3100b73fa80d","resolution":{"observed_at":"2026-08-06T17:51:00.029284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.018350Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"1aa26fa2-be5f-4bd4-b966-98756fba23d1","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.125523Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:0c5f3ec71720431a594c4d1f25dc67aff2eaa7fac96422d6ceb5a4f2c080a827","observation_id":"c11611dd-2def-4013-a462-091315d6ae41","resolution":{"observed_at":"2026-08-06T17:51:00.021201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.010559Z","title":null,"venue":null,"work_id":"80d3e1c3-cebf-453c-8171-5caaeb7e0698","year":2015},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.181272Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:576764af209b604ff3bd4fa8ca978c8e7492d9d538cfa6081a2f3c0a7bbc69fe","observation_id":"676f5f6c-4e03-4bb4-9270-1e94a8fe7527","resolution":{"observed_at":"2026-08-06T17:51:00.013344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:53.270207Z","title":"Dynamic 3d gaussians: Tracking by persistent dynamic view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.270207Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:32546f97b0204cca3fd3ac1b8e23931040958034a8b3af747605a3a765dcc792","observation_id":"2ef6f70e-f17b-4231-bcd0-90fcee363f37","resolution":{"observed_at":"2026-08-06T17:50:53.270207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13550","last_updated":"2025-03-28T04:36:55Z","snapshot_observed_at":"2026-07-06T19:53:21.444233Z","submitted_at":"2024-11-20T18:59:01Z","title":"Find Any Part in 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13550","snapshot_observed_at":"2026-08-06T17:50:53.354726Z","title":"Find any part in 3d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.354726Z"},"links":{"cited_paper":"/paper/2411.13550","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:3138fe1d0417b13319a2cbd4590ca02e39cdf062412b61497bdaba7b4d3e6e78","observation_id":"cfe10cad-e0ad-4536-b6e0-f4edef48df69","resolution":{"observed_at":"2026-08-06T17:50:53.354726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.996242Z","title":"Gim3d: A 3d dataset for garment segmentation","venue":null,"work_id":"b4c36118-44bf-4d59-852d-84e0d7a850b0","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.424875Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:26bc4939b51f79af0925ded54771cf52e2b493db599a0729b4e3624f20cc1716","observation_id":"d7617597-149c-484a-8a25-d484abb0bd24","resolution":{"observed_at":"2026-08-06T17:50:59.999111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.986738Z","title":"Gim3d plus: A labeled 3d dataset to design data-driven solutions for dressed humans","venue":null,"work_id":"ad443f12-2cb7-4f88-934e-61d5d94202c1","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.437337Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:04ec14f573826096221a78ea9c20750caec3437525713acca337efd453c0a1fd","observation_id":"46328877-c7f8-47e0-a62f-a19f12e297ad","resolution":{"observed_at":"2026-08-06T17:50:59.989589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.976989Z","title":"Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance","venue":null,"work_id":"c49f1a56-aa68-4a88-bb86-c68838953608","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.567231Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:38f6e657a219248f49bafc9469b22427022f489821deaa45debc5dbb50c3489a","observation_id":"29f81ef1-5581-488f-ae54-7fdd62b15b5c","resolution":{"observed_at":"2026-08-06T17:50:59.980303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:53.711045Z","title":"Clothcap: Seam- less 4d clothing capture and retargeting","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.711045Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:456ebdd6aadaa958c222cc888ea221d6113d359a8b872bfed3e3da4086ea930a","observation_id":"f9cf4a70-018b-408b-8968-403a583d9675","resolution":{"observed_at":"2026-08-06T17:50:53.711045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.967693Z","title":"3dpeople: Modeling the geometry of dressed humans","venue":null,"work_id":"a2fa04d4-bfd9-478e-91fa-9a45ef6eaa06","year":2019},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.846776Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:abc63f17d90be61bbdc0c9d7579460be348109095a36c525b3341f979ae52a3d","observation_id":"44f3bc1c-6177-4b60-9205-9831990143cc","resolution":{"observed_at":"2026-08-06T17:50:59.970917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.958844Z","title":"Pointnet: Deep learn- ing on point sets for 3d classification and segmentation","venue":null,"work_id":"1a1f23f9-2c0d-44e2-b82b-ed0d297a98b8","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.015587Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a768321c057ca64609cd87cc00e96fb7687acf5c55580ba05eee908bb27f23ee","observation_id":"f0cc671e-bcc9-4c7b-8fd7-a861093428b4","resolution":{"observed_at":"2026-08-06T17:50:59.961700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.949522Z","title":"Pointnet++: Deep hier- archical feature learning on point sets in a metric space.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"05ab0fb8-ffce-4b2c-bc39-23952656a542","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.129526Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:b6d70fc43084cad4692d7b037156499d205d885fecedaaf89da8ac487f13d04f","observation_id":"556f39a4-ef83-401a-aae3-a0da9cf26c2d","resolution":{"observed_at":"2026-08-06T17:50:59.952514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:54.273510Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.273510Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:0e4df8f755e166fa590183cca7f27fadf835f3c5b0eb7e5ef005388a010136df","observation_id":"9994fde3-33ba-4882-a03b-81776989f172","resolution":{"observed_at":"2026-08-06T17:50:54.273510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-06T17:50:54.418338Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.418338Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a4bdf10bde2852c79df4298bfddfc5aa06b285e309691eaff6d2b481ff0befc9","observation_id":"5b06be5b-4760-4e53-b89d-b25b34921be0","resolution":{"observed_at":"2026-08-06T17:50:54.418338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.894493Z","title":"Diffusionnet: Discretization agnostic learning on surfaces","venue":null,"work_id":"8c0f08d3-9c19-42d5-bc20-d5d8c4fd42ac","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.628538Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:9634898fe869b4558d7238e74f1cceec1bd6ea1251312f904440fd2589ef7f38","observation_id":"671f5f06-44e2-446b-9d28-4d2e2ae4eff3","resolution":{"observed_at":"2026-08-06T17:50:59.936190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.631579Z","title":"X-avatar: Expressive human avatars","venue":null,"work_id":"be2164f6-84e9-408d-a494-1a0e549a2c0e","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.815056Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7e18e1fc5066cf7e6a991b7dcac7a70b8f60431a0b7a3679633595300077aa42","observation_id":"dadc746d-bcbd-4c08-9cf7-a635235182c5","resolution":{"observed_at":"2026-08-06T17:50:59.770559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.491967Z","title":"Language embed- ded 3d gaussians for open-vocabulary scene understanding","venue":null,"work_id":"fbc8c0a8-72a2-4d12-b6dd-8fca55ac860d","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.943716Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:2edd6efd6b427000120b073a9820fac61230ce46ac2db37c93575b0836553a49","observation_id":"0056e02f-e2a0-4b23-bfb6-c8bc9cdbd0d7","resolution":{"observed_at":"2026-08-06T17:50:59.554681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.229326Z","title":"Alpha-clip: A clip model focusing on wherever you want","venue":null,"work_id":"8582c7b0-648d-49ec-988e-e1c3fd4464de","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.086219Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:1a93a94df2e075d23b0658d96ee4d4d527c377cbf26dea50b32767c1168a8612","observation_id":"21dccfb2-d0fe-42c1-ae59-ce20000a6399","resolution":{"observed_at":"2026-08-06T17:50:59.354930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19782","last_updated":"2025-02-27T05:47:05Z","snapshot_observed_at":"2026-08-09T03:42:45.568819Z","submitted_at":"2025-02-27T05:47:05Z","title":"Open-Vocabulary Semantic Part Segmentation of 3D Human","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19782","snapshot_observed_at":"2026-08-06T17:50:55.291691Z","title":"Open-vocabulary semantic part segmentation of 3d human","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.291691Z"},"links":{"cited_paper":"/paper/2502.19782","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:1bfdb380d207bca7030ceff11c5074bf2fccfcbc054552891bccf5ff3e7d170c","observation_id":"c0b8a48a-972e-4551-8e1b-d3fde75cf4a8","resolution":{"observed_at":"2026-08-06T17:50:55.291691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13631","last_updated":"2023-10-29T14:04:25Z","snapshot_observed_at":"2026-08-05T15:00:57.933479Z","submitted_at":"2023-06-23T17:36:44Z","title":"OpenMask3D: Open-Vocabulary 3D Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13631","snapshot_observed_at":"2026-08-06T17:50:55.494164Z","title":"Openmask3d: Open-vocabulary 3d instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.494164Z"},"links":{"cited_paper":"/paper/2306.13631","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:bf87bec20a8b129e7e00199c487e3df174fc9ca327df8571285b3de953e6a1ac","observation_id":"3c0a0a16-0a34-4cb6-a2f9-06561ad2f77e","resolution":{"observed_at":"2026-08-06T17:50:55.494164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:55.648449Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.648449Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7e79f9b63df02e21bc6b381b2c8a9284d39d4408967e0a0743b4c98d521d76b7","observation_id":"d6d6b93f-4a6d-410b-82ae-0e11febc781e","resolution":{"observed_at":"2026-08-06T17:50:55.648449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.107137Z","title":"Training pointnet for human point cloud segmentation with 3d meshes","venue":null,"work_id":"c97704cc-4900-4523-a250-fedda349996f","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.793500Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:11e9dcdc83908c653507eddc94b4d62fd2de2b7ef0264752b193a740c7d13a05","observation_id":"a6928442-e950-4ad2-a5ba-b42ff8266476","resolution":{"observed_at":"2026-08-06T17:50:59.179500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.945461Z","title":"4d-dress: A 4d dataset of real-world human clothing with semantic annotations","venue":null,"work_id":"8235eaa7-fadd-4525-8d49-25ba54267b46","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.001698Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:d0526b802565bf86744df4deb849ac84a11f144e491c062a83fca6ba156f331e","observation_id":"f1309973-7f61-4cb5-a295-84f7313d3422","resolution":{"observed_at":"2026-08-06T17:50:59.022634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.772945Z","title":"Point transformer v3: Simpler faster stronger","venue":null,"work_id":"88c3fa08-0c8a-45c4-825a-6153e2b97883","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.193223Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:42c53ab0ca1d05306893e7b5344ebcab469b90be539be30584a1c7072424359c","observation_id":"f88bfc5f-f934-4cc8-9ca7-386767f40ab3","resolution":{"observed_at":"2026-08-06T17:50:58.882442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.613935Z","title":"Owlii dynamic human mesh sequence dataset","venue":null,"work_id":"bd817f5a-c01c-40fe-b054-d47032bc7a4f","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.402933Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:f8949f102da30fbbe0495e300591eb36e2756a69049f770c3bf32f2a89974e41","observation_id":"1d9bc7c3-6b58-48ab-876e-e6610b009572","resolution":{"observed_at":"2026-08-06T17:50:58.680700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.486021Z","title":"Maskclustering: View consensus based mask graph clustering for open-vocabulary 3d instance segmentation","venue":null,"work_id":"ee9371c5-c97a-4fd2-9889-12efcc16a824","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.556531Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7544a0329631aabe980af422c064cac703d617e6ab42649345cc03645d8fb1b3","observation_id":"06fca95b-91bf-4ae2-aa0c-fa32d336e83d","resolution":{"observed_at":"2026-08-06T17:50:58.564510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.383929Z","title":"Function4d: Real-time human volumetric capture from very sparse consumer rgbd sensors","venue":null,"work_id":"5413b988-f26d-4032-a2fc-dfdc7e362492","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.722934Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:c1ffd50064d7c41bfd87a10f5274f777352cada4421ae2caa0ab74cf9b881e9b","observation_id":"d34dde30-9d5c-4176-9e96-9299ff85016f","resolution":{"observed_at":"2026-08-06T17:50:58.432785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:56.882521Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.882521Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:73e3186584e6d1101f5269c907b25bce6aef73b7a991d3d414f22dc676b1fd1b","observation_id":"721c34cd-ec02-4947-96ee-7ba09cb7fc58","resolution":{"observed_at":"2026-08-06T17:50:56.882521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.244206Z","title":"Black, and Gerard Pons-Moll","venue":null,"work_id":"259b5cf2-1fb6-43b7-85d8-f1f21b6cd173","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.052427Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:87b484e96d6a0e04de52584b7bb99785a8de10b689353cb31b4ce257eed2c083","observation_id":"1fcad798-6ff7-4519-9cdf-b1fe013a18da","resolution":{"observed_at":"2026-08-06T17:50:58.312943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.129829Z","title":"Dreamlip: Language-image pre-training with long captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.129829Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ed90ec0025da2f42dc6d88920ca03a665e7719c8380673c467ee43f6fda1646b","observation_id":"7d3154e4-d944-4d4a-82a2-0a967dd9d2ab","resolution":{"observed_at":"2026-08-06T17:50:57.129829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.113833Z","title":"Structured local radiance fields for human avatar modeling","venue":null,"work_id":"3ee9e538-909f-4edb-ab34-463e10d0dadd","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.218509Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:563dc33e8d8717d4d4e507d2b624a38c3222defc00ff09db1c81fc8c5d78adea","observation_id":"20f5d254-dd32-4248-b0a1-bd4cf19bf3f8","resolution":{"observed_at":"2026-08-06T17:50:58.175931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.961946Z","title":"Meshsegmenter: Zero-shot mesh semantic segmentation via texture synthesis","venue":null,"work_id":"0552a51d-2de9-4193-bed4-333dc7bd1dcb","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.286502Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:32cb3ca7dc8403e4f560a4a2d7da2346776f40b379eb78c44a12cd6f2e834e19","observation_id":"371e72d2-600c-4b41-9b48-0c438bf4f12d","resolution":{"observed_at":"2026-08-06T17:50:58.027730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03015","last_updated":"2023-12-05T01:33:04Z","snapshot_observed_at":"2026-07-06T16:57:21.997777Z","submitted_at":"2023-12-05T01:33:04Z","title":"PartSLIP++: Enhancing Low-Shot 3D Part Segmentation via Multi-View Instance Segmentation and Maximum Likelihood Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03015","snapshot_observed_at":"2026-08-06T17:50:57.346539Z","title":"Part- slip++: Enhancing low-shot 3d part segmentation via multi-view instance segmentation and maximum likelihood estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.346539Z"},"links":{"cited_paper":"/paper/2312.03015","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:b2d9ff3a601cf977508b9f253ed1386d54d09210cf930573f1b3d598a9a022db","observation_id":"5a010451-e3d8-444c-90bc-160beb3f0b07","resolution":{"observed_at":"2026-08-06T17:50:57.346539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.785529Z","title":"Open-vocabulary 3d semantic segmenta- tion with text-to-image diffusion models","venue":null,"work_id":"d809d6cb-3289-410a-8927-9f8e010fa8b1","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.413491Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:aee734bda838c9eb2ef202fda07a6369e24fbedca2aa82600e8f8d6494e01db4","observation_id":"8dd2f6d1-97d3-4398-a626-8a52dec14a95","resolution":{"observed_at":"2026-08-06T17:50:57.868416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.643180Z","title":"Cloth4d: A dataset for clothed hu- man reconstruction","venue":null,"work_id":"c3817066-6810-4b18-9047-e4c665f5a281","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.511667Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ade26dece1fdd800312b4f93ef8686ac23225fb45ab8ce20a52e9161317fd3ec","observation_id":"589122ea-b856-44d6-8848-19cd56b2285a","resolution":{"observed_at":"2026-08-06T17:50:57.695755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:35:34.759323Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":41},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2507.09880."}