{"as_of":"2026-08-09T10:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90b99e6f7cb96ab8e9bd65535e4c4c6e0cc3f17569d806b8b5fde4b7f336c5c4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:43:35.766548Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:59:55.881195Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":"2204.12484","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-07-04T14:59:55.881195Z","title":"Vit- pose: Simple vision transformer baselines for human pose estimation","venue":null,"work_id":"5abe07b1-cd8a-480a-a27b-f33bf5a4aea1","year":2022},"citing_paper":{"arxiv_id":"2312.06409","last_updated":"2026-05-07T09:54:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-11T14:30:11Z","title":"LiCamPose: Combining Multi-View LiDAR and RGB Cameras for Robust Single-timestamp 3D Human Pose Estimation","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-24T04:38:05.013487Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2312.06409"},"observation_digest":"sha256:789eeeafe4bf8ebb4f9c797d85e50aa51b6164b8e207778e2ff70dc626a05e06","observation_id":"9a2f4f26-73b5-4640-960f-ac26fa3166da","resolution":{"observed_at":"2026-05-24T04:38:53.662646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-06T20:34:11.858918Z","title":", author Zhang, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02519","last_updated":"2025-07-03T10:32:49Z","snapshot_observed_at":"2026-08-06T20:24:47.823350Z","submitted_at":"2025-07-03T10:32:49Z","title":"IMASHRIMP: Automatic White Shrimp (Penaeus vannamei) Biometrical Analysis from Laboratory Images Using Computer Vision and Deep Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:34:11.858918Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2507.02519"},"observation_digest":"sha256:3c98d0f8da97eeeee418011a91c3ede408a8e4548267f28a17329c323de19b61","observation_id":"d8277b2a-9c79-4a82-8811-17f75591c3fd","resolution":{"observed_at":"2026-08-06T20:34:11.858918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-06T17:56:03.799771Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09562","last_updated":"2025-07-13T10:10:17Z","snapshot_observed_at":"2026-08-09T04:04:11.824480Z","submitted_at":"2025-07-13T10:10:17Z","title":"Prompt Engineering in Segment Anything Model: Methodologies, Applications, and Emerging Challenges","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T17:56:03.799771Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2507.09562"},"observation_digest":"sha256:aa39f9a84f34527c678ab4e05e6cc228e37eae6a2fb1a89039b6a39969715882","observation_id":"c43331d7-32b4-49a9-b036-c96b36276fa0","resolution":{"observed_at":"2026-08-06T17:56:03.799771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-06T17:23:34.997088Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11075","last_updated":"2026-05-29T02:04:29Z","snapshot_observed_at":"2026-08-06T17:14:27.176109Z","submitted_at":"2025-07-15T08:16:39Z","title":"Joint angle based learning to refine kinematic human pose estimation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:23:34.997088Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2507.11075"},"observation_digest":"sha256:fed685c4144d0ba8951a0573af1cc0ccf005b02a0bd7c52e7ed538f4152a4b40","observation_id":"70691822-ca09-41a5-99ec-9f3115eea11a","resolution":{"observed_at":"2026-08-06T17:23:34.997088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-06T22:43:35.766548Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22898","last_updated":"2025-06-25T20:52:50Z","snapshot_observed_at":"2026-08-06T22:38:22.250439Z","submitted_at":"2025-06-25T20:52:50Z","title":"Voice-guided Orchestrated Intelligence for Clinical Evaluation (VOICE): A Voice AI Agent System for Prehospital Stroke Assessment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:43:35.766548Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2507.22898"},"observation_digest":"sha256:8ee6b55750ae9237f99ae0127d7bf494cace0e3825464b1b4d78d543e764dec8","observation_id":"f04c8987-4a2f-4206-9a41-85b60e932721","resolution":{"observed_at":"2026-08-06T22:43:35.766548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-05T16:24:59.404743Z","title":"Zhendong Yang, Ailing Zeng, Chun Yuan, and Yu Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18621","last_updated":"2025-08-26T02:51:31Z","snapshot_observed_at":"2026-08-07T12:23:53.377738Z","submitted_at":"2025-08-26T02:51:31Z","title":"Wan-S2V: Audio-Driven Cinematic Video Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T16:24:59.404743Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2508.18621"},"observation_digest":"sha256:8f1ee5ec97a9f73ad487c757d0cd96b5cfe96d6f067e61a28fb330109b7c5dc6","observation_id":"d77ea705-6962-4e0f-b2a1-7babb4f8852b","resolution":{"observed_at":"2026-08-05T16:24:59.404743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":"2204.12484","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-07-04T14:59:55.881195Z","title":"Vit- pose: Simple vision transformer baselines for human pose estimation","venue":null,"work_id":"5abe07b1-cd8a-480a-a27b-f33bf5a4aea1","year":2022},"citing_paper":{"arxiv_id":"2604.03299","last_updated":"2026-03-29T09:08:57Z","snapshot_observed_at":"2026-08-02T09:45:03.258790Z","submitted_at":"2026-03-29T09:08:57Z","title":"MoViD: View-Invariant 3D Human Pose Estimation via Motion-View Disentanglement","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-14T21:23:13.451470Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2604.03299"},"observation_digest":"sha256:9055256b67dd2c149ce9702664f9e82afa2b3e61b4c19bf930d7ccb53ea9ef93","observation_id":"b73d90c3-7ac4-4752-9c61-c8ab89f6ed4b","resolution":{"observed_at":"2026-05-14T21:28:00.269211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":"2204.12484","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-07-04T14:59:55.881195Z","title":"Vit- pose: Simple vision transformer baselines for human pose estimation","venue":null,"work_id":"5abe07b1-cd8a-480a-a27b-f33bf5a4aea1","year":2022},"citing_paper":{"arxiv_id":"2606.26215","last_updated":"2026-06-24T17:56:30Z","snapshot_observed_at":"2026-08-03T02:40:55.694894Z","submitted_at":"2026-06-24T17:56:30Z","title":"TaskNPoint: How to Teach Your Humanoid to Hit a Backhand in Minutes","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-26T01:57:35.170470Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2606.26215"},"observation_digest":"sha256:8d92bcdbff817dfe52ab15a1096457f1b3b91f44cb34410d98dc08a8df074409","observation_id":"51cb353f-964f-46b9-9fcb-b1e314c05059","resolution":{"observed_at":"2026-07-04T14:59:55.882640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":"2204.12484","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-07-04T14:59:55.881195Z","title":"Vit- pose: Simple vision transformer baselines for human pose estimation","venue":null,"work_id":"5abe07b1-cd8a-480a-a27b-f33bf5a4aea1","year":2022},"citing_paper":{"arxiv_id":"2606.28237","last_updated":"2026-06-26T16:23:40Z","snapshot_observed_at":"2026-07-07T00:02:18.989389Z","submitted_at":"2026-06-26T16:23:40Z","title":"Unleashing Infinite Motion: Scaling Expressive Quadrupedal Motion via Generative Video Priors","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T04:10:56.435946Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2606.28237"},"observation_digest":"sha256:b6b80254660a7a9930e6c9b12fbfa58ba4439d4cbed37fbe66d8d09c9d793fe0","observation_id":"ffe45601-26d7-495c-9e3b-2e46511faa18","resolution":{"observed_at":"2026-07-01T17:05:51.239271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2204.12484/citation-record","integrity":"/paper/2204.12484/integrity","json":"/paper/2204.12484/citation-record.json","paper":"/paper/2204.12484"},"outbound":[],"paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T16:43:13.815044Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2204.12484."}