{"as_of":"2026-08-16T21:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f0df2ebf0cef11d7757b15bb57431aff3eaa83430f7fb9675052dbdecddb4f4","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:45:40.882265Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.18944/citation-record","integrity":"/paper/2411.18944/integrity","json":"/paper/2411.18944/citation-record.json","paper":"/paper/2411.18944"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.10180","last_updated":"2021-03-18T11:30:31Z","snapshot_observed_at":"2026-08-16T18:38:02.399669Z","submitted_at":"2021-03-18T11:30:31Z","title":"OmniPose: A Multi-Scale Framework for Multi-Person Pose Estimation","version":1},"cited_work":{"arxiv_id":"2103.10180","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.10180","snapshot_observed_at":"2026-08-12T10:45:41.007543Z","title":"OmniPose: A Multi-Scale Framework for Multi-Person Pose Estimation","venue":"cs.CV","work_id":"4cccb22f-e0ab-4706-b294-aacea53bdbf3","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.754930Z"},"links":{"cited_paper":"/paper/2103.10180","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:0886012940aaf04fa792552a94b732877873942d3fd250782ecf6f60367b087f","observation_id":"49b2c69f-a853-4185-98c1-55aa3cb81cc3","resolution":{"observed_at":"2026-08-12T10:45:41.014544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.315202Z","title":"Unipose+: A unified framework for 2d and 3d human pose es- timation in images and videos","venue":null,"work_id":"d75a2bb4-606c-426b-bd82-d5824bf93549","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.761083Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:36e18d82be942e0a9d7ebb4a2955fb858942f5e101044d621b7e042d0604c0d8","observation_id":"3c1b5c4e-a886-4c86-a2ab-22003cca9fc9","resolution":{"observed_at":"2026-08-12T10:45:41.319831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.300580Z","title":"BAPose: Bottom-up pose estimation with disentangled water- fall representations","venue":null,"work_id":"41afec1e-05de-4a6d-bf59-3ead13627824","year":2023},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.765786Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:389102dda0594bf6a574d96b7981a0f975e5a58a8854e2a4f183b6e4b8757d90","observation_id":"1b14281e-ec90-4655-9db5-e876def5fd98","resolution":{"observed_at":"2026-08-12T10:45:41.305921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.286175Z","title":"Full-BAPose: Bottom up framework for full body pose estimation","venue":null,"work_id":"749ecd14-2fdd-47e0-a0f0-68966c53cda9","year":2023},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.771217Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:5400148ad111ea5d73f754174c99a9a61757ca3c5e10a2ff02929c7fbfa72e69","observation_id":"d239611b-80e3-46f0-92db-5cd14179a6aa","resolution":{"observed_at":"2026-08-12T10:45:41.290399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.273040Z","title":"Realtime multi-person 2d pose estimation us- ing part affinity fields","venue":null,"work_id":"e62ea623-e48e-468a-b72a-cba9e60a8be8","year":2017},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.776181Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:458bd799d09aaf0a7d84d17f202038dfc04eff0d92e113fc20dc2577ab1693ef","observation_id":"1c42810f-6717-44a8-bbad-538185bc1cef","resolution":{"observed_at":"2026-08-12T10:45:41.277295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.257394Z","title":"Yuille, and Xiaogang Wang","venue":null,"work_id":"05af6caa-f3c2-4e8f-b846-ee8b56921292","year":2017},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.780889Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:1ab68ffb7fbcfca05bda8b9d8ebacfacf675455f0a01e64302ef04f7254f09d2","observation_id":"8bf586b1-2653-4038-848a-11750dc2696f","resolution":{"observed_at":"2026-08-12T10:45:41.263225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.242013Z","title":"Openmmlab pose estimation toolbox and benchmark","venue":null,"work_id":"65409654-72bc-4863-9e1f-36fc2dd59497","year":2020},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.786489Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:14528347e3f1caf9a9eb2e189000b47f6507b7cf021c6ec65e044a9957fcd0be","observation_id":"c2146e82-d257-474f-b143-50aff9440978","resolution":{"observed_at":"2026-08-12T10:45:41.246717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T10:45:40.791075Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.791075Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:a46df87c5cc4a9ee6a6ed886a6dd8d6a833fc6101ee504f0199f8424b91eeb55","observation_id":"cedd7a66-f382-4208-bc40-5c12a5f30c62","resolution":{"observed_at":"2026-08-12T10:45:40.791075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15001","last_updated":"2023-01-16T18:58:58Z","snapshot_observed_at":"2026-08-16T16:28:04.474972Z","submitted_at":"2022-09-29T17:57:08Z","title":"Dilated Neighborhood Attention Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15001","snapshot_observed_at":"2026-08-12T10:45:40.795479Z","title":"Dilated neigh- borhood attention transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.795479Z"},"links":{"cited_paper":"/paper/2209.15001","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:5ebe209987688c5f57fba1c2d24aed24fbc064ac9c0603d67ef4a252ae3e1e9a","observation_id":"6f70adb9-6405-4ea1-93da-b13d67a8cbab","resolution":{"observed_at":"2026-08-12T10:45:40.795479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.227915Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"a5606657-60f4-487d-9e74-38995a289046","year":2016},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.800136Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:3f99984bfddb1b1859cffe81e4da6388c01b0daa10bfefa356ae7ab77be725dd","observation_id":"6d842eda-a9d8-4aa0-965a-cf1d7799f921","resolution":{"observed_at":"2026-08-12T10:45:41.232533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.00148","last_updated":"2019-05-30T01:30:32Z","snapshot_observed_at":"2026-08-16T09:34:05.801311Z","submitted_at":"2019-01-01T12:52:37Z","title":"Rethinking on Multi-Stage Networks for Human Pose Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.00148","snapshot_observed_at":"2026-08-12T10:45:40.804871Z","title":"Rethinking on multi- stage networks for human pose estimation","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.804871Z"},"links":{"cited_paper":"/paper/1901.00148","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:9b250125d650aa072ac6601a3fd2ea41e6d61ee9ff1eda29f08b6356861d0883","observation_id":"946f6bbe-7478-4852-9fd0-061826f8e1e1","resolution":{"observed_at":"2026-08-12T10:45:40.804871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.213763Z","title":"Token- Pose: Learning keypoint tokens for human pose es- timation","venue":null,"work_id":"d1830ae2-edf8-46fa-a874-790bdf1f2aa2","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.809858Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:e0f2d765a6a2adaa4273bcf87a27aad90f4eb057b8ed9c14f6f96cf3bd393f45","observation_id":"44929b41-d367-4730-8037-b72c42a43728","resolution":{"observed_at":"2026-08-12T10:45:41.218227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.199486Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll´ar, and C","venue":null,"work_id":"51cea8e1-33bb-4019-b38f-ae2908212566","year":2014},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.814490Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:a205cb9e165ef15c8ab163d35f822f7239b5c539099f241cdaa949cc84c30089","observation_id":"0428547c-f1ef-4ccb-889c-ccd4a12be50c","resolution":{"observed_at":"2026-08-12T10:45:41.204328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.183794Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"7416f3da-55f5-4973-bc58-778e601428ae","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.819136Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:10d258d60286fdceaef3b02db3b6ce3a5559016131cee44e63fa5526b0754c92","observation_id":"51547b5c-ead1-4f7c-892f-42e806023fad","resolution":{"observed_at":"2026-08-12T10:45:41.188848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.168177Z","title":"Stacked hourglass networks for human pose estimation","venue":null,"work_id":"c24e9c51-e34b-449b-a8da-f1e18b4b25e1","year":2016},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.823482Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:2cee65c2c87df551fcd96bf742ac49f49bb9f40cf8853921500b1328c8bb8f1d","observation_id":"e14903af-0820-4d31-9532-4f5f4a3d2d0b","resolution":{"observed_at":"2026-08-12T10:45:41.172765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09237","last_updated":"2019-04-19T16:21:38Z","snapshot_observed_at":"2026-08-14T16:43:55.734754Z","submitted_at":"2019-04-19T16:21:38Z","title":"On the Convergence of Adam and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09237","snapshot_observed_at":"2026-08-12T10:45:40.827758Z","title":"On the convergence of adam and beyond","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.827758Z"},"links":{"cited_paper":"/paper/1904.09237","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:468adb205cd6112e5b9d78b6bfa520288c8c1ff10f4d8bf9a33923aa4a8be894","observation_id":"a8dec8df-d24b-4455-8348-d01eeae7c86d","resolution":{"observed_at":"2026-08-12T10:45:40.827758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.154491Z","title":"15 keypoints is all you need","venue":null,"work_id":"85574379-70cb-4e7a-ac5f-2ef0429e0833","year":2020},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.832587Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:8ba688ef440fdd1c576bef7ac4bb76bcf46b206baacec2886f566717167121d3","observation_id":"93cef3a9-45e3-4152-8840-d8d7348ef792","resolution":{"observed_at":"2026-08-12T10:45:41.158898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.139771Z","title":"Deep high-resolution representation learning for hu- man pose estimation","venue":null,"work_id":"32714630-a26a-462b-917c-43e2b6b98a36","year":2019},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.837133Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:b9d96295c49e16cd5269ee85b9236e9537aa7f766b937f91d471f6558100c9d2","observation_id":"ef167870-978c-41a5-9cc3-17b8960760a3","resolution":{"observed_at":"2026-08-12T10:45:41.144722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.125236Z","title":"Deeply learned com- positional models for human pose estimation","venue":null,"work_id":"97ac99ee-6624-4ed0-bc18-b92c2d71b207","year":2018},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.841675Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:0749db31eb76aae75a414b213e407c2818f5341c0616343189608afd1ccb256f","observation_id":"850a7f89-1548-4479-a50a-d22121947c87","resolution":{"observed_at":"2026-08-12T10:45:41.129878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.110910Z","title":"DeepPose: Human pose estimation via deep neural networks","venue":null,"work_id":"d202d431-de01-4718-88da-17013d5eeb53","year":2014},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.846447Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:ed3d965e6ff10fddb39d81a9b29c40db37b47bb2e14fe90c116b9caf5e1e571e","observation_id":"f00b7b4f-58f2-4949-aa41-eba39dbcf6d8","resolution":{"observed_at":"2026-08-12T10:45:41.115506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:40.851188Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.851188Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:f6fec4b03cd3812238a06e0b2f82ed27a0f6ffac5f38aa9b78061f21860ff53b","observation_id":"b6d9ea08-9453-47e2-9a25-da2b23b31e43","resolution":{"observed_at":"2026-08-12T10:45:40.851188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.084310Z","title":"Deep high- resolution representation learning for visual recogni- tion","venue":null,"work_id":"a99834a3-ab1c-4183-97d8-01658f587821","year":2020},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.855807Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:9c4b76f0c373cf45379839710c3288e9926ac1c4c7dda0a2cf554f82bbf5ff8a","observation_id":"df18c7d0-eed9-413a-ab73-a4f08c1d7a0e","resolution":{"observed_at":"2026-08-12T10:45:41.089839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.070004Z","title":"Convolutional pose machines","venue":null,"work_id":"2d0dad86-62b7-4728-b347-ca999887941a","year":2016},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.860167Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:46b26d1feb9a1cf8a6eecb8058c1a308383a6b25808d00ad04b0da13b8c96775","observation_id":"106afd55-cb4b-4ac3-ba3a-149ba594317e","resolution":{"observed_at":"2026-08-12T10:45:41.074381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-16T17:04:24.971575Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-12T10:45:40.864432Z","title":"Vitpose: Simple vision transformer base- lines for human pose estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.864432Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:b6cad987705562d87f408427b33c2eb729b98c554c25afe0f4a68b11038418ad","observation_id":"a2362cc5-7c70-4a12-b54e-ec1b8cacb17c","resolution":{"observed_at":"2026-08-12T10:45:40.864432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.055289Z","title":"TransPose: Keypoint localization via transformer","venue":null,"work_id":"345e9004-63a1-4682-9003-00b6f3006e69","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.869277Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:bff33cb56b6a54809a9f707878a19945f4702c3fcd9f6ed315deac74251498a5","observation_id":"1d8b589b-af4d-4921-8095-9f669c78bed3","resolution":{"observed_at":"2026-08-12T10:45:41.060053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.040444Z","title":"HRFormer: High-resolution vision transformer for dense predict","venue":null,"work_id":"4f9c5b97-1e6f-46ec-967a-79a0b44ee160","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.873458Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:36faf620ff7380fd3a4759ae95ece3a139a1e0601bf2e391e91bfb57e05af002","observation_id":"d48e2c71-5285-4b0b-9c18-d769ce02cad0","resolution":{"observed_at":"2026-08-12T10:45:41.044908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01760","last_updated":"2019-01-07T11:58:10Z","snapshot_observed_at":"2026-08-14T17:34:20.618926Z","submitted_at":"2019-01-07T11:58:10Z","title":"Human Pose Estimation with Spatial Contextual Information","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01760","snapshot_observed_at":"2026-08-12T10:45:40.877764Z","title":"Human pose estimation with spatial contextual information","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.877764Z"},"links":{"cited_paper":"/paper/1901.01760","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:8b84683c3973729a3e03fca43b9814750c09fc641d9957fdd568e7d238772f05","observation_id":"a88c9097-a826-491e-9fbd-0f3d5403951a","resolution":{"observed_at":"2026-08-12T10:45:40.877764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.025187Z","title":"3d human pose estimation with spatial and temporal transform- ers","venue":null,"work_id":"9cd593d0-0e23-4f36-912e-0b8ca292fe08","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.882265Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:48a8b445ca0f3177482b9dbe224e75ab2a4282fbaf4edf22d0e1b0be03ebdb57","observation_id":"52b4b00b-bf0e-453b-b94e-51f4350897ed","resolution":{"observed_at":"2026-08-12T10:45:41.030614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2411.18944."}