{"as_of":"2026-08-08T02:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:132fb98e9af899f8eed1e7e61f257c6c163e6e7a038012b29f7e826b90050401","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:06:47.159731Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.03481/citation-record","integrity":"/paper/2506.03481/integrity","json":"/paper/2506.03481/citation-record.json","paper":"/paper/2506.03481"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-07-06T11:08:17.373935Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-07T11:06:43.477778Z","title":"Vi- creg: Variance-invariance-covariance regularization for self- supervised learning.arXiv preprint arXiv:2105.04906, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.477778Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:a5f3099b5ea849a2c8d0be9e26863d86cc1907667136195abe69df154a90266c","observation_id":"43869c56-db2f-4fb8-b7fe-8d7d2e1dc045","resolution":{"observed_at":"2026-08-07T11:06:43.477778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.683702Z","title":"Frame-wise action representations for long videos via sequence contrastive learning","venue":null,"work_id":"4bc291b2-5a91-4dc6-9cf9-5d5b8b70595d","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.540489Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:4238ef8cc69439367b21580d1b86e25896c144840ba613842e57a393eb3e9de3","observation_id":"6a554996-f228-4b9a-aea6-19bf188e6c79","resolution":{"observed_at":"2026-08-07T11:06:47.686881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.674027Z","title":"Hi- erarchically self-supervised transformer for human skeleton representation learning","venue":null,"work_id":"60c55ebe-32f9-4779-a546-e23a53575a4d","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.610467Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:346966939132db28a1fad45f177d76d3e82d93981017a176cd264f1cc2dd798a","observation_id":"cfce7484-644c-4b6e-bc54-84be252e4128","resolution":{"observed_at":"2026-08-07T11:06:47.677366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.663262Z","title":"In- fogcn: Representation learning for human skeleton-based action recognition","venue":null,"work_id":"005681fd-ab84-4389-9c4b-932eca67455d","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.642395Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:ad42939db750946d6aba4cdfab3530e7591d92c4c5073f0d9704acb4bd35a5bb","observation_id":"b3c0de17-5446-45e1-b7f0-4fba9aee4c61","resolution":{"observed_at":"2026-08-07T11:06:47.666810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.652785Z","title":"A large- scale study of spatiotemporal representation learning with a new benchmark on action recognition","venue":null,"work_id":"d99d3548-cade-425f-994b-0e37dd20592d","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.715123Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:aeb52e5086102827e9e60e98dab96f3f286cebe952525d12da694d011bd73649","observation_id":"f0d968a9-9c65-45f3-9718-33677dfb3297","resolution":{"observed_at":"2026-08-07T11:06:47.656206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.642590Z","title":"Hierarchical contrast for unsu- pervised skeleton-based action representation learning","venue":null,"work_id":"362fabc8-27da-4333-bd62-45ce90db3650","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.774814Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:b4cc5da78600289928254f717ed2ce173de30358088d93139b3b7137a3ac29cc","observation_id":"3c0b51a7-4cbc-4b86-be40-889624708444","resolution":{"observed_at":"2026-08-07T11:06:47.646014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:43.810978Z","title":"Representation learning of temporal dynamics for skeleton-based action recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.810978Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:c81ee56ad10a9062f1871ed789581b24ed31c945f29da4d073a5fa55f81fe65f","observation_id":"d5fc86b3-f8d1-4d8e-b393-c9c8a4162828","resolution":{"observed_at":"2026-08-07T11:06:43.810978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.626784Z","title":"Hyperbolic self-paced learning for self-supervised skeleton-based action representations","venue":null,"work_id":"28ca0ff4-85ac-40b8-a272-bb9254b650fd","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.866534Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:f7d722dd5cf2c927f59430bc26bc26fa00074acc92a3babfb200da03fc354d72","observation_id":"e239a6bd-68fb-4c26-985a-2d3a72d94afa","resolution":{"observed_at":"2026-08-07T11:06:47.629919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.616821Z","title":"Contrastive learning from ex- tremely augmented skeleton sequences for self-supervised action recognition","venue":null,"work_id":"7cba05bb-21f5-4020-b0b5-a60f285d98d4","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.941521Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:4290643832c4fde8892f4ba57a1e7638d91e71cea9eb4274e476faf03b01ad45","observation_id":"a05ea20e-4a6f-4bce-90bf-11c4609ab040","resolution":{"observed_at":"2026-08-07T11:06:47.619884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.606847Z","title":"Video rep- resentation learning by dense predictive coding","venue":null,"work_id":"c1c6ca6e-7b7b-4324-918b-f42f1a9f6b07","year":2019},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:43.997593Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:e62c10813df57989ddf924b026eea4680479261045581ddc46b07fa387ff4338","observation_id":"3617edf7-bb36-4b5f-935a-409e729cc5a5","resolution":{"observed_at":"2026-08-07T11:06:47.610079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.597184Z","title":"Global-local motion transformer for unsupervised skeleton-based action learning","venue":null,"work_id":"5987e83e-233f-4ff6-abd5-93f2351abf6d","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.067890Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:5c3464384683cac9bd2f43432fdeceb5a4bcbeef4e398acb336cee8a8b85479f","observation_id":"0637f5ca-5876-4933-8e4d-b7f42bc09df3","resolution":{"observed_at":"2026-08-07T11:06:47.600398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.586939Z","title":"3d human action rep- resentation learning via cross-view consistency pursuit","venue":null,"work_id":"37170f4b-ec0e-4367-ad59-5c4bc106757a","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.109472Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:5075608a1face1e46f723420d0e3b6c5f2d48f610b2b55a8c24f2de17fa1e098","observation_id":"6c23e607-05af-4153-948a-d3ffbad8c4bb","resolution":{"observed_at":"2026-08-07T11:06:47.590385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.576414Z","title":"Ms2l: Multi-task self-supervised learning for skeleton based action recognition","venue":null,"work_id":"ace5a4e9-9ed5-48ac-9c87-73ed1ae32db4","year":2020},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.166951Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:19a317a6b8c0db6c0aca3e6daa63b5181e7362df1cfe29046a6cc5b8c776407f","observation_id":"b504febb-b53d-46ef-ad32-ba0772f154a9","resolution":{"observed_at":"2026-08-07T11:06:47.579881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.565855Z","title":"Actionlet- dependent contrastive learning for unsupervised skeleton- based action recognition","venue":null,"work_id":"02501a4d-e06a-410d-aca0-82784a027365","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.243344Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:f67259f2b2a59e608078037e54bb597323535e64c806176bf6b01f325fd36a2f","observation_id":"fc7de963-b9dd-4970-bef4-1c01fd6d56fd","resolution":{"observed_at":"2026-08-07T11:06:47.569320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.556135Z","title":"Idempotent unsupervised representation learning for skeleton-based action recognition","venue":null,"work_id":"007f5f4e-a14a-4ddd-98fe-52d4086d7897","year":2025},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.287176Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:f8239884b63facc049c4d62af392184148f2abae83561bc3ebadb8aa92e10708","observation_id":"eb9ba976-dc1a-4705-b092-54caceb7bb06","resolution":{"observed_at":"2026-08-07T11:06:47.559503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.545944Z","title":"Ntu rgb+ d 120: A large- scale benchmark for 3d human activity understanding.IEEE Transactions on Pattern Analysis and Machine Intelligence, 42(10):2684–2701, 2019","venue":null,"work_id":"38447e06-05b8-4e9f-b4b2-f9419a390d08","year":2019},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.347445Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:95de5c9d02055ce0593c32abd49cb8223db9806c817b8aad5a2b2a1944ca8657","observation_id":"be287057-e648-435a-8176-0d52f4a6ef49","resolution":{"observed_at":"2026-08-07T11:06:47.549687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.535935Z","title":"A benchmark dataset and comparison study for multi-modal human action analytics.ACM Transactions on Multimedia Computing, Communications, and Applications, 16(2):1–24, 2020","venue":null,"work_id":"e6fc99d6-89c1-40de-a6c7-c7e326f60773","year":2020},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.411386Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:9046ab1288715d93f860cf12a777660e17df8faa5c49e6a80c4cd39119b4199c","observation_id":"7a942322-d48f-4723-94ab-e699f538f6de","resolution":{"observed_at":"2026-08-07T11:06:47.539351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:44.456435Z","title":"Cmd: Self-supervised 3d action representation learning with cross-modal mutual distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.456435Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:414fbc0db40347de088d7345f5a0b07d7d95a1541502d694fbb13b0157e56bf3","observation_id":"06c13971-c70b-4d43-a961-238e44a52caa","resolution":{"observed_at":"2026-08-07T11:06:44.456435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.520001Z","title":"Masked motion predictors are strong 3d action representation learners","venue":null,"work_id":"ca8c829c-63b7-45a8-a1d4-bcd326f7138f","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.521609Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:e948e6c4eaff41b3237b423a4eccc05ea91f6172e7ad8f8e4974f4dd0717962c","observation_id":"19596449-8966-4c42-b069-e164635565dc","resolution":{"observed_at":"2026-08-07T11:06:47.523498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:44.580750Z","title":"Unsupervised 3d human pose representation with viewpoint and pose disen- tanglement","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.580750Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:c6dd8c74ade070bfd50fc737a441a78f0494e38834f75c691dc8799cd97fed4c","observation_id":"c21f7671-1e21-4c25-ae30-7981095a6c89","resolution":{"observed_at":"2026-08-07T11:06:44.580750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.502347Z","title":"Skeleton-based action recognition via spatial and temporal transformer networks.Computer Vision and Image Under- standing, 208:103219, 2021","venue":null,"work_id":"998ff79d-22f2-4c55-906f-f5554595f97a","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.619351Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:d333894b2f0018c20c3f46c70d200ddb45cc0af7be3ec909837daa34cdf0666b","observation_id":"bcdffa0c-90c1-497d-8abb-181f2bda67ac","resolution":{"observed_at":"2026-08-07T11:06:47.505971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:44.670421Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.670421Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:06a57cf006fb10793aae90ad78ee1060c4c11575f9d980291ae2e7931b6b2e6b","observation_id":"332d7af5-cd79-4f99-9506-9cb2b1f64c24","resolution":{"observed_at":"2026-08-07T11:06:44.670421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.485882Z","title":"Self-supervised video transformer","venue":null,"work_id":"0207edfe-3ff6-432a-9e95-cbd113543a46","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.734310Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:3c7804e6ba8d772673b8043277b03c38756c3e81e445274ff0029b23ea687443","observation_id":"04c958e0-640a-479a-80c8-c41f5782d3f0","resolution":{"observed_at":"2026-08-07T11:06:47.489218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.475862Z","title":"Halp: Hal- lucinating latent positives for skeleton-based self-supervised learning of actions","venue":null,"work_id":"9cab1aba-f05f-47d5-977b-f0b0ae228b95","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.783384Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:09f45c8e063dfe5cd2a9a4f7fe6a4d1515faf06def9934f2c53f51585240261f","observation_id":"b8a1dca4-1888-4716-8fa5-efd342c20dac","resolution":{"observed_at":"2026-08-07T11:06:47.479352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.465250Z","title":"Ntu rgb+ d: A large scale dataset for 3d human activity anal- ysis","venue":null,"work_id":"ea8f8d3d-d3d0-4a49-8f1a-58f0cdf7c45b","year":2016},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.838929Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:9db16d7d738b53b148829201dcd8bd634825f1cc0af40d56fd32ed5907bce7f8","observation_id":"dd4c0264-46ca-4371-9bb9-17c8f566a871","resolution":{"observed_at":"2026-08-07T11:06:47.468575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:44.877195Z","title":"Finegym: A hierarchical video dataset for fine-grained action understand- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.877195Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:8441eb55d093c04756ce59d3f8e2d09acc05196e40bdbdd929822dbaadb36f13","observation_id":"e3bdde17-6881-437f-90b6-53854179d1c0","resolution":{"observed_at":"2026-08-07T11:06:44.877195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.448022Z","title":"Adversarial self-supervised learn- ing for semi-supervised 3d action recognition","venue":null,"work_id":"977eae65-fa65-4024-a719-d0939197dd05","year":2020},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.916841Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:aae5ac67fd47f2abe88fbdb2f54949a5958e7404a066f38fd4c233cd14f5de4a","observation_id":"8d089eb5-a310-465d-9c93-6012dcd93b16","resolution":{"observed_at":"2026-08-07T11:06:47.451295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.437795Z","title":"Predict & cluster: Unsupervised skeleton based action recognition","venue":null,"work_id":"196637b0-1bf2-469b-8092-e2f54df39b4e","year":2020},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:44.989452Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:eaefa58aca3fc285e4e1a044d2d71f2feb2f5a981f747892856145719a946d10","observation_id":"c6a1ba77-9a03-4dd8-8a95-952d784952c8","resolution":{"observed_at":"2026-08-07T11:06:47.441188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.427204Z","title":"Self-supervised 3d skeleton action representation learning with motion con- sistency and continuity","venue":null,"work_id":"ac93f709-199a-4194-b2b3-f7ba96b96079","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.004867Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:4b54e3c2bc0d0ea82e87ce8c24c7b9f2f602a5e3df7c3f07f9b04e7a8dbecb39","observation_id":"c82caa85-a56f-481e-8e09-2cf5ae44811a","resolution":{"observed_at":"2026-08-07T11:06:47.430435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.416703Z","title":"Deep high-resolution representation learning for human pose es- timation","venue":null,"work_id":"b41f6125-9d0d-4b87-8cc2-75b1a523b6eb","year":2019},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.068187Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:d511de26b496979ff809a269580b30a068aa1cd3dde573b4ffee1cbe8bd47f5f","observation_id":"b0ded5d3-29e0-4163-a39b-445b97d494ea","resolution":{"observed_at":"2026-08-07T11:06:47.420216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.407412Z","title":"Uni- fied multi-modal unsupervised representation learning for skeleton-based action understanding","venue":null,"work_id":"2d2c1203-c7d8-4fe5-b299-97896c675f62","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.201037Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:97103e175011f131394824bcddfa843c99666fe4b6e42c4894ee9b89bab15e09","observation_id":"99b167f7-cbfc-4f3f-973c-406a5f24aa99","resolution":{"observed_at":"2026-08-07T11:06:47.410581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.397806Z","title":"Learning the predictability of the future","venue":null,"work_id":"7734b5c8-3d68-48f3-8994-449ae5fbe38f","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.293414Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:735becd30cfdebca6795973b31c6482e44494329df9134358c215ad57ddc95ab","observation_id":"ace27ef8-06e5-41bc-8f59-fbe95d02f206","resolution":{"observed_at":"2026-08-07T11:06:47.401143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.387093Z","title":"Skeleton-contrastive 3d action representation learn- ing","venue":null,"work_id":"9678af93-6797-4dbc-a4d5-ce7067ae742f","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.389407Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:d6965c257e9262cb16f67a08381922d35098cb0332f4d032b9aadc187d9478e5","observation_id":"a733d715-0de7-4e87-8806-143a93571bcb","resolution":{"observed_at":"2026-08-07T11:06:47.390751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.376533Z","title":"Modeling temporal dynamics and spatial configurations of actions using two- stream recurrent neural networks","venue":null,"work_id":"53964b41-3f9b-4cda-ae53-9e204b905cf3","year":2017},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.446928Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:2376273df69b0c365ce7a837f596e29427dcd70e2bfafb338f0eec0964a5cd56","observation_id":"a995ecac-09c8-4b8e-9d04-ac4449fa0963","resolution":{"observed_at":"2026-08-07T11:06:47.380041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.365696Z","title":"Beyond joints: Learning representations from primitive geometries for skeleton-based action recognition and detection.IEEE Transactions on Im- age Processing, 27(9):4382–4394, 2018","venue":null,"work_id":"fa136836-a253-4359-a02c-ac1a4ed67f1c","year":2018},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.642470Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:2ac6fde6f4b528c23abd734cd606340770547afa440916b5c2fd1dbfb107e408","observation_id":"71f8437e-6df5-4e33-93d3-8857f506bd0e","resolution":{"observed_at":"2026-08-07T11:06:47.369129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.354455Z","title":"Contrast-reconstruction representation learning for self-supervised skeleton-based action recognition.IEEE Transactions on Image Processing, 31:6224–6238, 2022","venue":null,"work_id":"d7a252c6-5f8b-4598-ad17-a9715dd36946","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.719169Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:1686f73403da1a5e40c14d6dfc5f0842166c6b5b39a49a2c65664facbca095a7","observation_id":"951cc43a-4ffe-49b7-8cb2-dba30f69b352","resolution":{"observed_at":"2026-08-07T11:06:47.358200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.344582Z","title":"Molo: Motion- augmented long-short contrastive learning for few-shot ac- tion recognition","venue":null,"work_id":"ae7727e0-460a-4712-bb2a-5f713320e186","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.764308Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:99a9522029a26e9d4c2eef0f53647bfcd945ab1ce5327705f355ad14313c08d7","observation_id":"2b373d72-0739-48fa-a54c-2bcb89b67e59","resolution":{"observed_at":"2026-08-07T11:06:47.348004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.334377Z","title":"Usdrl: Unified skeleton-based dense repre- sentation learning with multi-grained feature decorrelation","venue":null,"work_id":"33541407-6912-40be-9b1a-3c3cdcf862c4","year":2025},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:45.928064Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:a320d1df8dd218eae690e431e056db77df117514a2773abd3c35c44d75a21d09","observation_id":"46205731-868c-474e-8515-2df298284d56","resolution":{"observed_at":"2026-08-07T11:06:47.337892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:46.019890Z","title":"Scd- net: Spatiotemporal clues disentanglement network for self- supervised skeleton-based action recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.019890Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:e579077d3c6c7917294dfd7b18d466957c9ef9a0fc0960f0cf99e399235fb68c","observation_id":"e2398188-1697-4dde-a866-c74ca795c915","resolution":{"observed_at":"2026-08-07T11:06:46.019890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.317617Z","title":"Generative action description prompts for skeleton-based action recognition","venue":null,"work_id":"35823d40-d7d8-496e-857b-d4002cf32367","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.076183Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:3acad974504b9898233891cd3048fe6ebb2821b513c6b9def0773b0ecb4e808a","observation_id":"63ed8129-acfe-400f-bac5-a77e9d0f9742","resolution":{"observed_at":"2026-08-07T11:06:47.321118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.307063Z","title":"Unsupervised motion representation learning with capsule autoencoders.Advances in Neural Information Processing Systems, 34:3205–3217, 2021","venue":null,"work_id":"d560eabb-a693-4675-a912-990532ee5d00","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.230855Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:f87482591df1b8dc7276116387d63f1392215c308d408d35c3ba58ed124ddc4b","observation_id":"5299cc6a-43b0-4dd9-be6b-78d366c00acd","resolution":{"observed_at":"2026-08-07T11:06:47.310397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.296453Z","title":"Spatial tempo- ral graph convolutional networks for skeleton-based action recognition","venue":null,"work_id":"6a649012-87c9-4035-9eca-838ae357b226","year":2018},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.381430Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:df62a3b0e9833d7c088c2033c304d9ce8786653f1d5e9df5497127be1a97f10f","observation_id":"2408f2c1-3f29-4b07-9357-4ed5d3766102","resolution":{"observed_at":"2026-08-07T11:06:47.300464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.285962Z","title":"Skeleton cloud colorization for unsupervised 3d action representation learning","venue":null,"work_id":"6b244c27-b037-4671-883c-3bfeaff698ed","year":2021},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.432912Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:7e9002a66ad5311c2c8fec1ef3ebe6770185f02697e4f1513c5fa4c26fa366a7","observation_id":"1b6e84b0-1d5d-4a23-a263-edd61515adfc","resolution":{"observed_at":"2026-08-07T11:06:47.289840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.275166Z","title":"Contrastive positive mining for unsupervised 3d action representation learning","venue":null,"work_id":"51fbd7b4-00ee-486d-82db-7c652ada1ac7","year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.544762Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:62544cb7b594e3ccb3b14c99c1f3a6361182d8b98f3d29196786a2345e3798ab","observation_id":"4543e6f7-8363-44a3-b8a3-760326d0f442","resolution":{"observed_at":"2026-08-07T11:06:47.278457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.264733Z","title":"Hierarchi- cal consistent contrastive learning for skeleton-based action recognition with growing augmentations","venue":null,"work_id":"0f840686-9d4a-4a8a-8ba9-ecadd4ce6f3e","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.632010Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:b70490bb59affab2984b2543a2edf5034bf1796cb13de38f58799301a9ad3b92","observation_id":"89b392c2-5816-45f7-9450-753903264428","resolution":{"observed_at":"2026-08-07T11:06:47.268271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.254329Z","title":"Prompted con- trast with masked motion modeling: Towards versatile 3d ac- tion representation learning","venue":null,"work_id":"254b3713-dbe3-4076-ab2f-409e8e1f4428","year":null},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.774602Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:be5df9f32ade9a477f2006dbc971084c1071f2463aa9147c3d9f9b4fb2f4f41a","observation_id":"1d84fa41-3c90-4a89-adb1-5fb9d066fd7b","resolution":{"observed_at":"2026-08-07T11:06:47.258019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.244628Z","title":"Unsupervised representation learning with long-term dynamics for skeleton based action recognition","venue":null,"work_id":"0b633fb8-8e29-43d0-b8a8-f256f2eb1aa3","year":2018},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.837648Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:4b9d4d502df7ad2aee13c8576b0ea1b82a7bd28bcde0e7462a33034a02c66b61","observation_id":"fc5718cc-57e6-4fd2-890e-4c273c1daa68","resolution":{"observed_at":"2026-08-07T11:06:47.248112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09590","last_updated":"2023-03-21T17:34:34Z","snapshot_observed_at":"2026-07-06T14:19:51.472138Z","submitted_at":"2022-11-17T15:36:48Z","title":"Hypergraph Transformer for Skeleton-based Action Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09590","snapshot_observed_at":"2026-08-07T11:06:46.985861Z","title":"Hypergraph transformer for skeleton-based action recognition.arXiv preprint arXiv:2211.09590, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:46.985861Z"},"links":{"cited_paper":"/paper/2211.09590","citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:c0e7928f7000f6f6669ef49da7dd370b3ac5c19dca66e89c3ee123b0063b7a47","observation_id":"04387c97-3171-4d87-901d-7ecedea2c078","resolution":{"observed_at":"2026-08-07T11:06:46.985861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.235222Z","title":"Self-supervised action representation learning from partial spatio-temporal skeleton sequences","venue":null,"work_id":"2e614a4c-b374-47cb-8ccd-438b4427939f","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:47.052327Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:605a3f578a2e700557f0460a229b04b38b794360b633737f37a2b309ada501ce","observation_id":"6c791959-1f2c-4e6d-8762-57d5270638b8","resolution":{"observed_at":"2026-08-07T11:06:47.238694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.056362Z","title":"Blockgcn: Redefine topology aware- ness for skeleton-based action recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:47.056362Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:b8a31a39d15c40bf967c8eea8f955d3cbaa9c6bd589f731876418b73bd1cb13c","observation_id":"31725841-f1ee-4b3d-82a7-a2e832c18cf9","resolution":{"observed_at":"2026-08-07T11:06:47.056362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.219011Z","title":"Motionbert: A unified perspective on learning human motion representations","venue":null,"work_id":"c2e9d359-00d6-4c88-8a9f-717c876afabf","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:47.059646Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:bf0861e0941a79a664190535cc534cab706f733ab8fe9374c4e87c5440841f6e","observation_id":"3791d759-483e-463d-8f56-fef018816cf9","resolution":{"observed_at":"2026-08-07T11:06:47.222551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:47.207066Z","title":"Modeling the relative visual tempo for self-supervised skeleton-based action recognition","venue":null,"work_id":"9dbfca33-02a8-4b50-9635-5d6e983f4626","year":2023},"citing_paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:47.159731Z"},"links":{"citing_paper":"/paper/2506.03481"},"observation_digest":"sha256:835afb101865c905b85566db759c15a655908c82e9b86124227ca9195ea1d45d","observation_id":"220b9a2d-b3f0-45c8-ae3f-6f364644787e","resolution":{"observed_at":"2026-08-07T11:06:47.212139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03481","last_updated":"2025-06-04T01:39:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:59:40.985044Z","submitted_at":"2025-06-04T01:39:13Z","title":"Heterogeneous Skeleton-Based Action Representation Learning"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.03481."}