{"as_of":"2026-08-08T12:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0e2fa0d28e006170eb30b6014092acae8d07a377bb6ae864264f0c657b8cf94","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T23:48:44.328448Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:44:24.069899Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T08:04:28.908338Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"cited_work":{"arxiv_id":"2511.05611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.05611","snapshot_observed_at":"2026-07-24T02:22:56.042715Z","title":"Zhu et al","venue":null,"work_id":"b2ae2c22-5de0-4137-a199-0b178b6bfadd","year":2025},"citing_paper":{"arxiv_id":"2606.29230","last_updated":"2026-06-28T06:37:50Z","snapshot_observed_at":"2026-08-03T22:58:07.661779Z","submitted_at":"2026-06-28T06:37:50Z","title":"Again-Pose: Anchor-Guided Adaptive Inter-Frame Motion Cues Propagating for High-quality Human Pose Reconstruction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T07:44:24.069899Z"},"links":{"cited_paper":"/paper/2511.05611","citing_paper":"/paper/2606.29230"},"observation_digest":"sha256:3da8bb09c0ab2e063ceeaf14d9215b782a71934c823ac5b2564295bf678d1a17","observation_id":"7289f2d6-88e7-402e-ae1d-4a1d8d1ba9c5","resolution":{"observed_at":"2026-07-24T02:22:56.042715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.05611/citation-record","integrity":"/paper/2511.05611/integrity","json":"/paper/2511.05611/citation-record.json","paper":"/paper/2511.05611"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.048497Z","title":"Sportsmot: A large multi-object tracking dataset in multiple sports scenes,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.048497Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:d648ade94fa28c72ab073b61a9de3dd2f254b1ecfdde26ded15806f626e1b15d","observation_id":"9e0ea3c0-484c-4da4-8532-bb82cb35a248","resolution":{"observed_at":"2026-08-03T23:48:38.048497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.127909Z","title":"Multisports: A multi-person video dataset of spatio- temporally localized sports actions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.127909Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:cea3343ce0d0880ccf0eaf23ebc485422919a961e8628ded9c62e58292015880","observation_id":"89b9994d-db43-43bf-8330-960669190d3d","resolution":{"observed_at":"2026-08-03T23:48:38.127909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.191200Z","title":"Finegym: A hierarchical video dataset for fine- grained action understanding,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.191200Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:0b120c5e6524d20c8587979cd94e25d67e3179275bd79499ba5645b4f0205f01","observation_id":"2f2d0e4b-48fa-47b6-98e4-eb003227ee18","resolution":{"observed_at":"2026-08-03T23:48:38.191200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.287451Z","title":"Finediving: A fine-grained dataset for procedure- aware action quality assessment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.287451Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:4952bacf4fde06939f2d39a28353c7be0b6a8576bccaf5363b6edb6c97d33fbd","observation_id":"17d80826-f434-4af2-9231-ca20ec773623","resolution":{"observed_at":"2026-08-03T23:48:38.287451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.361485Z","title":"Uncertainty-aware score distribution learning for action quality assessment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.361485Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:21988484e9f43d3b7fa1ceed68751221551b88ae210738fe324d16c79f4d2c6a","observation_id":"48659428-359a-4e07-a039-0aaa88388d30","resolution":{"observed_at":"2026-08-03T23:48:38.361485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.431114Z","title":"Group-aware contrastive regression for action quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.431114Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:85680ac1229ba81a18cf32e14d9a8ee517d2d99c96fea02e01790a2d984e8eb5","observation_id":"6be79727-51f2-49fc-a25f-d50af90cbf98","resolution":{"observed_at":"2026-08-03T23:48:38.431114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.525601Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.525601Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:c6627940fe917f92c2e23d5817e6d97e83c8170d3b903376dbbd8ebf30915a26","observation_id":"2ba947a2-ed84-4820-9abf-8b9110a52cb8","resolution":{"observed_at":"2026-08-03T23:48:38.525601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.613453Z","title":"Online quality assessment of human movement from skeleton data,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.613453Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:dd242f9ae98c55c89825dd32744f15653a418dbec3dffbf65b7419b6bb8626f6","observation_id":"fa80a1f2-875d-45a1-9f74-370ae2c10739","resolution":{"observed_at":"2026-08-03T23:48:38.613453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.824089Z","title":"Visual and human-interpretable feedback for assisting physical activity,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.824089Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:fec1729eb3478472239a446cc0f3bef5cb0d5520447b3feb07c6538eba43f2cf","observation_id":"5f65d357-26e4-4bc0-91ee-6d3a37c297e8","resolution":{"observed_at":"2026-08-03T23:48:38.824089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:38.932578Z","title":"A video-based augmented reality system for human-in-the-loop muscle strength assessment of juvenile dermatomyosi- tis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:38.932578Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:9c9336a99809f9e328d8d2ebcb9fae69cd69d4fb38850697e96530e60201fce1","observation_id":"14898589-6fd9-43c3-b546-8857d65c4a28","resolution":{"observed_at":"2026-08-03T23:48:38.932578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.006237Z","title":"Who’s better? who’s best? pairwise deep ranking for skill determination,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.006237Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:c0fbf3178a5a952017f52f3c0dca6bb5d7f5424381d80152282733a8f978f385","observation_id":"46910a52-a870-4273-95b0-8734940c03c5","resolution":{"observed_at":"2026-08-03T23:48:39.006237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.068651Z","title":"The pros and cons: Rank-aware temporal attention for skill determination in long videos,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.068651Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:9aa1144d96254ce9512890be08309b02e4027e01ca520265bf4ea9808e965b9b","observation_id":"1280945e-0608-4392-b76f-b47d25f2a366","resolution":{"observed_at":"2026-08-03T23:48:39.068651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.128553Z","title":"Spatio-temporal adaptive network with bidirectional temporal difference for action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.128553Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:c9cf30e23548a7e0fc088fc30dd72ec64608d449ec74415c1b532c61c9eeb66c","observation_id":"49559630-4e96-4c20-a2a9-9604fce7f13f","resolution":{"observed_at":"2026-08-03T23:48:39.128553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.288637Z","title":"Agpn: Action granularity pyramid network for video action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.288637Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:b55ade22bed58fdff2aca63c500ad9988057b6dff966ef452722b5a0430743f5","observation_id":"c6770058-f6ab-4644-857b-2ce40b022547","resolution":{"observed_at":"2026-08-03T23:48:39.288637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.397148Z","title":"Question-aware global-local video understand- ing network for audio-visual question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.397148Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:d5371b5a93c1d670560a34e97303ac60e9297b0deecbe2499d16bdf5ea821060","observation_id":"cf6173b2-9ff8-4b39-b93c-06b6f76acfac","resolution":{"observed_at":"2026-08-03T23:48:39.397148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.449360Z","title":"Learning to score olympic events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.449360Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:a58077a601d5cf803849b1fc964f8cc93267bea0b812c1bcb606e89d4a29fef2","observation_id":"4f38f7cc-13f0-4bd4-8215-1915008ec481","resolution":{"observed_at":"2026-08-03T23:48:39.449360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.542818Z","title":"Learning to score figure skating sport videos,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.542818Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:6e4c74b66914155f3db90d15c8b5087aea9737e473757b792099b54742793d06","observation_id":"c1f28496-e16d-4576-bc1d-1453b580651c","resolution":{"observed_at":"2026-08-03T23:48:39.542818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.630036Z","title":"Attentive spatio-temporal representation learning for diving classification,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.630036Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:f9ca7a09fbac457eaa9df60dd5baa93ef9973b43c4a981c3b0c8c252e2f7fc9a","observation_id":"77fecffd-ab3d-4207-aceb-c6e4e17938b9","resolution":{"observed_at":"2026-08-03T23:48:39.630036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02841","last_updated":"2024-01-05T14:48:19Z","snapshot_observed_at":"2026-07-06T17:12:02.810275Z","submitted_at":"2024-01-05T14:48:19Z","title":"Multi-Stage Contrastive Regression for Action Quality Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02841","snapshot_observed_at":"2026-08-03T23:48:39.709133Z","title":"Multi-stage contrastive regression for action quality assessment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.709133Z"},"links":{"cited_paper":"/paper/2401.02841","citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:359d633d5527f636abc28f9dc60e87c7108f424089bf26d37468ed9d999dec18","observation_id":"a2bae062-ed25-4644-9326-1a8fe809b25f","resolution":{"observed_at":"2026-08-03T23:48:39.709133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.830226Z","title":"Fineparser: A fine-grained spatio-temporal action parser for human-centric action quality assessment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.830226Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:13dc9962da16273d759b482bd2e94632f5a99f5ba6fe19f6d35fed82e40c64fb","observation_id":"30af414f-2b09-41f3-b95e-41e7b8d32460","resolution":{"observed_at":"2026-08-03T23:48:39.830226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:39.924511Z","title":"Efficient spatio-temporal contrastive learning for skeleton-based 3d action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:39.924511Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:0918d9135949e97a86fafa56da4fde3e72e3069ac000eb889bee9fb677dcd72d","observation_id":"ab61d71b-7ef0-4740-95d1-4eb3d03bb2ba","resolution":{"observed_at":"2026-08-03T23:48:39.924511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.015926Z","title":"Glimpse and focus: Global and local-scale graph convolution network for skeleton-based action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.015926Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:910676028f79889c9d0273af359a93fc24419085f7320340eb38c62cc5594bdb","observation_id":"40755d3e-f246-425a-bec6-cbb35e7c4530","resolution":{"observed_at":"2026-08-03T23:48:40.015926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.132625Z","title":"Learning heterogeneous spatial-temporal context for skeleton-based action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.132625Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:754b0f6b59375c8e22cfe0dc30242e251b4424a4d7f7a4be9b38e580817cc570","observation_id":"4bcba255-a9e4-46f9-8c22-c34119ef3af9","resolution":{"observed_at":"2026-08-03T23:48:40.132625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.223696Z","title":"Assessing the quality of actions,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.223696Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:1d34a2e4f49aa061a27def0fc008b787ab73537713357f0a1bbb1ddde97b5233","observation_id":"1b5c170c-7920-4b91-ab98-d5cdc9b37baf","resolution":{"observed_at":"2026-08-03T23:48:40.223696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.279294Z","title":"Support vector regression,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.279294Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:8f12a8e4f56fca2c2cd78140b5e64f59a23f443c202fda028e06a14cadd1ca11","observation_id":"4dec9edd-2145-4df9-bdff-7052809e9aec","resolution":{"observed_at":"2026-08-03T23:48:40.279294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.356161Z","title":"What and how well you performed? a multitask learning approach to action quality assessment,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.356161Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:520c6a298798a2c797f9b44d51e154ed9b4a17d5a958a033af9e1ca8b11da2a8","observation_id":"679be7d3-0d0a-4594-bf0c-1562ed374526","resolution":{"observed_at":"2026-08-03T23:48:40.356161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.371574Z","title":"Hierarchical graph convolutional networks for action quality assessment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.371574Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:81eb9c62f5162d4f3638bb5adbdea65ff5d7d00e99a09d9c23dfe6291cf7e8e6","observation_id":"baa0fb18-4202-4b2f-a336-738e21b2d3ca","resolution":{"observed_at":"2026-08-03T23:48:40.371574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.530247Z","title":"Hybrid dynamic-static context-aware attention network for action assessment in long videos,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.530247Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:910ad495fdb66cdd80d354a8753d007ca8e08f7797b48a01e24c171703d3f940","observation_id":"12dbc821-abd3-40ae-83bb-618b60e4516d","resolution":{"observed_at":"2026-08-03T23:48:40.530247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.724880Z","title":"Fine-grained temporal contrastive learning for weakly-supervised temporal action localization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.724880Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:f24fddb449d32c2d9ad6b4cdcc8a42a8c7af65baabc18900373e3a315700db02","observation_id":"c37a65d3-6e1b-4935-beb6-f11094f0334e","resolution":{"observed_at":"2026-08-03T23:48:40.724880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.11107","last_updated":"2022-10-20T10:30:59Z","snapshot_observed_at":"2026-08-03T22:19:37.683430Z","submitted_at":"2021-05-24T06:06:32Z","title":"FineAction: A Fine-Grained Video Dataset for Temporal Action Localization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.11107","snapshot_observed_at":"2026-08-03T23:48:40.796906Z","title":"Fineaction: A fine-grained video dataset for temporal action localization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.796906Z"},"links":{"cited_paper":"/paper/2105.11107","citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:b05dd3ab38d5e935104942ccc5ed2a66ff625e016cabbb098a7ecd8ba3b6dd0f","observation_id":"4877fea4-ddd2-4831-944a-5aabebace2e3","resolution":{"observed_at":"2026-08-03T23:48:40.796906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:40.849984Z","title":"Fine-grained activity recognition in baseball videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.849984Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:e6f0a5e898989ded558378ff61926713cac158032afd45d57bc5255ff6d70248","observation_id":"556faa05-bdbb-494b-bd9f-b2e95e80c72d","resolution":{"observed_at":"2026-08-03T23:48:40.849984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-03T23:48:40.966113Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:40.966113Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:f7c825fa7bf39f29020e5a91cb5147863e9c539f4518fe66a7722ad0b6138e2c","observation_id":"9a3b178a-b543-4d13-84f9-d6264b60785c","resolution":{"observed_at":"2026-08-03T23:48:40.966113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.06866","last_updated":"2020-07-14T07:20:14Z","snapshot_observed_at":"2026-07-06T09:38:00.030095Z","submitted_at":"2020-07-14T07:20:14Z","title":"Alleviating Over-segmentation Errors by Detecting Action Boundaries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.06866","snapshot_observed_at":"2026-08-03T23:48:41.162079Z","title":"Alleviating over-segmentation errors by detecting action boundaries,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:41.162079Z"},"links":{"cited_paper":"/paper/2007.06866","citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:e54310cdc4a711040a1552243dcbd1f01d3fb49e50f378b398ed686caad4e6e0","observation_id":"6f5c7f62-73e8-4bb2-bcaf-2c574e29b4fb","resolution":{"observed_at":"2026-08-03T23:48:41.162079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:41.330843Z","title":"Learning and fusion of multiple hidden sub-phases for action quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:41.330843Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:3aa3c42584c534ffa21f5718e104990eea08d8d6d0ef93714fbc5359dd13e465","observation_id":"f55f16f9-97cc-4033-a323-e4294f93ead5","resolution":{"observed_at":"2026-08-03T23:48:41.330843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:41.507370Z","title":"Ms-tcn++: Multi-stage temporal convolutional network for action segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:41.507370Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:195abb713a6650ae5f174ae5a3cdde112591484d88eadde3276e3ea0930be802","observation_id":"32880c9e-2f46-496f-a884-82b81eefa9d9","resolution":{"observed_at":"2026-08-03T23:48:41.507370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:41.687461Z","title":"Mtdan: A lightweight multi-scale temporal difference attention networks for automated video depression detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:41.687461Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:b62be278b00290d314ed04b8f39e7b37db0cafe220df7eff1645c609f2e07434","observation_id":"db594dea-4e43-4b22-b4a6-878ba93c77be","resolution":{"observed_at":"2026-08-03T23:48:41.687461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:41.825300Z","title":"Bidirectional temporal and frame-segment attention for sparse action segmentation of figure skating,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:41.825300Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:3d43e28861d437c79fb1985cad5145aa3eb1405a6e9ff20e6b624802d78e2fcc","observation_id":"18d600ad-22c7-434e-a5f7-40b6157b6320","resolution":{"observed_at":"2026-08-03T23:48:41.825300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:41.918614Z","title":"On space-time interest points,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:41.918614Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:c232d8a28761a063ee7bdc3bde55e8286fb3b07a1734b85b2da411916e0f3bdf","observation_id":"35dba519-caa7-4e43-b89f-2de7e7da4055","resolution":{"observed_at":"2026-08-03T23:48:41.918614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:42.065925Z","title":"Dense trajectories and motion boundary descriptors for action recognition,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:42.065925Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:bdb91417bb063b7ea699c0974ee86a4e25711dfbce5ad42d513b856d060ba66c","observation_id":"4354fc3e-3375-4f3c-8e1b-be7184f9d8e7","resolution":{"observed_at":"2026-08-03T23:48:42.065925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:42.313886Z","title":"Action recognition with improved trajectories,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:42.313886Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:0f09d02c0e50690101273c5f5b69ecb5b7358d1d6b0b2d57fb851f537b68e0b8","observation_id":"e130e983-aea7-46b7-9c82-04bf40aaffb5","resolution":{"observed_at":"2026-08-03T23:48:42.313886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:42.558949Z","title":"Beyond short snippets: Deep networks for video classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:42.558949Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:bf4d8d89504b9c6927ae6efbb31eb3bf9630a813a6715b9d13e590778b703b01","observation_id":"fe9d3cf4-095a-4dd3-8fb6-f7433d9cf3c2","resolution":{"observed_at":"2026-08-03T23:48:42.558949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:42.721053Z","title":"Unsupervised learning of video representations using lstms,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:42.721053Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:7adf6144c45b053e9f976c21531b9f8082837b04ea2d73a6d1ea6bba112d9693","observation_id":"ad9fdef6-c51a-4ebc-a25e-6ffa4abe8c1c","resolution":{"observed_at":"2026-08-03T23:48:42.721053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:42.862186Z","title":"Long-term temporal convolutions for action recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:42.862186Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:b15ff53db3184144dd21c67c0790c89c13cad5d8c99b5465ecb8ec6db4dd1ee2","observation_id":"8cf9f985-b343-4f2c-8bb9-bee5f2bd5baf","resolution":{"observed_at":"2026-08-03T23:48:42.862186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:42.994886Z","title":"Action assessment by joint relation graphs,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:42.994886Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:36238163e908f2b2b649a02c08a0aa58fd30b3b3973140f16789c0441ff39236","observation_id":"4db22d5f-9141-471b-8931-4d25f264ce74","resolution":{"observed_at":"2026-08-03T23:48:42.994886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:43.181616Z","title":"Temporal segment networks: Towards good practices for deep action recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:43.181616Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:be2f21ce6de779452d362d03a6f5bded6e1e16e4aeb2ff4bf75be40dd174a2d7","observation_id":"d8700d5c-5d58-4a20-b4f4-6ed45a6875ee","resolution":{"observed_at":"2026-08-03T23:48:43.181616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:43.308045Z","title":"Timemil: Advancing multivariate time series classification via a time-aware multiple instance learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:43.308045Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:d0e1824c4fe1d978b4b7edb883f8d7a670d0a0661457f04a00327d081a5d1ca6","observation_id":"8b94d8e9-e2c4-4cc8-b5b8-68007d2fb4a6","resolution":{"observed_at":"2026-08-03T23:48:43.308045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:43.369873Z","title":"Likert scoring with grade decoupling for long-term action assessment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:43.369873Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:72678fa83d2ebc8f5058196fe3a9c131b1de421aae402f5b9772f703751063a2","observation_id":"09a0e7ef-99bc-4e0b-aa98-6c34045990da","resolution":{"observed_at":"2026-08-03T23:48:43.369873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:43.500472Z","title":"Pairwise contrastive learning network for action quality assessment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:43.500472Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:3d86ae0a80835ac3a1a3147100fee450c91427cf5dd3d229a91c617e57572c9b","observation_id":"a89d0bcd-00eb-4029-9a85-64a11fdba215","resolution":{"observed_at":"2026-08-03T23:48:43.500472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:43.637099Z","title":"Auto-encoding score distribution regression for action quality assessment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:43.637099Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:53b5b864ae6d4070dbea100cf5a5adf0e75576e986f6dca37baeec61f5ff5cbc","observation_id":"0a783a24-4535-4aac-bd78-d8fe4b5d2ec8","resolution":{"observed_at":"2026-08-03T23:48:43.637099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:43.835909Z","title":"Cofinal: Enhancing action quality assessment with coarse-to-fine instruction alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:43.835909Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:87a797f43abf268c0f5f9dc906cef3abc2ca7d83d74808a1df03b7521a5d0846","observation_id":"9fd8b83e-dd22-40ce-94f2-1546f93115be","resolution":{"observed_at":"2026-08-03T23:48:43.835909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:44.048865Z","title":"Asformer: Transformer for action segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:44.048865Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:039b92a3205390401e4ca9d9a4df74e06c868e81c432e810bfbf49d13ee0d274","observation_id":"fa9c9ec7-ae4f-4936-bdb6-2df27973b460","resolution":{"observed_at":"2026-08-03T23:48:44.048865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:48:44.220123Z","title":"Hierarchical neurosymbolic approach for comprehensive and explainable action quality assessment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:44.220123Z"},"links":{"citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:374097a31358badc4bc5995ebc1198e22ff09226c558bab8406da50177b059f3","observation_id":"f4b6b71d-c4eb-4e73-9faa-eaef5a719ea4","resolution":{"observed_at":"2026-08-03T23:48:44.220123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.02410","last_updated":"2015-02-09T09:56:57Z","snapshot_observed_at":"2026-07-06T04:08:35.216545Z","submitted_at":"2015-02-09T09:56:57Z","title":"Out-of-sample generalizations for supervised manifold learning for classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.02410","snapshot_observed_at":"2026-08-03T23:48:44.328448Z","title":"Incorporating nesterov momentum into adam,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T23:48:44.328448Z"},"links":{"cited_paper":"/paper/1502.02410","citing_paper":"/paper/2511.05611"},"observation_digest":"sha256:3e859f91a48d0874fae132670aee9c082af02f875d4ee84baa15073899352e00","observation_id":"187a38a0-1e47-4e45-a7bf-eaca070fa06e","resolution":{"observed_at":"2026-08-03T23:48:44.328448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.05611","last_updated":"2026-07-23T08:14:55Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T15:58:58.187014Z","submitted_at":"2025-11-06T13:00:22Z","title":"Focus on What Matters: Constraining Spatial-Temporal Attention via Action-Units for Noise-Resilient AQA"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2511.05611."}