{"as_of":"2026-08-08T02:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7228456f93c7193c45216e3f224a530a3339108f4afb98da20388533e0dd7afe","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:18:57.363534Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:55:19.283818Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16287","snapshot_observed_at":"2026-08-03T15:55:19.283818Z","title":"Beyond label semantics: Language-guided action anatomy for few-shot action recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.15153","last_updated":"2026-06-04T05:17:07Z","snapshot_observed_at":"2026-08-03T15:55:15.333984Z","submitted_at":"2025-12-17T07:35:03Z","title":"Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T15:55:19.283818Z"},"links":{"cited_paper":"/paper/2507.16287","citing_paper":"/paper/2512.15153"},"observation_digest":"sha256:b5aef21a7d8bb83b356424d116a4908d7b93d611c659de55ef1c9ccc98d87b75","observation_id":"976ffdc3-ba65-4fb0-bb24-acd73a8de30e","resolution":{"observed_at":"2026-08-03T15:55:19.283818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.16287/citation-record","integrity":"/paper/2507.16287/integrity","json":"/paper/2507.16287/citation-record.json","paper":"/paper/2507.16287"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:10.233536Z","title":"TARN: temporal attentive relation network for few-shot and zero-shot action recognition","venue":null,"work_id":"b0d92244-3163-473a-8706-7ccae50e8012","year":2019},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.335538Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:71bd60d5d1a7eb6f5aab544be7259b0603410721ab0b0d1f64b576635375466f","observation_id":"cba446e0-22fc-415f-b615-cd239a169fcd","resolution":{"observed_at":"2026-08-06T15:19:10.358557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:10.006404Z","title":"Task-adapter: Task-specific adap- tation of image models for few-shot action recognition","venue":null,"work_id":"50594525-ff9b-49d5-8c8f-7a9ca34a7b00","year":2024},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.434971Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:263f8581714666a9e1f458596f547a6acdab0a5d3911945cf2ef8c5cca0c4ae3","observation_id":"7bac5aa8-604d-4252-8142-623dbc5dba53","resolution":{"observed_at":"2026-08-06T15:19:10.109895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:09.737084Z","title":"Few-shot video classification via tem- poral alignment","venue":null,"work_id":"f7248166-b99e-40eb-b35f-88f9513baaa1","year":2020},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.546323Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:9c2ab9cd1ee7f05a4994adba01ed8e6843d00ff87e3358012e2f9e87dcfc9470","observation_id":"1ad44c11-b587-48cd-9ebc-1c65a939d90d","resolution":{"observed_at":"2026-08-06T15:19:09.841294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:09.541244Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":"33a1fb6c-487a-4ad8-b16d-f197bb139f85","year":2017},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.623585Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:c1b60d2f05e4d87e85019305f010cfd0422337358a1de7bbe52e79e689b346b4","observation_id":"29b71e2b-5e13-4c09-82a9-62998751ed4a","resolution":{"observed_at":"2026-08-06T15:19:09.628887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:50.800104Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.800104Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:8bb98c048dc9705a05b9193e230c0dd9523886b006b07a8be3cca38e936d6833","observation_id":"4b84d69b-72ea-4d30-9611-eb750c17dd1c","resolution":{"observed_at":"2026-08-06T15:18:50.800104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:09.272142Z","title":"Fergus, and P","venue":null,"work_id":"b2b13d43-1bcb-44bc-b949-4732158ecf84","year":2006},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.893105Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:97444898853a9acaf5e5706bca709fd75b4ecf48f1b009f3e5610981954ac1ab","observation_id":"5140c9b8-6cf8-45f3-b040-d5ed5166cbfa","resolution":{"observed_at":"2026-08-06T15:19:09.411851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:08.967658Z","title":"Depth guided adaptive meta-fusion network for few- shot video recognition","venue":null,"work_id":"c7cdde58-b0d9-4fda-8a90-132dfda5eb74","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:50.996664Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:5011f732612316dfd728b4925f3d79cde6167bcdaf06c6afe1be7c402cbe58e4","observation_id":"385fb114-9a1e-4363-b80a-fd31e954daec","resolution":{"observed_at":"2026-08-06T15:19:09.136705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:08.714552Z","title":"Fine- grained temporal contrastive learning for weakly-supervised temporal action localization","venue":null,"work_id":"061d427a-1819-48e5-9172-d7b68ee81f6d","year":2022},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.123652Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:b22e6f6798d6fdc2220c884218b7a8395016fb3148f1fc1d9471d954cdca5951","observation_id":"cfee785a-73a2-4016-bf10-e01e5411bb04","resolution":{"observed_at":"2026-08-06T15:19:08.852752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:08.452697Z","title":"The” something something” video database for learning and evaluating visual common sense","venue":null,"work_id":"a6e72ea9-b42e-46bc-b077-c4fa48457940","year":2017},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.246911Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:7ddd854b0d89779297fc135e504662e894caa5a91be187f604b3064ebdc784eb","observation_id":"99799444-d9d2-45d5-985d-64dc773adc1b","resolution":{"observed_at":"2026-08-06T15:19:08.558850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:08.218304Z","title":"Consistency prototype module and motion compensation for few-shot action recognition (clip-cpm2c)","venue":null,"work_id":"2f309c69-a904-48e0-81d2-f53ea4031ba5","year":2025},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.391513Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:864cd8e8d0025547c5d1e34f1f82bac811238629408ec7c38ac9f4cf13b2a1e9","observation_id":"88ae390a-e3ac-41d7-87cd-37dd48b95972","resolution":{"observed_at":"2026-08-06T15:19:08.346160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:07.936915Z","title":"Low-shot visual recognition by shrinking and hallucinating features","venue":null,"work_id":"e3f2f4bd-b513-4c55-9c90-b081946b21fd","year":2017},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.504369Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:c81a34553d1b7ae589234e54470c10951faad8b56a423aa1c2a11877ad2c715d","observation_id":"e6e0f579-b692-48c0-9e5d-d97ff19e400c","resolution":{"observed_at":"2026-08-06T15:19:08.042235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:51.635295Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.635295Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:13a3313765216360c6a5beffbc1db2cde8285ee8fea67daff1d5b8979e237eb5","observation_id":"ff7353da-904c-42a7-acc0-8671b3e2eccd","resolution":{"observed_at":"2026-08-06T15:18:51.635295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:07.629785Z","title":"Compound proto- type matching for few-shot action recognition","venue":null,"work_id":"003ec4a5-28ed-4a3e-b105-c94bf0a7b8b2","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.780432Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:2fa1662d1639d4a750f980c7f64439b61db5f74dbe61a42de7fd0830f4e88cfc","observation_id":"3bc6c4f3-18fc-4a8a-b326-b01c7face634","resolution":{"observed_at":"2026-08-06T15:19:07.772770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:07.399457Z","title":"Matching compound prototypes for few-shot action recognition","venue":null,"work_id":"3118a2ff-274b-4e0f-97d7-ca478a2b9043","year":2024},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:51.892186Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:459df417e221cba9df3e21e9eb5ecb651e0dc7736ff321ca2dda30e7db5fec1b","observation_id":"1a51a661-2215-42e0-9965-b09a640e1487","resolution":{"observed_at":"2026-08-06T15:19:07.508735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:07.144611Z","title":"Action genome: Actions as compositions of spatio- temporal scene graphs","venue":null,"work_id":"c9b4234f-0bc5-4346-b8e2-f054d395559e","year":2020},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.028919Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:eb8cf8d8bfe6c6c2d98ed4f4e3f1afe76fb5fbfaf7f19a857c0b0571126d81a2","observation_id":"214fb9fd-0172-49cb-b3bc-b2f00acb7337","resolution":{"observed_at":"2026-08-06T15:19:07.227622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T15:18:52.174139Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.174139Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:734852812d78a664eff3b664102f1e3087a7740a59103bac1ee741da506c3bf9","observation_id":"b7175e0e-3306-4c24-9dd3-ad8e87ab55d0","resolution":{"observed_at":"2026-08-06T15:18:52.174139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:06.845749Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"28f201e5-a4cb-4aee-a6f2-f452277b73ad","year":2011},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.271803Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:d5de577d246c15adcf61cbcbfa07878750da4b8bff724e52612b489db3752589","observation_id":"a96c14c5-d16c-4974-929c-cb769a4c6b96","resolution":{"observed_at":"2026-08-06T15:19:06.983278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:06.574153Z","title":"Trajectory-aligned space-time tokens for few-shot action recognition","venue":null,"work_id":"35eb0301-a825-4fcf-ae11-d7854d4243e4","year":2024},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.356018Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:27d81a77f5513d9cc5d15395cb17874b2ad5425084bb5b5dc0c491f0395a5443","observation_id":"3835ea3e-13ef-43c1-ab80-204e1b2cbf0d","resolution":{"observed_at":"2026-08-06T15:19:06.717710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:06.277860Z","title":"Temporal alignment-free video matching for few- shot action recognition","venue":null,"work_id":"03708fce-6a57-42bd-876a-0d230d7378cb","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.502013Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:e84881e52fe11605bbc21dabcc573be445a879332a20c9987908b469813e33eb","observation_id":"697414f1-7f80-4fd5-8ba4-d6397dc13828","resolution":{"observed_at":"2026-08-06T15:19:06.432274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:06.011603Z","title":"Frame order matters: A temporal sequence-aware model for few-shot action recognition","venue":null,"work_id":"798c10ff-e38d-4395-9a48-feb1a5fa4efe","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.635219Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:09a5674724467afb1ddaa602b2e8010fa8c41edff38826841f109ec8b5d1611b","observation_id":"76e19a55-b3ff-4235-a6ba-45abc363cecf","resolution":{"observed_at":"2026-08-06T15:19:06.115873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:05.822037Z","title":"Pastanet: Toward human activity knowledge en- gine","venue":null,"work_id":"deb96539-b464-4ba6-bbdb-1ca464affc7d","year":2020},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.769271Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:7b33d60e0ae83a92e9b7201e9a78b617ee2b253a3f24704d1563907079e00744","observation_id":"48f2664c-2d67-4ca9-85a5-531c5ede1291","resolution":{"observed_at":"2026-08-06T15:19:05.920290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:05.588188Z","title":"Bmn: Boundary-matching network for temporal action pro- posal generation","venue":null,"work_id":"0f4f0791-e919-4b7f-af04-5448d0b441f9","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:52.904093Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:0ddd79b9b125ecc0143df3e6e64d0beeac3f2be59cd41341fa3d0cf19a68a47e","observation_id":"9ca7afc3-4424-4e02-b65b-a6789431d36a","resolution":{"observed_at":"2026-08-06T15:19:05.710717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:05.373960Z","title":"Lite- mkd: A multi-modal knowledge distillation framework for lightweight few-shot action recognition","venue":null,"work_id":"cbeb0441-84c2-410c-b789-4b91d34b9555","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.025649Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:461f83727cf15b08fc3a510d04c0f5f3151b0eb5d47335590af2246792f2e159","observation_id":"7b276b48-6291-4bf7-a36f-a49362a91513","resolution":{"observed_at":"2026-08-06T15:19:05.482425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:05.078170Z","title":"Multidimensional prototype refactor enhanced network for few-shot action recognition","venue":null,"work_id":"6a3ff969-f0a2-4ed5-a2f2-90444150fdac","year":2022},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.129744Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:8dabc743e8fe8093c50e338860d6848ef77b36bf8d12fa775a6dad38e139012d","observation_id":"90afe8ed-a822-439c-aa22-85493d9845f2","resolution":{"observed_at":"2026-08-06T15:19:05.252391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-06T15:18:53.267812Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.267812Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:efbc8fe0017e5d22ad637223fee99a56657d6facd30dbee431173615fa0268d1","observation_id":"a6ff9581-9d2e-4319-ad8c-ae66154b1b74","resolution":{"observed_at":"2026-08-06T15:18:53.267812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:04.851166Z","title":"Multimodal prototype-enhanced network for few- shot action recognition","venue":null,"work_id":"efca39a1-ca39-455e-bc73-73616c1085d1","year":2024},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.377939Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:caf9da8da584c9c7e71b469112d1d140dd754185352c7fe30cd2aa49ac42c377","observation_id":"9f83eb00-ea7e-416b-8f6b-ba7d06185ae9","resolution":{"observed_at":"2026-08-06T15:19:04.961011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:04.662156Z","title":"Temporal-relational crosstransformers for few-shot action recognition","venue":null,"work_id":"3741c142-e2da-4a95-8a07-30fcb557d6cb","year":2021},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.484216Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:d301ac9df8dc4e52ec2b39bcccd9c30a141b736d3f72d6b65c01ab4c0a84a14f","observation_id":"9b28422b-caf8-42c0-ac44-1503415bec34","resolution":{"observed_at":"2026-08-06T15:19:04.751016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:04.467463Z","title":"Joint image-instance spatial-temporal attention for few-shot action recognition","venue":null,"work_id":"a28928c6-6d30-4344-8422-5141e7dea8a5","year":2025},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.640790Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:d6fc2aa38531ffdc0c344c00a6af24c3155b79fa83a27d38b3dd3addf0a870a6","observation_id":"41f958ee-076d-4240-bb0f-60b7aeeea8d1","resolution":{"observed_at":"2026-08-06T15:19:04.541510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02077","last_updated":"2025-03-05T13:43:07Z","snapshot_observed_at":"2026-07-06T18:09:21.647337Z","submitted_at":"2024-05-03T13:10:16Z","title":"MVP-Shot: Multi-Velocity Progressive-Alignment Framework for Few-Shot Action Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02077","snapshot_observed_at":"2026-08-06T15:18:53.782385Z","title":"Mvp-shot: Multi-velocity progressive-alignment framework for few-shot action recog- nition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.782385Z"},"links":{"cited_paper":"/paper/2405.02077","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:d0e1ae1c4a2a1a9e1d9bcea798c4ab84f3b329f1237afcec01654466fc49f326","observation_id":"6922987c-fa14-4737-b957-84a76fe850f2","resolution":{"observed_at":"2026-08-06T15:18:53.782385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:04.284299Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"457ad7b7-bb6a-407c-9e6b-78df743d742e","year":2021},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.875344Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:96f3bfac2375abb3c7cd9796adc3e1ae0b7d74e010992be2fbb8dd544d04fab9","observation_id":"b4cb2a4a-9a23-4905-923d-a862a2e46cb5","resolution":{"observed_at":"2026-08-06T15:19:04.361136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:53.962186Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:53.962186Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:4dd5a27ec8e435ccf71d811fefd7e7674360d6d95016aae64891d3e3efd075e4","observation_id":"9e41d713-cdf8-4a94-baa3-9688032f9e5f","resolution":{"observed_at":"2026-08-06T15:18:53.962186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:04.004024Z","title":"Home action genome: Cooperative compositional action understanding","venue":null,"work_id":"6b5798a6-b045-496c-bedf-5b066ea34a34","year":2021},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.087891Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:4cf47b6202f3cbfcfdf1977f0e833ae7f0cc49dd80a356060f0491ce17181647","observation_id":"0955aa44-5d18-4ad6-97da-3160bf26d181","resolution":{"observed_at":"2026-08-06T15:19:04.120983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:03.792696Z","title":"Temporally-weighted hierarchical clustering for unsupervised action segmentation","venue":null,"work_id":"995d696c-2fe0-4039-a7bc-75042ecdc87f","year":2021},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.197880Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:d9c826580aad26fc6f6c55c06aa29c8d5425ca7f6041eea4d0bced2b175fb71b","observation_id":"893cf76f-6467-43a6-b683-cae6f3b2f585","resolution":{"observed_at":"2026-08-06T15:19:03.901016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:03.556969Z","title":"Com- monsense knowledge prompting for few-shot action recog- nition in videos","venue":null,"work_id":"dd06ee55-eff3-4c6e-b407-808cc3ed3156","year":2024},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.290992Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:1329825e5557d7aede69187fcbd52736c31bbaf8ff701abcdf220f59db2d4e5b","observation_id":"ad9616b0-0a82-41b2-ae73-5b949bc42c41","resolution":{"observed_at":"2026-08-06T15:19:03.655487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:03.250222Z","title":"Prototypical networks for few-shot learning","venue":null,"work_id":"4d584cdb-1f3f-43e9-ac8d-e3b3b70bea94","year":2017},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.429948Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:210a94f360768a2f1d4a5797382e6fb1a638c542795c218b7863a041c147ea7a","observation_id":"4174eb07-2783-4ec4-840d-d5d9d8a92c77","resolution":{"observed_at":"2026-08-06T15:19:03.388482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-06T15:18:54.562797Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.562797Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:093fc24982e2d402e18a192455ce82cb98e08f833e43403ee6b33af51583e73b","observation_id":"8acc9467-d32e-46b2-acb2-a825d5cf0499","resolution":{"observed_at":"2026-08-06T15:18:54.562797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:03.025048Z","title":"Discriminative clip mining for video anomaly de- tection","venue":null,"work_id":"46709934-2ed2-4ab5-871f-f47e165e594f","year":2020},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.663669Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:1140e6500e816ed53ef0886cb7501fe520488714d02693e5c0aab2691ce7a6c5","observation_id":"a3d39ba2-b9cc-4102-afd9-c7547133009a","resolution":{"observed_at":"2026-08-06T15:19:03.147439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:02.709175Z","title":"Semantic- aware video representation for few-shot action recognition","venue":null,"work_id":"991394ae-ea7c-42ac-8a92-a93647a79895","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.814854Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:c19f434d65fd595aa81276d07764f02694fa51613cdb005203279714f0b47f39","observation_id":"3480d360-bc7e-4ecc-aca4-85a68488c492","resolution":{"observed_at":"2026-08-06T15:19:02.869141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:02.476377Z","title":"Spatio-temporal relation modeling for few-shot action recognition","venue":null,"work_id":"4a61bdb4-2eee-4e6f-9883-daf62f409d97","year":2022},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:54.916985Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:08fd928d7a5f74d6e1db69a850f86d2162a6bc9587004703bb2a0e8b9f9e4f82","observation_id":"d28e9ef8-bfc0-4e8a-9f80-16217dac386f","resolution":{"observed_at":"2026-08-06T15:19:02.578291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:02.226087Z","title":"Hybrid relation guided set matching for few-shot action recognition","venue":null,"work_id":"fcb18d1c-7f14-4d83-98ba-32b756352269","year":2022},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.060097Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:620ae3760b319a87db7ddbfdaf4ab25ecd6b76dfda7f6d89b6dcf6e4765104f2","observation_id":"bb313b0f-938a-49f5-9ab8-e5e403e264b5","resolution":{"observed_at":"2026-08-06T15:19:02.343428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:01.947321Z","title":"Task-aware dual-representation network for few-shot action recognition","venue":null,"work_id":"2047f9b1-be37-4130-b0ec-6d7171c10883","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.175860Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:59bd43f6aa2ef12e5e397643fb8dfda9459b7cf5c0724749b30ce71c669a62cf","observation_id":"95cd3ed8-9f15-442a-ae63-e36b8b06d2bc","resolution":{"observed_at":"2026-08-06T15:19:02.085292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:01.682859Z","title":"Clip-guided prototype modulating for few-shot action recognition","venue":null,"work_id":"b8d62087-6ed0-4382-bb26-97c684a007c9","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.273629Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:dcfc6f606faf65c29e8f1b3e2148602553715dd0c6f0190bd3edb19327e65a5a","observation_id":"5244a167-ecae-4050-98d9-379e8d91e25d","resolution":{"observed_at":"2026-08-06T15:19:01.835797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:01.379056Z","title":"Molo: Motion- augmented long-short contrastive learning for few-shot ac- tion recognition","venue":null,"work_id":"d9c93fa1-7e27-47ba-bda3-c75c149a538b","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.384754Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:e8b12afb4a348ec99b9a7872ace881b02f8628de690e2d684cf836eb57d08272","observation_id":"133b8295-6375-428c-83bf-a7421686c062","resolution":{"observed_at":"2026-08-06T15:19:01.549476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10125","last_updated":"2023-10-16T07:08:39Z","snapshot_observed_at":"2026-07-06T16:33:34.184498Z","submitted_at":"2023-10-16T07:08:39Z","title":"Few-shot Action Recognition with Captioning Foundation Models","version":1},"cited_work":{"arxiv_id":"2310.10125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.10125","snapshot_observed_at":"2026-08-06T15:18:57.963976Z","title":"Few-shot Action Recognition with Captioning Foundation Models","venue":"cs.CV","work_id":"c54afb9d-057e-47bb-ab25-f541068c20d8","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.510536Z"},"links":{"cited_paper":"/paper/2310.10125","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:859de160883ca848319fc5f52ed00e97cb2a76955ba26e007b948d11e704538e","observation_id":"77fe9feb-2e74-4388-baf9-1e89219330f0","resolution":{"observed_at":"2026-08-06T15:18:58.078089Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:01.092122Z","title":"Cross-modal contrastive learning network for few-shot ac- tion recognition","venue":null,"work_id":"c9df5b8c-a948-4534-b67c-f30d3b9d23ad","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.667957Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:6b20f2dbd1a92f828a1ef6cee44a1b58227bc2c22028623a224ff5775fc48940","observation_id":"27390eba-c95c-4258-9e2e-89040050e736","resolution":{"observed_at":"2026-08-06T15:19:01.228970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:00.907394Z","title":"Active exploration of multimodal comple- mentarity for few-shot action recognition","venue":null,"work_id":"00808cd3-de2f-4fb0-9b5b-177ae09e74e6","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.781375Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:36f19909214370ffc790b174f7916f1be1468a23cc5b504d976b406f97cbbd78","observation_id":"77982e03-1359-48fe-8b6a-f62e22022065","resolution":{"observed_at":"2026-08-06T15:19:01.015469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:00.656309Z","title":"Efficient few-shot action recognition via multi-level post-reasoning","venue":null,"work_id":"d691649b-4baa-4c9b-894d-d68b62033d4f","year":2025},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:55.881744Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:5273394faf4fa3db7ac40472c039a3d29de4478b5ff9c8c6e59f32173fb80774","observation_id":"c9dc2e32-e6bb-4747-bc6c-e119b942ff42","resolution":{"observed_at":"2026-08-06T15:19:00.741467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:00.363470Z","title":"Few-shot video classification via representation fusion 10 and promotion learning","venue":null,"work_id":"fb1142e7-3130-41a4-9d19-4f6c719c3391","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.032447Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:53d8ab39c7776650dbdaec34fa44bb00de92cca098eae8ff61e3ceec118064a7","observation_id":"9342fd42-2308-4591-aa93-34fb4d306d72","resolution":{"observed_at":"2026-08-06T15:19:00.488205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01532","last_updated":"2024-10-04T06:43:47Z","snapshot_observed_at":"2026-07-06T16:01:58.161047Z","submitted_at":"2023-08-03T04:17:25Z","title":"MA-FSAR: Multimodal Adaptation of CLIP for Few-Shot Action Recognition","version":2},"cited_work":{"arxiv_id":"2308.01532","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.01532","snapshot_observed_at":"2026-08-06T15:18:57.716221Z","title":"MA-FSAR: Multimodal Adaptation of CLIP for Few-Shot Action Recognition","venue":"cs.CV","work_id":"6e74275e-d875-4a02-b6f5-a9bae6accc54","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.160323Z"},"links":{"cited_paper":"/paper/2308.01532","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:de79de715230c4f10867e79d253fa9d480002d900cb66255bf70cf467bf7394e","observation_id":"222cf120-3570-4fd2-9f4b-7f9bf0df27bf","resolution":{"observed_at":"2026-08-06T15:18:57.835983Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:00.110419Z","title":"Boosting few-shot action recognition with graph- guided hybrid matching","venue":null,"work_id":"9e0431b6-a12c-4280-aa8e-bab7ae781bbe","year":2023},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.290096Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:13aaeedac6df4e94880cffb810d32205e1e416c3ec952f212a4cf3edfa65f38b","observation_id":"5e052322-346b-4fac-ba36-1a46afcf5238","resolution":{"observed_at":"2026-08-06T15:19:00.231451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:59.888951Z","title":"Ma-fsar: Multimodal adaptation of clip for few-shot action recognition","venue":null,"work_id":"d57b3ebe-2f0e-4aea-bf5b-20154303c087","year":2025},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.433133Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:1a9e4b22f830aa030b79243537b36967883d8cae07debc167657ca543a299df4","observation_id":"20ffd553-0532-4c6e-8052-98672407472c","resolution":{"observed_at":"2026-08-06T15:19:00.024993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04823","last_updated":"2021-05-11T07:18:57Z","snapshot_observed_at":"2026-07-06T11:08:14.161972Z","submitted_at":"2021-05-11T07:18:57Z","title":"Learning Implicit Temporal Alignment for Few-shot Video Classification","version":1},"cited_work":{"arxiv_id":"2105.04823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.04823","snapshot_observed_at":"2026-08-06T15:18:57.493286Z","title":"Learning Implicit Temporal Alignment for Few-shot Video Classification","venue":"cs.CV","work_id":"c62e549e-825f-4999-ac47-85e331c04484","year":2021},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.490301Z"},"links":{"cited_paper":"/paper/2105.04823","citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:7f819fcc6b899f962e2887de2847fb95be8508ca93ef12c84790b1e7fb3a4411","observation_id":"84c6305f-231a-49be-80c5-3fb33a778207","resolution":{"observed_at":"2026-08-06T15:18:57.592456Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:59.662792Z","title":"Temporal action detection with structured segment networks","venue":null,"work_id":"c9b452b8-7053-49ef-90e8-78613c7dbd0f","year":2017},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.587877Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:72e5dc69b517750f0133163f0f1d59854ab402cfeac83ec305c986d1dd46ef13","observation_id":"1dfd765d-3562-4b07-8926-d8bf348cba1c","resolution":{"observed_at":"2026-08-06T15:18:59.749860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:59.437030Z","title":"Few-shot action recognition with hierarchical matching and contrastive learn- ing","venue":null,"work_id":"b1e21b8a-ad4a-4155-b2a5-aaa6a18489fd","year":2022},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.764457Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:65ea45f0c06172a3e0b10d252dc3213513d3ef26ec74050ea3403c5c3cc50470","observation_id":"826fe8e4-827f-4883-845a-8f18d111431e","resolution":{"observed_at":"2026-08-06T15:18:59.528929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:59.223187Z","title":"Thinking inside uncertainty: Interest moment perception for diverse temporal grounding","venue":null,"work_id":"2252f0e7-f3b1-4045-b2b1-f210a2ef6e95","year":2022},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.855238Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:a64bf85d607997e2899a950cd58db4fbef7fa882c1e652acb28cdeaa1b3b3e9d","observation_id":"d89316c4-aa30-48c9-b65b-5d690d0b71c6","resolution":{"observed_at":"2026-08-06T15:18:59.311230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:58.973995Z","title":"Compound memory networks for few-shot video classification","venue":null,"work_id":"c5523450-3e56-45cb-81c8-d06210774633","year":2018},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:56.958066Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:c2a635c52437580eb09c4dab5fdb245bf8c805db6acc26919a628317ccc9757f","observation_id":"2ed3faa1-955a-4e80-96f9-5f978027853b","resolution":{"observed_at":"2026-08-06T15:18:59.097419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:58.703023Z","title":"Action La- bel","venue":null,"work_id":"72676deb-5843-4cf6-b38b-7246304b663c","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:57.112330Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:a6957eb183c43bab9678c2fe8df02db1c62a973f44890df224a9d0f32f7e24ca","observation_id":"114ad806-c170-4304-b2e5-60d9f0f20ffb","resolution":{"observed_at":"2026-08-06T15:18:58.859421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:58.512098Z","title":"Below is a sequence of images showing an action. What action is being performed?","venue":null,"work_id":"2f318e01-7da5-4441-8309-d4bbcf1cf600","year":2000},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:57.244062Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:effc9458d3b6709596897821f58b182e1a116369e589614f942624267f911677","observation_id":"62b99307-263d-4076-94cd-97c38d172bc7","resolution":{"observed_at":"2026-08-06T15:18:58.610547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:18:58.247055Z","title":"lowering the body","venue":null,"work_id":"469e3d01-3bc2-4843-9220-4c4aee9bd732","year":null},"citing_paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:18:57.363534Z"},"links":{"citing_paper":"/paper/2507.16287"},"observation_digest":"sha256:8e974cf41528c60740abf984a1d5b6761b722d4f3560d735d958895208fca432","observation_id":"b5bd78df-65ab-42f4-83c6-21c9968d2735","resolution":{"observed_at":"2026-08-06T15:18:58.363946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16287","last_updated":"2025-08-24T14:06:36Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T15:11:05.968019Z","submitted_at":"2025-07-22T07:16:25Z","title":"Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":49},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2507.16287."}