{"as_of":"2026-08-07T06:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:78093355cdf6e538f4491243b7598f10eacf29b7e08a46aae4599b9eedd9a2a5","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:20:59.194993Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T05:01:11.880003Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T05:02:19.709890Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"cited_work":{"arxiv_id":"2508.01984","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.01984","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imore: Implicit program-guided reasoning for human mo- tion q&a","venue":null,"work_id":"e6394555-272c-4943-9484-c84b8d06559f","year":2025},"citing_paper":{"arxiv_id":"2602.12370","last_updated":"2026-04-16T20:43:03Z","snapshot_observed_at":"2026-08-02T07:45:27.779427Z","submitted_at":"2026-02-12T20:02:21Z","title":"LLaMo: Scaling Pretrained Language Models for Unified Motion Understanding and Generation with Continuous Autoregressive Tokens","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T05:01:11.880003Z"},"links":{"cited_paper":"/paper/2508.01984","citing_paper":"/paper/2602.12370"},"observation_digest":"sha256:a671f836df4eeb1ca2b077d53145ceb6be36eb6fe882b04c7ebd46e638ed56cd","observation_id":"9ae9a26e-8879-45e0-87d1-4a257988a160","resolution":{"observed_at":"2026-05-16T05:02:19.712601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.01984/citation-record","integrity":"/paper/2508.01984/integrity","json":"/paper/2508.01984/citation-record.json","paper":"/paper/2508.01984"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.976651Z","title":"Neural module networks","venue":null,"work_id":"0c44a4a7-7716-424a-968f-1173d632b95c","year":2016},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:55.831055Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:76c5c92d0e4959591bea6d786a2d25e4f8fe9bf6faac926687af0f6c80155e8c","observation_id":"35fa7cd4-f471-4ac9-8803-5746b9c12849","resolution":{"observed_at":"2026-08-06T05:21:00.979323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.969015Z","title":"Dynamic motion representation for human action recogni- tion","venue":null,"work_id":"3fcf9da3-66fa-4131-ba40-2c90f51ec897","year":2020},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:55.863396Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:accf99187e32d687afc7ebcff32919913cb569b6173a4c4fcc6a399a2876ede5","observation_id":"835c8d78-c2ac-4c45-8492-b3202415fe9e","resolution":{"observed_at":"2026-08-06T05:21:00.971462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.962056Z","title":"Skelemotion: A new representation of skeleton joint sequences based on motion information for 3d action recognition","venue":null,"work_id":"25175fb4-93b1-4266-a3db-affd48f3598a","year":2019},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:55.943613Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:b20370dfae33982fc7da29ff7e2c6d6c44185520db30843970b0c9b38b233559","observation_id":"ea6a1750-0fab-4828-b4a7-5812f9a641fe","resolution":{"observed_at":"2026-08-06T05:21:00.964699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.954971Z","title":"Jolo-gcn: mining joint-centered light-weight information for skeleton-based action recognition","venue":null,"work_id":"1195665f-0caf-4738-8a86-d2d6082400ba","year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.013241Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:ff2747775796ae46f5e41949adbafe57f0441e9ffa59291674468e6bcc11dba1","observation_id":"2b33127f-6e82-48f8-b45e-69f6631ef074","resolution":{"observed_at":"2026-08-06T05:21:00.957509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.947732Z","title":"Meta module network for compositional visual reasoning","venue":null,"work_id":"16d0f699-62dc-4d61-bcdb-7f8ff44c1ba8","year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.082633Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:46c47fa3ac59e9a7c4951dc1be895cc85d09160d2fddf42c9664f26dced6e970","observation_id":"c8647c6c-7119-4bd6-931c-aa58a04bb2ec","resolution":{"observed_at":"2026-08-06T05:21:00.950211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.16564","last_updated":"2021-03-30T17:59:48Z","snapshot_observed_at":"2026-07-06T10:54:58.877342Z","submitted_at":"2021-03-30T17:59:48Z","title":"Grounding Physical Concepts of Objects and Events Through Dynamic Visual Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.16564","snapshot_observed_at":"2026-08-06T05:20:56.186749Z","title":"Grounding physical concepts of objects and events through dynamic visual reasoning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.186749Z"},"links":{"cited_paper":"/paper/2103.16564","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:27aac475e8c0be48ad3f8f88a263aa9b10f99fb12910554004c1cccc80e1917d","observation_id":"4117e27d-4fad-491d-8827-196b1735cecf","resolution":{"observed_at":"2026-08-06T05:20:56.186749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.940592Z","title":"Skeleton-based action recognition with shift graph convolutional network","venue":null,"work_id":"0a4faef0-be4f-4c21-83f5-df289fa476c2","year":2020},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.243690Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:bdb8c216bc9ab80d1459c8688e3bcc64d602eb70f8dd4d00b1cfbdb61e8a1b50","observation_id":"085852f1-e07e-46f8-8bf6-e82fb0a69fda","resolution":{"observed_at":"2026-08-06T05:21:00.943148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.932498Z","title":"Potion: Pose motion representation for action recognition","venue":null,"work_id":"b6bcac63-e70f-473f-9a7f-f35aae927e44","year":null},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.383383Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:767a61a99405d5f904affebd7809c82409b0f0e9c464d79a59260a68a2e0cb02","observation_id":"1f755de1-9ffa-47a3-b0ce-0cc17cd8c0ca","resolution":{"observed_at":"2026-08-06T05:21:00.935807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04793","last_updated":"2018-05-12T22:06:17Z","snapshot_observed_at":"2026-07-06T06:38:46.066644Z","submitted_at":"2018-05-12T22:06:17Z","title":"Coarse-to-Fine Decoding for Neural Semantic Parsing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04793","snapshot_observed_at":"2026-08-06T05:20:56.482901Z","title":"Coarse-to-fine decoding for neural semantic parsing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.482901Z"},"links":{"cited_paper":"/paper/1805.04793","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:7d6e71e1495689ff8eb9d7087fae7ce4fafc87ffe7877c8011a2af6b99431463","observation_id":"e35a651e-8833-4c08-8d7b-cc6097a574b4","resolution":{"observed_at":"2026-08-06T05:20:56.482901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.925056Z","title":"Revisiting skeleton-based action recognition","venue":null,"work_id":"6d64b133-029c-476c-a488-6483768edc42","year":2022},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.583090Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:aad2eb0a0f328520057bca8596008afa7616498268fd34c4f0cd68c826ea6e73","observation_id":"bdc69c85-8326-49e3-98d8-271306461b13","resolution":{"observed_at":"2026-08-06T05:21:00.927762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.917993Z","title":"Motion question answering via modular motion programs","venue":null,"work_id":"51e0370c-2be7-49d7-a244-1a1976075efe","year":2023},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.644770Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:d00af10cfdfe37e8c10c84d7db2f9f290b5365c93eb2c7e31728bacbdf48667e","observation_id":"90186931-f94d-428f-9f96-8f9f949fc624","resolution":{"observed_at":"2026-08-06T05:21:00.920646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.910544Z","title":"Skeleton- based action segmentation with multi-stage spatial-temporal graph convolutional neural networks","venue":null,"work_id":"4f36d093-c360-4128-9f04-ba7d099c88ee","year":2022},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.761657Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:5e223f6305ee8af10434b167ac8f8864410f865c0825df28730ebc420b5fc0cd","observation_id":"4aa949d9-2b55-4f4a-8fbb-eb0ebbb34b7f","resolution":{"observed_at":"2026-08-06T05:21:00.913155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.903103Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"c275c36f-69d4-488d-9be4-b15a480ed56c","year":2022},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.817074Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:31721d728a6d749508ff45407d39d49299f902727505acef4604f3a388b8ee03","observation_id":"b24ff83f-c2f8-45d9-b4e2-baa4eea18f01","resolution":{"observed_at":"2026-08-06T05:21:00.905818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.896184Z","title":"3d concept grounding on neural fields","venue":null,"work_id":"b9adfda3-363e-455a-84cf-8ceda282c41b","year":2022},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.909546Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:c857c34171087f5cee98e65788ce9173a340fc5f3cea96c509a970d7111bb840","observation_id":"87f19ab3-e528-40ab-81d2-85bd2f3413a2","resolution":{"observed_at":"2026-08-06T05:21:00.898646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.888887Z","title":"Ns3d: Neuro-symbolic grounding of 3d objects and relations","venue":null,"work_id":"2c1fd3c8-08a7-44cf-8e82-721b98963b66","year":2023},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:56.986956Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:7154bc7a9e265a68b3a24c281bd67df55255040b9998c54fc4ff980d50e2b268","observation_id":"ed0d912e-bc86-4d54-b17c-8d9062033bc8","resolution":{"observed_at":"2026-08-06T05:21:00.891486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03067","last_updated":"2018-04-24T10:25:07Z","snapshot_observed_at":"2026-07-06T06:27:14.996782Z","submitted_at":"2018-03-08T12:37:14Z","title":"Compositional Attention Networks for Machine Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03067","snapshot_observed_at":"2026-08-06T05:20:57.046796Z","title":"Compositional attention networks for machine reasoning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.046796Z"},"links":{"cited_paper":"/paper/1803.03067","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:8ac29c2c524dc95d6569c7c40e9f5aecda85c3963cb6aa41965484f03ea10068","observation_id":"7c66dd8a-dd46-49e2-a4c0-a7bbd48d9d75","resolution":{"observed_at":"2026-08-06T05:20:57.046796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.881509Z","title":"Learning to reason iteratively and parallelly for complex visual reasoning scenarios","venue":null,"work_id":"53aeefc6-8c07-49c0-a5b4-9c439d5720c8","year":2024},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.137261Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:6f1b0ffe48f5e4a22d6a588d96b1e9fb275d349b2960b8f529a834b438237322","observation_id":"1b6929a3-92bd-4d32-b7d8-062ed6108a57","resolution":{"observed_at":"2026-08-06T05:21:00.884158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.873084Z","title":"Clevr: A diagnostic dataset for compositional language and elementary visual reasoning","venue":null,"work_id":"a2102399-30d9-4f85-9bd2-641f3427df8e","year":null},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.240938Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:0abbea25b584750cf419a74152ef9075589327e4913393c823fba0a65aa53528","observation_id":"8e05f6f0-cf93-470c-9563-6514f5149cf0","resolution":{"observed_at":"2026-08-06T05:21:00.876660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.865803Z","title":"Self-supervised pre-training and contrastive representation learning for multiple-choice video qa","venue":null,"work_id":"19bc1975-2798-4742-a1be-8f3fa1ed0f3e","year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.315679Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:7eee77e7f8e79bf356df78fdea66e83c06ee73b1fb0e990c76c3e5aa844c8058","observation_id":"733e35bb-6bf7-4d54-a7c1-e7bbb84086ba","resolution":{"observed_at":"2026-08-06T05:21:00.868438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.858365Z","title":"Do rules still rule? comprehensive evaluation of a rule-based question generation system","venue":null,"work_id":"633ef8e9-984a-47db-b5c4-5b3fe9269940","year":2023},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.381818Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:a2350cb08ec04b62e6f9231eb9bf9a263d4133b66bce8a0deeb1c7eefc24cc5a","observation_id":"549b40a5-0e05-4e29-953f-63995c4ad1a2","resolution":{"observed_at":"2026-08-06T05:21:00.861150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.850606Z","title":"Blip: Bootstrapping language-image pre-training for unified vision- language understanding and generation","venue":null,"work_id":"fb0b0422-4d9f-4ca5-91b4-9a73e9b6a1e0","year":null},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.480959Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:c5375b14f45f2f3dcd8b41616d39884f402d3917c2e925519eea96aed491aff9","observation_id":"7d3eeba8-396a-4c13-bf05-6fd169cb90c8","resolution":{"observed_at":"2026-08-06T05:21:00.853208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.843525Z","title":"Vila: On pre-training for visual language models","venue":null,"work_id":"6ccc0f71-2961-4f6f-87f3-7bea059e1385","year":2024},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.577788Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:216fc86ff7dced5433711729f5df43bf0b117c981083d9fe64ce616e47ee9a39","observation_id":"0f6d8584-e80d-443c-a108-8406110d1435","resolution":{"observed_at":"2026-08-06T05:21:00.846065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.836003Z","title":"Pku-mmd: A large scale benchmark for skeleton-based human action understanding","venue":null,"work_id":"941b1f6d-f750-4054-b19e-82dc1d4cf1e8","year":2017},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.681482Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:9c4b319a35704ee8ccd879170987f2c789c1cc8024aa9e041af592b737a2e680","observation_id":"c52b6360-bad2-4534-8104-9884d9af5320","resolution":{"observed_at":"2026-08-06T05:21:00.838675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T05:20:57.819645Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.819645Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:a7f0dd0658bb867f458cf94402a9a9d6e9459b9ec2436b4ba866e1210f8acdbf","observation_id":"642dd513-75e5-4927-9d36-bdf661ecb19b","resolution":{"observed_at":"2026-08-06T05:20:57.819645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.828099Z","title":"Learning to answer questions from image using convolutional neural network","venue":null,"work_id":"7dff4730-196f-42d3-91c6-3ff2b32c5879","year":null},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.913282Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:7e1e5dccdf706a1d39452dfe0ffb4391d3026b6292dbb7da95851cd99e74aaec","observation_id":"52978656-1ff6-419e-b1b3-e8c59da4f88b","resolution":{"observed_at":"2026-08-06T05:21:00.831033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.820006Z","title":"Ask your neurons: A neural-based approach to answering ques- tions about images","venue":null,"work_id":"7e615ec6-cd06-4b7f-8040-dfa67873c140","year":2015},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:57.979377Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:44ca10ecbd62fc6dca9724fd4b67821ba678c9eb7c40f2268f1d17e8961f821f","observation_id":"029464e4-2e82-4e70-b4ce-67be1511e39e","resolution":{"observed_at":"2026-08-06T05:21:00.823427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12584","last_updated":"2019-04-26T06:50:54Z","snapshot_observed_at":"2026-08-06T17:51:03.744239Z","submitted_at":"2019-04-26T06:50:54Z","title":"The Neuro-Symbolic Concept Learner: Interpreting Scenes, Words, and Sentences From Natural Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12584","snapshot_observed_at":"2026-08-06T05:20:58.062565Z","title":"The neuro-symbolic concept learner: Interpreting scenes, words, and sentences from natural super- vision","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.062565Z"},"links":{"cited_paper":"/paper/1904.12584","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:5ad8d4a22a55c516cadae9eb971ddeefbdf82a48660c6cd7780faccb5ba7d947","observation_id":"bb53029e-7b51-4538-99b1-8bb69331a5d8","resolution":{"observed_at":"2026-08-06T05:20:58.062565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05832","last_updated":"2021-04-12T21:37:18Z","snapshot_observed_at":"2026-07-06T10:58:54.293300Z","submitted_at":"2021-04-12T21:37:18Z","title":"SpartQA: : A Textual Question Answering Benchmark for Spatial Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05832","snapshot_observed_at":"2026-08-06T05:20:58.127327Z","title":"Spartqa:: A textual question an- swering benchmark for spatial reasoning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.127327Z"},"links":{"cited_paper":"/paper/2104.05832","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:3a08d20c8b4ad66a56742168db5795cbf50f0e3a673842bc3ed6a82e685a02cf","observation_id":"021ce3e3-3e5c-4997-bdf4-1a6c61852732","resolution":{"observed_at":"2026-08-06T05:20:58.127327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:20:58.213798Z","title":"Neuro symbolic knowledge reasoning for procedural video question answer- ing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.213798Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:ef951d4bbd9cf0f2c08c84bc74a93baa3873caf82e3f5d3799370439cf923a2e","observation_id":"b0671c7c-b02d-43e1-96e3-f560184cf69e","resolution":{"observed_at":"2026-08-06T05:20:58.213798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.812331Z","title":"The kit motion-language dataset","venue":null,"work_id":"e0c667a1-6264-4aa2-a8c4-2acf62ad16ce","year":null},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.303832Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:61d5735c1bc2d72fff509009598a1a427aa6d382838dce6a71dd62692d6a3568","observation_id":"b18ef8dc-2a2d-49cc-854d-1da4174e84c5","resolution":{"observed_at":"2026-08-06T05:21:00.815347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.804199Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"ba3efe63-6fe5-4581-a647-2da5e1206279","year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.398232Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:09853fb1d08ff0ee7bb4999c17fccb6f9b2d600d9ef1ba2d955a3ae4ffc82435","observation_id":"f619ec86-6bb5-44b3-8b05-e5dd86840005","resolution":{"observed_at":"2026-08-06T05:21:00.806805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10719","last_updated":"2022-03-21T03:35:32Z","snapshot_observed_at":"2026-07-06T12:50:04.562634Z","submitted_at":"2022-03-21T03:35:32Z","title":"LocATe: End-to-end Localization of Actions in 3D with Transformers","version":1},"cited_work":{"arxiv_id":"2203.10719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.10719","snapshot_observed_at":"2026-08-06T05:20:59.760078Z","title":"LocATe: End-to-end Localization of Actions in 3D with Transformers","venue":"cs.CV","work_id":"2d04c186-fd18-428a-88cf-19746e50e658","year":2022},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.461555Z"},"links":{"cited_paper":"/paper/2203.10719","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:54bcd3624e7f29a6c0134d460d05085046b261f57be3e82a9c7f1a474da3a8e0","observation_id":"d6a17092-f75a-4b08-ad91-2dac929ec48c","resolution":{"observed_at":"2026-08-06T05:20:59.854388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.795847Z","title":"Motionclip: Exposing human motion gen- eration to clip space","venue":null,"work_id":"f10f2d2a-f389-4dfe-9067-d65a7343e721","year":2022},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.538527Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:0f660ab604bb1d9a9ddb755ef2132a2aa528049e7fbb6977b740861c35899e30","observation_id":"fcea484a-9387-4012-b913-daa39c45652d","resolution":{"observed_at":"2026-08-06T05:21:00.798655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.787056Z","title":"Spatial temporal graph convolutional networks for skeleton-based action recog- nition","venue":null,"work_id":"2b2ea569-8845-410d-bddb-bca62b4989bc","year":2018},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.597191Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:65570806ca1ed5850743fa3e7fa8adfbc7e918f363aece84bc73659cba6e8528","observation_id":"3839581b-3c97-4946-b663-595fa19268ed","resolution":{"observed_at":"2026-08-06T05:21:00.790090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.778787Z","title":"Efficient dense labelling of human activity sequences from wearables using fully convolutional networks","venue":null,"work_id":"afbec8aa-5cf7-447f-b736-ae1943d776ad","year":2018},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.682799Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:6455885f16451f7ada80c2b795719bd49f774f73af9e05f7b1383105589f80b9","observation_id":"c715564f-ed24-4015-9eda-adf41a1012a8","resolution":{"observed_at":"2026-08-06T05:21:00.781619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06378","last_updated":"2022-12-13T04:14:48Z","snapshot_observed_at":"2026-08-04T00:08:57.383561Z","submitted_at":"2021-04-13T17:32:51Z","title":"QA-GNN: Reasoning with Language Models and Knowledge Graphs for Question Answering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.06378","snapshot_observed_at":"2026-08-06T05:20:58.742242Z","title":"Qa-gnn: Reasoning with language models and knowledge graphs for question answering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.742242Z"},"links":{"cited_paper":"/paper/2104.06378","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:a0471ed22e580d2ff4d5aa93b2eebcc794cd52762d646f58ea853b24bfd3e850","observation_id":"38d551ea-78e8-4efc-b2e0-0b3e69621bbc","resolution":{"observed_at":"2026-08-06T05:20:58.742242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.770271Z","title":"Neural-symbolic vqa: Dis- entangling reasoning from vision and language understanding","venue":null,"work_id":"e6432cae-4ee9-4de4-9c9a-a21217cedf4d","year":2018},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.839686Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:b5c6545cfdefe58d22f11d46f921c1fa28978ed0ffa2ebe16c40f6a3fc069632","observation_id":"27a33d36-feea-4639-abf8-7d5d3a9f7879","resolution":{"observed_at":"2026-08-06T05:21:00.773033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.613900Z","title":"Exploring vision transformers for 3d human motion-language models with motion patches","venue":null,"work_id":"cca950ce-d4de-4565-971b-4a24842455d4","year":2024},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:58.926596Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:c281bdc94e0e8efd24af9abf98d81a3f0a7edb5bb2bc901200c1df9774af2cf3","observation_id":"aa2d19b8-eedb-4fd0-aaf2-7655df77bf2b","resolution":{"observed_at":"2026-08-06T05:21:00.692405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:21:00.481394Z","title":"Finemogen: Fine-grained spatio- temporal motion generation and editing","venue":null,"work_id":"92e6fdd6-07ef-49d8-8764-720cfea6781b","year":2023},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:59.008990Z"},"links":{"citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:62bf2d0f6c64f2c026c7a826f564b0b2c15c444b49a8ac8a1e5c408290f2d9f8","observation_id":"c08d7fd8-3bb5-4ff6-b86f-ab262482793d","resolution":{"observed_at":"2026-08-06T05:21:00.535365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-06T05:20:59.194993Z","title":"Video instruction tuning with synthetic data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:59.194993Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2508.01984"},"observation_digest":"sha256:14099ef071ce8987510262022a4e3d453c7fb2a5878fc1a9f1fdcf8bfd9573da","observation_id":"8afe1ff4-893c-4b1b-a864-e129ce931309","resolution":{"observed_at":"2026-08-06T05:20:59.194993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01984","last_updated":"2025-08-04T01:44:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T05:20:54.924397Z","submitted_at":"2025-08-04T01:44:41Z","title":"IMoRe: Implicit Program-Guided Reasoning for Human Motion Q&A"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2508.01984."}