{"as_of":"2026-08-24T03:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5e41cdedb77160a89b0517017b13a0a4990b6c139bdf42dcd40195129240896","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:55:44.989050Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10765/citation-record","integrity":"/paper/2608.10765/integrity","json":"/paper/2608.10765/citation-record.json","paper":"/paper/2608.10765"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.658767Z","title":"Logic tensor networks","venue":null,"work_id":"fd41c028-0d5a-49e0-bd0e-e0637d876a6e","year":2022},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.819020Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:acbed6156113ae5a70d359d0521ea3057eb0b0f2ec97aed46a0f05a0fce47177","observation_id":"048b5b65-2f97-4fda-86cc-24ecfc273405","resolution":{"observed_at":"2026-08-12T17:55:45.664312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.640360Z","title":"Enhancing action recognition by leveraging the hierarchical structure of actions and textual context","venue":null,"work_id":"10f8e43b-0e17-4072-bde8-be33d786cf9a","year":2025},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.828603Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:dd62b7bc00a711dc69d3a4139017f6e16b77c4e112791fd0f2aec730b8940542","observation_id":"25acdc02-470a-4c14-a527-0d7c0cccdb10","resolution":{"observed_at":"2026-08-12T17:55:45.645971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01713","last_updated":"2025-05-03T06:33:54Z","snapshot_observed_at":"2026-08-18T09:04:10.490644Z","submitted_at":"2025-05-03T06:33:54Z","title":"Vision and Intention Boost Large Language Model in Long-Term Action Anticipation","version":1},"cited_work":{"arxiv_id":"2505.01713","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.01713","snapshot_observed_at":"2026-08-12T17:55:45.159103Z","title":"Vision and Intention Boost Large Language Model in Long-Term Action Anticipation","venue":"cs.CV","work_id":"264ca93a-487a-40c9-8d04-e23d0f608755","year":2025},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.834170Z"},"links":{"cited_paper":"/paper/2505.01713","citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:b483f7e6c3888884fbbd46b820a375d2b01a9b34f23577067b630fe52bce944b","observation_id":"c57a096f-e4b6-494f-b811-0b43be3e0627","resolution":{"observed_at":"2026-08-12T17:55:45.166090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.620804Z","title":null,"venue":null,"work_id":"03f26f4f-a77a-4504-9f16-dd4eafa16f38","year":null},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.841129Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:5eec6a0718bd1bfdac07e1253328c868c91cae5ace75acfaa009de327d3da310","observation_id":"2b3b312e-85c0-43d8-b0cc-d9653b358bc6","resolution":{"observed_at":"2026-08-12T17:55:45.626315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cvpr.2017.278","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.035517Z","title":"Procedu- ralgenerationofvideostotraindeepactionrecognitionnetworks,in: 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":"6d48ca82-3653-4a0f-8bac-0acc7b77582e","year":2017},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.855918Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:178240e316dc4ac2fc4b2d65d46b84ff7ac5c6a6ad9605141ec8702353db056f","observation_id":"c36b0bf5-7547-41e1-9e50-6973747c9d93","resolution":{"observed_at":"2026-08-12T17:55:45.049400Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.578681Z","title":"Datasheetsfordatasets","venue":null,"work_id":"3c6aecd5-07a2-467a-9757-3192a1950f63","year":2021},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.863270Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:45f6e3fb74ec7514ce3ee8bda9d0e0181bc01332ca52e8ba9766c00f9a79c769","observation_id":"6f0c3470-1d75-479f-801a-44387c452f0c","resolution":{"observed_at":"2026-08-12T17:55:45.584032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:44.868737Z","title":"What has been lost with synthetic evaluation? arXiv preprint arXiv:2505.22830","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.868737Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:64962b7606ea11c881c16f2c4c4208c127da624c4965bc8afb05fd7edd11b2e2","observation_id":"cf5fbbb3-b9df-427e-8d2b-83336d24af42","resolution":{"observed_at":"2026-08-12T17:55:44.868737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:44.876085Z","title":"Heterogeneous graph transformer, in: Proceedings of the web conference 2020, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.876085Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:c3106259223c8e2f8e9a753c6287a9844c08a3cddd6c7d91738724cc7b5d72d6","observation_id":"51936507-11f2-472a-b6c6-df8b5d1fc88a","resolution":{"observed_at":"2026-08-12T17:55:44.876085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.545318Z","title":"Cogs: A compositional generalization challenge based on semantic interpretation, in: Proceedings of the 2020conferenceonempiricalmethodsinnaturallanguageprocessing (emnlp), pp","venue":null,"work_id":"28319385-8be1-49c5-88bd-de1ee4980d9b","year":2020},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.882014Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:d6aacef1e14d973db772b87a8093c97837410a8edb16dd47885fad0e8e01f3fe","observation_id":"1e80ff31-bf5b-4827-8bf8-40a71591b33e","resolution":{"observed_at":"2026-08-12T17:55:45.551639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.524850Z","title":"C2c: Component-to-composition learning for zero- shot compositional action recognition, in: European Conference on Computer Vision, Springer","venue":null,"work_id":"2b65b1ff-6239-499b-9500-b48959e11c48","year":2024},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.888882Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:569c1068852d11f17533652662051ef774974ea5c9a01631c6b4666cecb88298","observation_id":"a56091b8-8f78-4770-8b46-f46e46a26f22","resolution":{"observed_at":"2026-08-12T17:55:45.531439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.495388Z","title":null,"venue":null,"work_id":"5a207955-4de0-49c1-857d-69a856bd6331","year":null},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.894109Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:ceb471187606b31f6fa91f4ee35b6107293cb5ad81a24a8bfc756e5f5f12eff9","observation_id":"d2c7cb33-181b-4aa7-897d-70d6aec7a0a5","resolution":{"observed_at":"2026-08-12T17:55:45.504377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.457429Z","title":"Fineaction: A fine-grained video dataset for temporal action localization","venue":null,"work_id":"8782555d-be18-41e7-9950-9ec7156aa795","year":2022},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.904279Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:35a79861d898153ca18565680fd7758137ed744ac0e812f6e213e80e9faefdb8","observation_id":"709fb47f-c0a9-46f6-924f-4a2889413159","resolution":{"observed_at":"2026-08-12T17:55:45.463109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.438327Z","title":"Intention-conditioned long- term human egocentric action anticipation, in: Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision, pp","venue":null,"work_id":"8932895b-5be0-4b5e-9944-cbbf0b17592b","year":2023},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.910169Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:cfe0fc50136d0532c9cab11305662fa8ff75213bfb53e91b54cfbe2057b528f9","observation_id":"20ee0575-d9ec-4243-a4b3-89b219a57bfe","resolution":{"observed_at":"2026-08-12T17:55:45.444956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.416535Z","title":"1049– 1059","venue":null,"work_id":"d513a1e5-9293-44fd-ac82-5def32603e4c","year":2020},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.916575Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:b164383f887747f9c0dc53750af614399f550fb4a0af18ce79a83064b831bb8a","observation_id":"e51cb3ef-e9ac-44a3-baa4-67e2c85ae553","resolution":{"observed_at":"2026-08-12T17:55:45.424323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.395065Z","title":"Gaze-guided graph neural network for action anticipation conditioned on intention, in: Proceedings of the 2024 Symposium on Eye Tracking Research and Applications, pp","venue":null,"work_id":"579736e4-5dbd-4e87-b22a-7a87e14b43bc","year":2024},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.924130Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:2cce0a61ce04d3f54db2fcff0d5a4937ad6dcfb5e16c551bbdac05b4185bf65a","observation_id":"d823cbe7-5bcb-4dfe-b22d-e71d72042c5a","resolution":{"observed_at":"2026-08-12T17:55:45.403010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.365843Z","title":"Ad- versarial generative grammars for human activity prediction, in: Eu- ropean Conference on Computer Vision, Springer","venue":null,"work_id":"700e24ee-05ff-44b2-b74a-9f090f782015","year":2020},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.931396Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:d6f6c73344d5d8d7e9de0c469ffb99dc564780522a9dfe50790d9ee88e533df4","observation_id":"86836c17-c2f9-4691-bb32-d177b69aa011","resolution":{"observed_at":"2026-08-12T17:55:45.372536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.344098Z","title":"Predicting human activities using stochastic grammar, in: Proceedings of the IEEE International Conference on Computer Vision, pp","venue":null,"work_id":"c58c59b0-f251-4777-9c5d-be4a9f67ca9b","year":2017},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.938553Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:62019c6bd98419efc75d137358f54b2939f5edfa936115541d717390a3aaeb9e","observation_id":"589744c7-f555-48ae-9bea-0d8d383cac2d","resolution":{"observed_at":"2026-08-12T17:55:45.352585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.317431Z","title":"Assembly101: A large-scale multi-view video datasetforunderstandingproceduralactivities,in:Proceedingsofthe IEEE/CVFConferenceonComputerVisionandPatternRecognition, pp","venue":null,"work_id":"616b0436-866e-4409-862e-f0b52c61f680","year":2022},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.944974Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:bd138647dbd6ae9a8d7a5bbe9ddb0605da91ceb9cf408fd4834ee8ac27d1a3d8","observation_id":"24e0d288-b7c3-453d-8033-8203d466e0e3","resolution":{"observed_at":"2026-08-12T17:55:45.326530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.296852Z","title":"Humanactivitiesasstochastickroneckergraphs, in:EuropeanConferenceonComputerVision,Springer.pp.130–143","venue":null,"work_id":"c05d3375-fc51-4cff-a09d-6dc715f66ae3","year":2012},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.950724Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:c8e55748192e4d792c2746b19eea8e1076019b635f7abaafdc884321ccd170d9","observation_id":"aeb1e38b-9377-4858-83e4-bbb21af5f596","resolution":{"observed_at":"2026-08-12T17:55:45.302847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.276612Z","title":"A semantic loss function for deep learning with symbolic knowledge, in: International conference on machine learning, PMLR","venue":null,"work_id":"df9c48c4-43ed-47f2-ab45-9bee1093d5eb","year":2018},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.957236Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:c2728bd62dff6585bbd2ccdb5ff761e976c35cd49a6967932ce893b694d55520","observation_id":"7854195f-5839-4528-80b5-124241425ecf","resolution":{"observed_at":"2026-08-12T17:55:45.282153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.256895Z","title":"Logicmp: A neuro-symbolic approach for encodingfirst-orderlogicconstraints,in:InternationalConferenceon Learning Representations, pp","venue":null,"work_id":"898e93e3-3755-4a6e-a877-40fc0ea3be9c","year":2024},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.964962Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:81db868250c59fcba34cf0295da4c1b15c2cd1d24c4857519a78f76df5b96255","observation_id":"d4dae1f0-b6aa-4369-908f-764dedbc7ca6","resolution":{"observed_at":"2026-08-12T17:55:45.262876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.237881Z","title":"Skelformer:Anadaptivehi- erarchical transformer-based approach on skeleton graphs for human action recognition in video sequences","venue":null,"work_id":"6950f971-595e-494f-a7f7-e021eaf578de","year":2026},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.971029Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:cb7b3e8991c19a224567ed7c104b0d427983e563ca7472ce50898c8b23dea855","observation_id":"3a5ecf8e-34a7-4dda-b740-b374b5bec8c5","resolution":{"observed_at":"2026-08-12T17:55:45.244190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.218386Z","title":"Zero-shot composi- tionalactionrecognitionwithneurallogicconstraints,in:Proceedings ofthe33rdACMInternationalConferenceonMultimedia,pp.3625– 3634","venue":null,"work_id":"3c12dbc6-3faa-40e6-9585-e7cf042fc33f","year":2025},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.976837Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:2f261388180c0b03d7a339670abe647a48e014fa06300e052747f283a36a8a0d","observation_id":"2cd5829d-5e96-423e-80ce-c49319f27a37","resolution":{"observed_at":"2026-08-12T17:55:45.224901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.197855Z","title":"Action anticipation with goal consis- tency, in: 2023 IEEE International Conference on Image Processing (ICIP), IEEE","venue":null,"work_id":"f1c9fe3f-b3b2-4d0a-967a-4cad30130188","year":2023},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.983000Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:f52b9e04d4c84e348c0d1a02abe83933701161dec3e1155eb735e50385faf9e3","observation_id":"9dfa9b34-7964-48a3-9060-676e287eeac1","resolution":{"observed_at":"2026-08-12T17:55:45.203082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.179575Z","title":null,"venue":null,"work_id":"d2eee87e-0076-4261-b9fe-00b5ab737a57","year":2025},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.989050Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:ae091e3149a081fee005c2d0ca78443d25a4a9106264c0ee218fe3382a9bb16a","observation_id":"9794bc85-4f0e-409e-9511-839251dc4e49","resolution":{"observed_at":"2026-08-12T17:55:45.185883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.475342Z","title":"IEEE transactions on pattern analysis and machine intelligence 42, 2684–2701","venue":null,"work_id":"de49c37c-fa5b-4bdc-83e7-559bc1feec08","year":null},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.898694Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:ec019c730ddb80c8ba847f719d5ee57c8634483a646b13e9409b9a6ef22fe812","observation_id":"da105146-6cdc-42d1-bcb4-fc86b49cc3ec","resolution":{"observed_at":"2026-08-12T17:55:45.480358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:55:45.598074Z","title":null,"venue":null,"work_id":"9951f9bf-fd77-4460-9699-136175723000","year":null},"citing_paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T17:55:44.848993Z"},"links":{"citing_paper":"/paper/2608.10765"},"observation_digest":"sha256:f8e3344091d4c661a344b5675b3613eaba2666a958bf492606674448092d3c37","observation_id":"731d8be4-42cb-44fb-b62d-ff9546ee4640","resolution":{"observed_at":"2026-08-12T17:55:45.604725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10765","last_updated":"2026-08-11T10:22:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T09:04:28.233652Z","submitted_at":"2026-08-11T10:22:22Z","title":"Compositional Benchmark Synthesis for Hierarchical Human Action Recognition"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.10765."}