{"as_of":"2026-08-22T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e134e8c616b121a2b407002c5fbaad9ffb82cc3ec825ebd8be318bcace04935","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:25:00.982697Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.09050/citation-record","integrity":"/paper/2412.09050/integrity","json":"/paper/2412.09050/citation-record.json","paper":"/paper/2412.09050"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.01313","last_updated":"2024-03-18T16:02:10Z","snapshot_observed_at":"2026-08-19T01:03:03.185064Z","submitted_at":"2023-08-02T17:57:25Z","title":"PerceptionCLIP: Visual Classification by Inferring and Conditioning on Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01313","snapshot_observed_at":"2026-08-11T17:25:00.787038Z","title":"K.; and Huang, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.787038Z"},"links":{"cited_paper":"/paper/2308.01313","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:f4c3bce6178ad638e2b00c2d66f40b4e435335238c46ae65a40f465d2ea466c8","observation_id":"0089061e-8949-4442-8135-d5441d5b0d6c","resolution":{"observed_at":"2026-08-11T17:25:00.787038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.591781Z","title":null,"venue":null,"work_id":"fcdbc73d-c1e0-4019-80ea-e375bba13e26","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.794337Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:b974ae30e48a4015b5404b3a6cdaaa7771a15318188b07234507ddbbd19b914d","observation_id":"c4f5a5df-0355-4041-a717-750b4f298c39","resolution":{"observed_at":"2026-08-11T17:25:01.596373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.578850Z","title":null,"venue":null,"work_id":"86f65d78-281e-40a5-8de4-ef65a0f59039","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.799070Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:c53b1e1c2428bc0abef6ae755929649504255688141941e375aab9d92c4a1109","observation_id":"b7f6db32-b281-4408-a4eb-74c18fe4a096","resolution":{"observed_at":"2026-08-11T17:25:01.583086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.564586Z","title":null,"venue":null,"work_id":"c7139b94-a702-49c8-8a2f-ea9a709419cb","year":2020},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.805247Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:e100c179cb5c3ba179acd7bec2fd85675c19abcb2d1b94d29ab57568d40bcbe9","observation_id":"5f128304-f865-47e2-8eff-b50807c4c9c1","resolution":{"observed_at":"2026-08-11T17:25:01.569189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.550508Z","title":null,"venue":null,"work_id":"41560f2e-3146-43b4-b182-e0537ed26a57","year":2018},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.811084Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:a7ae4b6a0ed00fafc4537ee4fb8ffc19aba76084c02ad950f63ceab2b9553414","observation_id":"70d3a051-94fb-4935-82e5-18d7ade856e7","resolution":{"observed_at":"2026-08-11T17:25:01.554804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.536116Z","title":null,"venue":null,"work_id":"2ac02cfa-bbd1-4c40-b1ca-9d08ae4a0b58","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.816546Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:098d7a7cae2fca9a7fc188edd267c70a9fbbe17f0928971e3fb790c6af684e70","observation_id":"1fb69c7d-57e1-4b7b-80ee-62b41b8ffc6d","resolution":{"observed_at":"2026-08-11T17:25:01.540798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.521788Z","title":null,"venue":null,"work_id":"56b59d18-9b88-45e3-b6e5-285a77a6b62b","year":2018},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.821486Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:4f99b7a2ff6e2f976755f1f1cc7588376913f97ff690e53563090d22c802018f","observation_id":"ac491ad2-4ce7-42a8-8f8a-84cc2877619e","resolution":{"observed_at":"2026-08-11T17:25:01.525733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07636","last_updated":"2022-12-05T13:53:51Z","snapshot_observed_at":"2026-08-16T16:16:16.267082Z","submitted_at":"2022-11-14T18:59:52Z","title":"EVA: Exploring the Limits of Masked Visual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07636","snapshot_observed_at":"2026-08-11T17:25:00.825314Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.825314Z"},"links":{"cited_paper":"/paper/2211.07636","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:1cb77bc4db9e0079e11fdea47ea8a9bc7d4fd9c00bc7c2d8887b9dc934404689","observation_id":"f544c997-bc01-4f8d-baf6-1c144b659adb","resolution":{"observed_at":"2026-08-11T17:25:00.825314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.509672Z","title":"Zhang, D","venue":null,"work_id":"d49a596b-16fd-4ee6-ab6e-7d30edcea165","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.834271Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:be84e17737c8d2fe7dfd4829aca5c77ec6ac27cf7db9ebaff8e854bcec7ffcdc","observation_id":"2055403f-5aac-4906-89ce-53ad83e6ead7","resolution":{"observed_at":"2026-08-11T17:25:01.513359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.496788Z","title":null,"venue":null,"work_id":"16068004-4e33-4ed9-9293-bbad9344e460","year":2020},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.840740Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:a4b7f9f127f0643a29f017ec1d5190c257bcd4512fa122bdecb74bec5fde3f60","observation_id":"0d10942e-b362-4dec-94b7-ecf32a662b0e","resolution":{"observed_at":"2026-08-11T17:25:01.501916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.483148Z","title":"(2018) Chen, G.; Yuliang, Z.; and Huang, J","venue":null,"work_id":"34791b44-fa09-4277-be9e-016c1ed5657f","year":2018},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.847873Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:49c4c8fc1e24e64197c09510e9c27788a0adb9ccf051264e18bd5a5299b010f3","observation_id":"636bb21e-412e-4ef1-9f3a-b366d9ca5c4b","resolution":{"observed_at":"2026-08-11T17:25:01.487503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04474","last_updated":"2015-05-17T23:21:35Z","snapshot_observed_at":"2026-08-19T22:00:06.074211Z","submitted_at":"2015-05-17T23:21:35Z","title":"Visual Semantic Role Labeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04474","snapshot_observed_at":"2026-08-11T17:25:00.853293Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.853293Z"},"links":{"cited_paper":"/paper/1505.04474","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:fe1232904a9990b382d5c4e40042e4c9e47e1a7296855ad8a620d73a46c2495b","observation_id":"77f8d9a5-ba90-4449-b133-d104ec940e1f","resolution":{"observed_at":"2026-08-11T17:25:00.853293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-15T03:05:41.956181Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-11T17:25:00.859408Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.859408Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:074e42eba0f30d4c927dd5f14c0c214fc713a2005c949d23b67b88d2682107c9","observation_id":"d7a87ad7-ac05-4c68-b615-c895e1a1342c","resolution":{"observed_at":"2026-08-11T17:25:00.859408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05676","last_updated":"2024-01-11T05:38:24Z","snapshot_observed_at":"2026-08-16T14:28:20.723930Z","submitted_at":"2024-01-11T05:38:24Z","title":"Exploring Self- and Cross-Triplet Correlations for Human-Object Interaction Detection","version":1},"cited_work":{"arxiv_id":"2401.05676","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.05676","snapshot_observed_at":"2026-08-11T17:25:01.095904Z","title":"Exploring Self- and Cross-Triplet Correlations for Human-Object Interaction Detection","venue":"cs.CV","work_id":"683f0998-2a31-4cff-959c-62f12ca81622","year":2024},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.864068Z"},"links":{"cited_paper":"/paper/2401.05676","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:69f9c138af068fc65314800e1520e762bbaf102f96f9a17b46d75301207a12e6","observation_id":"c7af0407-4f94-4d1c-9b9a-ba62a3336d3c","resolution":{"observed_at":"2026-08-11T17:25:01.101042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.469052Z","title":null,"venue":null,"work_id":"5e2bb12c-c145-4e32-ac21-37d63ddc4000","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.868666Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:0af2290fdc5537c201f69d510a2815723b3cf29901c567aeda0ff2695c3d494b","observation_id":"6e4e0ba8-17ec-41a0-9af6-4ff510e9f981","resolution":{"observed_at":"2026-08-11T17:25:01.473845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04997","last_updated":"2023-04-11T06:01:10Z","snapshot_observed_at":"2026-08-16T15:41:24.471891Z","submitted_at":"2023-04-11T06:01:10Z","title":"Relational Context Learning for Human-Object Interaction Detection","version":1},"cited_work":{"arxiv_id":"2304.04997","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.04997","snapshot_observed_at":"2026-08-11T17:25:01.072524Z","title":"Relational Context Learning for Human-Object Interaction Detection","venue":"cs.CV","work_id":"c45cb663-c7da-4516-baa4-bd9058721e09","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.873315Z"},"links":{"cited_paper":"/paper/2304.04997","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:66baa8ffec1f6b1378646b28efa569029e4aef6244938802471cc3c825e3fe43","observation_id":"39e12bbb-df4e-4beb-9448-d841d17c301f","resolution":{"observed_at":"2026-08-11T17:25:01.077692Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.449338Z","title":null,"venue":null,"work_id":"136b5bf1-70f5-4dea-bcb4-e00821a12e67","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.877535Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:9624a472321891f0a9f4c9677124c148c2d63a76c02e13b21f431c4440e0ea53","observation_id":"2205a7de-1370-4f1f-b298-9d64cc95c2fc","resolution":{"observed_at":"2026-08-11T17:25:01.455768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.430652Z","title":null,"venue":null,"work_id":"0a83e582-898b-4d29-a9f9-4131aefe7d62","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.881938Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:135cb30a8df5fc78a19bab46dcf41eb57dd5c6caf54da511035ba821977d00fb","observation_id":"c18c56a0-555c-49cd-be32-3a4517d656c3","resolution":{"observed_at":"2026-08-11T17:25:01.438234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.415762Z","title":null,"venue":null,"work_id":"665e4c5e-2f68-4cd4-babb-0cbe7161c2fd","year":2022},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.886007Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:27991b573f660e0ac8a93d358fa54abd5143fecb6e33cf20e179f8afbe5c6b3b","observation_id":"01442620-77ef-4bb4-8c83-0f6050fd271c","resolution":{"observed_at":"2026-08-11T17:25:01.420579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04019","last_updated":"2023-01-08T03:53:50Z","snapshot_observed_at":"2026-08-19T03:35:06.490250Z","submitted_at":"2023-01-08T03:53:50Z","title":"FGAHOI: Fine-Grained Anchors for Human-Object Interaction Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04019","snapshot_observed_at":"2026-08-11T17:25:00.890444Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.890444Z"},"links":{"cited_paper":"/paper/2301.04019","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:309f5690f2a371301dd22c1c63fd0b6bf26729b8788310e1262fa66ae8827af3","observation_id":"4ff32dbe-389d-48a9-8a68-97b065f65859","resolution":{"observed_at":"2026-08-11T17:25:00.890444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.403055Z","title":null,"venue":null,"work_id":"c9308fc6-ce5e-4916-aaad-3260513a807b","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.895209Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:cf8670f68b946f4000ca070cdab82f837ee9ae725192eb7cddf47fa6f4241b63","observation_id":"685b4914-68be-42ab-a961-113064e69c23","resolution":{"observed_at":"2026-08-11T17:25:01.407194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.382885Z","title":null,"venue":null,"work_id":"719373fe-0d9a-4826-a924-752eb1817370","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.900485Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:2e2f6827ef3a3cb4f386bb10cbebed737be8906304b9e8f80daa360f451f4420","observation_id":"12e7880a-fd2d-4590-b9ed-2bc48b032be9","resolution":{"observed_at":"2026-08-11T17:25:01.386961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.369800Z","title":"K.; and Kim, H","venue":null,"work_id":"e5dac51e-b985-4422-96eb-2855b48ad72b","year":2022},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.905282Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:b6afbf6e67b97be0506edd2806cd928915582ee0922eb309afd84374d0605987","observation_id":"5fbd6b51-32f6-47eb-86d6-b189cfcc023d","resolution":{"observed_at":"2026-08-11T17:25:01.374310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.357748Z","title":"(2023) Park, J.; Park, J.-W.; and Lee, J.-S","venue":null,"work_id":"fc4f1d41-ab74-4af4-81a5-c75d2e257c7c","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.909545Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:c49e4114d2af47068e9c89383d75d12562ba519c7d910b6ab237aac5862a1c36","observation_id":"49e33edc-5965-4f04-af8d-db3d59d902a4","resolution":{"observed_at":"2026-08-11T17:25:01.361918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.345719Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":"06d3429e-6bfb-411d-a796-10b0d47f1da6","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.914009Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:cc65525365c6a5c633d4e666291a9c91ecbba3ba5665050425114fc8ab6d3618","observation_id":"cd5457c0-984e-4a6a-8185-e1c3ac11b072","resolution":{"observed_at":"2026-08-11T17:25:01.350149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.332650Z","title":"D.; and Savarese, S","venue":null,"work_id":"c3aa191e-480c-4184-9e3d-826c2c7a267c","year":2019},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.918951Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:8a6f9bca99e25fe362f8f5e1a23deee9aafea1942f4a93efe72b9131b2a96673","observation_id":"bc54dd43-951e-47ef-a0a2-f8584d3c0a9a","resolution":{"observed_at":"2026-08-11T17:25:01.337329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-08-20T09:51:02.717471Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-11T17:25:00.923959Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.923959Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:901eda249981723c77b3f487a65674a62837ccba1cf82773001b0356d8db0340","observation_id":"62902a20-0f60-4cec-b377-2d6e728c1824","resolution":{"observed_at":"2026-08-11T17:25:00.923959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.317706Z","title":null,"venue":null,"work_id":"2027d2d0-adc7-4de7-8d51-789badde73ec","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.928333Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:72c022db9048c020162f61100a09018cdada99c362c10f3ede1c98a344b2c841","observation_id":"6cda081d-e229-40b4-a784-9e642bd944c7","resolution":{"observed_at":"2026-08-11T17:25:01.321942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.303191Z","title":null,"venue":null,"work_id":"1b5a7835-a52c-4db8-8fe1-b90c416a1469","year":2024},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.932627Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:5c30419d708d832bfe07c217a1cc69853dd7cf3a09c31093d700085d19295117","observation_id":"6eb79fda-4a5f-4e75-83e9-7fe2acaf2fc7","resolution":{"observed_at":"2026-08-11T17:25:01.308034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.288384Z","title":"M.; Khan, M","venue":null,"work_id":"c97070bf-a79c-40b2-af5b-4feeebb9484a","year":2019},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.936546Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:d629bedbf911582d6744caf464706a7f8aa98cbb8ad963e78fc9defe86b75e1a","observation_id":"f47c3100-4f89-4e7d-85c6-056c15c6c8c5","resolution":{"observed_at":"2026-08-11T17:25:01.292512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.275922Z","title":null,"venue":null,"work_id":"fa05c7f4-01f1-47aa-a264-c8ca7479924c","year":2018},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.940365Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:770fc66f3db38c4538c1d8432ad6df073f159c65e20ae9d94e74f33bb074acdf","observation_id":"ca747a98-9847-4d93-928d-dca165f54d45","resolution":{"observed_at":"2026-08-11T17:25:01.279939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.260943Z","title":null,"venue":null,"work_id":"21ea21ef-c5e2-4874-ab82-5ea7e1a9c1a0","year":2022},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.944876Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:6bc15b1f04737a524764e4dbd6556c1a7ca34ece5d8a91c3688b23b2efee9d08","observation_id":"d39bfa13-335c-4705-8586-0ae59fa57b57","resolution":{"observed_at":"2026-08-11T17:25:01.265743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.246405Z","title":null,"venue":null,"work_id":"deea5f16-8e0f-4666-9cd3-b2eb5763030b","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.948733Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:64904f2d1af367e2528b879d22e14aef29f5413482dc7acc4b0009f686902473","observation_id":"a1013311-e65a-437f-a331-5a3fa7319800","resolution":{"observed_at":"2026-08-11T17:25:01.251168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.231482Z","title":null,"venue":null,"work_id":"84b37beb-764c-4a8f-b7b2-86bcec9d999f","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.953011Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:c9acd61d2ac8223dfbf3eb66a74fc23d4c964262c05c9f824a9b3ddb9ea141dd","observation_id":"6b6b3f8c-b44d-4a17-ac4e-8b3440d5e1ad","resolution":{"observed_at":"2026-08-11T17:25:01.236261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01265","last_updated":"2023-09-03T20:20:48Z","snapshot_observed_at":"2026-08-16T15:03:39.300893Z","submitted_at":"2023-09-03T20:20:48Z","title":"SOAR: Scene-debiasing Open-set Action Recognition","version":1},"cited_work":{"arxiv_id":"2309.01265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.01265","snapshot_observed_at":"2026-08-11T17:25:01.021284Z","title":"SOAR: Scene-debiasing Open-set Action Recognition","venue":"cs.CV","work_id":"9bc2f096-9577-4554-a80c-d8c5ff267692","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.958955Z"},"links":{"cited_paper":"/paper/2309.01265","citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:4a371b5710af788a28272b05cdd1562e47de939b3d4b111b4650643755e8900b","observation_id":"f27fef14-ed9e-441a-b424-33d2d94e9bc2","resolution":{"observed_at":"2026-08-11T17:25:01.028092Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.217427Z","title":null,"venue":null,"work_id":"dbf7fd55-f710-4db7-98a6-95f7d1251e7f","year":2021},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.963533Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:7e205fc94e682361a3910f8443d77eaaa9c338f759fe57c568429926dc374523","observation_id":"c7e180d9-6e86-4292-b04e-9f70765a928f","resolution":{"observed_at":"2026-08-11T17:25:01.222177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.204311Z","title":"Z.; Yuan, Y.; Campbell, D.; Zhong, Z.; and Gould, S","venue":null,"work_id":"927dee55-3bda-41fd-99dd-299b87da27c9","year":2023},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.968369Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:c78c49dd6e9e287e95eacfa398d6e29d3595757f257ee7799a09d1e5393c6aec","observation_id":"6b6ffd65-7d87-49e0-bc2c-3ca72d799a1b","resolution":{"observed_at":"2026-08-11T17:25:01.208791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:01.187568Z","title":"(2022) Zhang, F","venue":null,"work_id":"1ff90d23-1521-4093-a24b-dc5e77eab7c2","year":2022},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.973547Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:1441c86777c1ef7feb602e602db9f03f3c849cb949aa74c86294b996f7eb8b20","observation_id":"73f527b0-5e3b-43cf-b1b1-6c808f76ffe6","resolution":{"observed_at":"2026-08-11T17:25:01.194479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:00.978387Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.978387Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:e0b6807a4964ddb2e034419248c505eb1fe9e37646541cbc4334c1a26fdc00f1","observation_id":"a82b0013-7868-4700-85de-5e214839e443","resolution":{"observed_at":"2026-08-11T17:25:00.978387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:25:00.982697Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T17:25:00.982697Z"},"links":{"citing_paper":"/paper/2412.09050"},"observation_digest":"sha256:62ce5b0e26329061534fa9dde7c58d653bad7483397ac903aa7269a3f8901c14","observation_id":"57716dfa-b02b-462e-bc10-e8c2475abd9b","resolution":{"observed_at":"2026-08-11T17:25:00.982697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09050","last_updated":"2024-12-12T08:21:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T20:44:22.119941Z","submitted_at":"2024-12-12T08:21:19Z","title":"ContextHOI: Spatial Context Learning for Human-Object Interaction Detection"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":3,"verified_fuzzy":9},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2412.09050."}