{"as_of":"2026-08-20T09:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:944b449aa55faffb2b5727b038bb7b9263c2f8ac40dc206fd77a13f514d1d4c0","coverage":[{"denominator":85,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":85,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:06:30.680985Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06510/citation-record","integrity":"/paper/2507.06510/integrity","json":"/paper/2507.06510/citation-record.json","paper":"/paper/2507.06510"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.515732Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.515732Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:f5b74c1c676d81aa9d768aa324a2b099fedad8a15aaefdeb2d4079c8d263330e","observation_id":"ea9d75de-5aae-46fe-aeb0-8c3ed4469ebd","resolution":{"observed_at":"2026-08-06T19:06:30.515732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.518313Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.518313Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:525874498cc92ed13941b1ae24ac10b826706d7ca25a14e831477bff0ad625ca","observation_id":"0e689754-7b55-4a5b-8909-1b6e0b96b834","resolution":{"observed_at":"2026-08-06T19:06:30.518313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.520560Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.520560Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ad2d2eb578fef77d140f6edb8a43ac76ec6f560d6e21d588ade7dc98278b6edd","observation_id":"ad75ca5f-159b-458f-8c51-e2ffc3d749b5","resolution":{"observed_at":"2026-08-06T19:06:30.520560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.522748Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.522748Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7a3bc50ed384ec400a8a5f561d4157f493c5dd5cae9adf896974473a284b3a12","observation_id":"5792a0e1-95ec-4a64-b3ac-9c4a9f78a338","resolution":{"observed_at":"2026-08-06T19:06:30.522748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.525533Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.525533Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3bb24f6e2e3e55fc09b83f6fcddaee53198f726a6e05fa893979bb0b1df2f6be","observation_id":"6ae4b3e2-1047-4b7a-af32-6ae0c8d96924","resolution":{"observed_at":"2026-08-06T19:06:30.525533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.179633Z","title":null,"venue":null,"work_id":"8144fefc-4d0b-4227-945f-710cba9fea6f","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.527589Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:df552d70daa568cb9d054785c389b603b9c7007d531e4e566c9ff17bffe232fc","observation_id":"cce1f801-e704-404a-a428-21c9100d1c47","resolution":{"observed_at":"2026-08-06T19:06:31.181770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.173698Z","title":null,"venue":null,"work_id":"ff445a56-030d-477d-b576-1650c485aa3a","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.529766Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:4d2f832ca7fbb34a19804bca5bffc27c7815f3a85b9be5959071cb66ade69fe3","observation_id":"840dd4f0-012c-4811-8058-1557feda8a44","resolution":{"observed_at":"2026-08-06T19:06:31.175945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.167730Z","title":null,"venue":null,"work_id":"9c7f80e9-5842-4f34-855b-cd50a567859c","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.531693Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:4fcf9156cccfa38be1e416687a097474c50d5149d85a761e5955ca4952cad014","observation_id":"cc3eeb2d-1b4d-47c8-9d17-6c4143261c45","resolution":{"observed_at":"2026-08-06T19:06:31.169838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.161616Z","title":"Tamura, H","venue":null,"work_id":"2da04461-4b58-4e53-a65f-4a3d6e94f02e","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.533581Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:f8f3e42989abb976946fcd687eed72300d5ef25baf19af3bfd85f58a18bf08ab","observation_id":"c949a46c-3ba5-4b79-b4e5-b2b42bb0921a","resolution":{"observed_at":"2026-08-06T19:06:31.164066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.155358Z","title":"Zhang, D","venue":null,"work_id":"4a0ddc97-8367-4d28-bdd1-f56a74f26287","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.535586Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e991d9aa49ca59fc5232bccf91720bc4b57863c0b7b21b380d4b80431eaaf465","observation_id":"9a4112ab-6f39-4215-b939-cc03835edbd3","resolution":{"observed_at":"2026-08-06T19:06:31.157415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.149679Z","title":null,"venue":null,"work_id":"08ef6df0-5fd3-451d-a141-c83cfd766f97","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.537666Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3a22143c2ab855f67ef22e689046b3a348f430a248d5837bf790b5b6355f4109","observation_id":"f0e4de5c-d157-407c-8f8d-2c8a44663bcb","resolution":{"observed_at":"2026-08-06T19:06:31.151664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.143564Z","title":"Zhang, Y","venue":null,"work_id":"9887facf-55e5-4b8b-9e05-dd9f0c4fe78e","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.539631Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9164934c696d8b4fb5a3dfab6b5672ac75cc110953d4604518a612a1b12861e7","observation_id":"50edd7af-2731-42c6-bcb5-f4ca08e935d2","resolution":{"observed_at":"2026-08-06T19:06:31.145758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.137820Z","title":null,"venue":null,"work_id":"c2a5c1cb-2cc0-49e4-b475-a3e91049efcf","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.541706Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:18c94a3ae885e185f16230f18527598de826f520742a5bba91cb3cb3e151a7a1","observation_id":"962def8c-7e70-499a-aa38-41e013a406e7","resolution":{"observed_at":"2026-08-06T19:06:31.139931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.131509Z","title":null,"venue":null,"work_id":"3ae35431-cd53-4186-815a-b4d8460b241a","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.543485Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3cfedc49ea061a6c91181143837e4f67d2cabaf3ad3895c195ad9f279bafe975","observation_id":"2c352c1f-76be-4065-8e45-08c6214662f4","resolution":{"observed_at":"2026-08-06T19:06:31.133984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.125628Z","title":null,"venue":null,"work_id":"0f1e47d0-55fd-4b88-9887-389e087b1c2e","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.545237Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:4ba58bcaf9c2cea08dbd00775c0302483399933b08d95d6db7d06b899b3287af","observation_id":"c94a1d4c-c5ab-4e35-b23a-fb3feaa22030","resolution":{"observed_at":"2026-08-06T19:06:31.127783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.119773Z","title":null,"venue":null,"work_id":"f53ee2b6-38e8-4a88-8571-22c39dbf2cd1","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.546893Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d7dd429898112d3ab440ff3edf3484df03688c7e08d4bb9884f8a445442c41c9","observation_id":"7f51bf63-ff6d-4fb0-9287-128b77041e97","resolution":{"observed_at":"2026-08-06T19:06:31.121833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04474","last_updated":"2015-05-17T23:21:35Z","snapshot_observed_at":"2026-08-19T22:00:06.074211Z","submitted_at":"2015-05-17T23:21:35Z","title":"Visual Semantic Role Labeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04474","snapshot_observed_at":"2026-08-06T19:06:30.548878Z","title":"Gupta, J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.548878Z"},"links":{"cited_paper":"/paper/1505.04474","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:779d59f04c918b24b11e556ba9f6d9028b394096b2ef87063e3705b3944e841a","observation_id":"bd5e347a-aea2-4b3f-bd76-aeba812e76f9","resolution":{"observed_at":"2026-08-06T19:06:30.548878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.113750Z","title":"Ulutan, A","venue":null,"work_id":"63ad5e38-abfa-47c4-bfdc-126e22c560ed","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.550996Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:b9c6fb582adfabba872a9646eff3440bd7334247c932262b1dd755357699811f","observation_id":"4690dfff-9b3a-465e-92a2-805a16808b25","resolution":{"observed_at":"2026-08-06T19:06:31.115906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.107601Z","title":null,"venue":null,"work_id":"53b40549-33c9-48eb-84ae-213b84a49f72","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.553143Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:b0b651ece32294abe77afc4aa6f19b8c947d84e0d12cbe8370cd4d4e4cd52151","observation_id":"dba21fef-d6ce-42fd-890d-56e6fd780116","resolution":{"observed_at":"2026-08-06T19:06:31.110117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.101673Z","title":"Gupta, A","venue":null,"work_id":"8ae01c64-93b6-4f6e-b280-171ef5f53783","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.555044Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3392c75d000832e8192880c76fb28396cf0dfa16d8cd4ec484dd92eaf7ebdc2f","observation_id":"07e66959-8440-4668-8e5f-c8d9b4c5f4d3","resolution":{"observed_at":"2026-08-06T19:06:31.103838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.095517Z","title":null,"venue":null,"work_id":"a6c1cc06-32a6-4ab6-8688-7c383b4af2f4","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.556866Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:fd958224599d1ddde7df72d970d72cb0a2bcbbc854b7e858e42d8355afe887ed","observation_id":"0b8dcbc0-693c-41df-b3fd-c13366023b2b","resolution":{"observed_at":"2026-08-06T19:06:31.097823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.089300Z","title":null,"venue":null,"work_id":"83090908-7ed7-4df9-91b2-c6f5f9806302","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.558698Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3e5c8c04d77d00711efbac53ca7ccccfef881db279842e2cce7d3c462ab9602d","observation_id":"dbaeba22-4e16-4e74-b3a4-8498b9b4385e","resolution":{"observed_at":"2026-08-06T19:06:31.091378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.083167Z","title":null,"venue":null,"work_id":"1bd7b336-4543-49d6-9b8e-9a4a61829a1a","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.560595Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:6287a3d60f99d193433a9f812c298a6c63220aac82ac766257c71bb29ee9d1d1","observation_id":"d64d0341-f576-4589-af67-7b42905240af","resolution":{"observed_at":"2026-08-06T19:06:31.085479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.077246Z","title":null,"venue":null,"work_id":"201ba98c-bdf6-4a1a-a1a7-62489fe361e9","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.562605Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:8c914f53b8c1ecc78a44db57dc4c9be958b47535b5ca33c3b6793a80da7f33d0","observation_id":"a1f501b6-4aae-4890-b435-c98f09690e48","resolution":{"observed_at":"2026-08-06T19:06:31.079389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.070859Z","title":null,"venue":null,"work_id":"57d21ff8-0117-440d-956d-02c9b486264a","year":2018},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.564377Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:03ececf8a6a3aba02efddd764c000e23d787826ab7f1cd7a0660b982a0eb608e","observation_id":"f6d43d2a-8a80-4674-ac2f-d2a14f1e3e84","resolution":{"observed_at":"2026-08-06T19:06:31.073263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.064542Z","title":null,"venue":null,"work_id":"74f043ef-6c49-4e98-89ee-6e5dc0cb8fbf","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.566263Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7960e9d2dc434359cc4bbc55fa847f793de39fe23525b5ab59f74b290f6a12bd","observation_id":"75de9edc-5e5a-4082-93ee-8894bc70c9bc","resolution":{"observed_at":"2026-08-06T19:06:31.066796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.058418Z","title":null,"venue":null,"work_id":"1e857a9a-1806-40ab-b324-b0c189dc0f8d","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.568028Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:451cbf3bcfaa28bbd8589978581a3c6df1dea412933c2cd6b24ce20023f203ee","observation_id":"cb1bc14e-b9e3-4d95-82d7-d13af7be08f9","resolution":{"observed_at":"2026-08-06T19:06:31.060702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.052560Z","title":null,"venue":null,"work_id":"14c2f296-405b-4d83-adbf-5d2dd1e17c4f","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.570126Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d3880a6c6eb60a120e07f598a38b0e544f4eb92c7b5e63253b3cc4d23b9582cd","observation_id":"18a6729d-7d57-4cac-acfb-971849644a8e","resolution":{"observed_at":"2026-08-06T19:06:31.054615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.046739Z","title":"Zhong, X","venue":null,"work_id":"8998d3a3-6364-4e4b-aaec-61251e2bd103","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.571945Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:73d9993303f195b5cd25f87fb2a3d8d6b9d3ed61e277fad0868e87ffeaedd81a","observation_id":"b761514e-8ec4-4fde-b187-472a8aa6bd67","resolution":{"observed_at":"2026-08-06T19:06:31.048740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.040343Z","title":null,"venue":null,"work_id":"f6a31fa9-c3fd-410f-9589-a54433a5896c","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.573802Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:faef793cdad3aa67a58150275ad184a41bda5d3c868e427ebef4c833288ee6d3","observation_id":"5d3318a8-d5d2-4c68-a536-e30c48b0045d","resolution":{"observed_at":"2026-08-06T19:06:31.042468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.034382Z","title":"Radford, J","venue":null,"work_id":"d5344c8a-f59a-4cc7-9eb7-6432e3615c78","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.575606Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:26a593317ff611b13da086ce1db0128a678bb56e296285e56ffc2862c7228fa7","observation_id":"ace63cea-4341-499d-88d9-e7e193d32884","resolution":{"observed_at":"2026-08-06T19:06:31.036715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.028274Z","title":null,"venue":null,"work_id":"c680d0ae-d748-4c5c-9586-1e91baf384eb","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.577561Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:b32c974985c4455e3eb46bbc5f95aebf4507af8cf7cd0c29279cbe988f1293e0","observation_id":"327a9e42-7d81-4df0-8ddb-dc9012f8f8f5","resolution":{"observed_at":"2026-08-06T19:06:31.030422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.021683Z","title":null,"venue":null,"work_id":"6eb087d8-300b-49df-a2bd-a2cfbe4ebb73","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.579386Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ec981469088420428e2673b33b74452c5f45398188d02ff49815af96cade0d5b","observation_id":"a57fe27d-a400-46b0-afee-dc6b830f24b6","resolution":{"observed_at":"2026-08-06T19:06:31.024125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.014963Z","title":null,"venue":null,"work_id":"187ea4ff-e7d2-42ee-ac8a-c37c5589accf","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.581577Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:260b03b1489aab79d4119998a36431220933d9dfa922322df081b4043b7b8b40","observation_id":"13fb7d13-1ad4-4e7c-bb21-5367de96579a","resolution":{"observed_at":"2026-08-06T19:06:31.017449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.007940Z","title":null,"venue":null,"work_id":"b808d009-df3f-4be6-bde1-6e92fdd35ee3","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.583359Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:402fe942b718f9ccad73eeacfdd4f3fa2c442c6c92eaf9e3ce2d7e524fff4095","observation_id":"7617333c-2705-4a54-aaa6-3b5767baa50e","resolution":{"observed_at":"2026-08-06T19:06:31.010261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.001716Z","title":null,"venue":null,"work_id":"3c800f2a-b2d5-4e54-acd4-e058cc4dc6bc","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.585444Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:5707389caefbb7f57085ee55bffb66d0fd75479a4e3d19b8cb052e376e39647f","observation_id":"7212532c-6921-408b-b01b-64cc1fe97748","resolution":{"observed_at":"2026-08-06T19:06:31.003956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.995186Z","title":"Zhong, J","venue":null,"work_id":"4066ec63-f53e-4a29-9d80-fe3e7753878a","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.587365Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:6ce8cbf26b3eaeb146d1bef45f566b013c867fc25be70f5cab29815a8f336cfe","observation_id":"606f9912-4ed6-4339-a1a1-7a7e0b0d0388","resolution":{"observed_at":"2026-08-06T19:06:30.997551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.988665Z","title":null,"venue":null,"work_id":"9c3a1a84-9e39-41f0-aac1-a1d2fcae34a7","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.589127Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:6b37e94ab43903103ea1c741da1ba15035a26a05f63fabd26443da59b5d4d94d","observation_id":"eaba8dbd-7492-4220-8706-b8b534079720","resolution":{"observed_at":"2026-08-06T19:06:30.990884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.982728Z","title":"Bansal, N","venue":null,"work_id":"ef9865cf-e03d-4113-9f53-ce961fbd1cb5","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.590936Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:be6cd18182e19054dd1dd818f0cce8360fd3050705ab3b4ddaf21509b72ad7d3","observation_id":"7a6d721d-a777-459a-8bc7-4e51e2c607fa","resolution":{"observed_at":"2026-08-06T19:06:30.984907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.976848Z","title":null,"venue":null,"work_id":"f5750cda-4b5e-41b4-bc7e-8cd70a8d2faf","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.592750Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0f052641ffb236dae95cfa8f5173399bd69243c678644698372e090871c63934","observation_id":"e8eafec0-5dd1-4eae-980b-dc1bafadc06f","resolution":{"observed_at":"2026-08-06T19:06:30.979016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.971011Z","title":null,"venue":null,"work_id":"fd9dac3c-b246-4e82-a30d-f9f0c22f2445","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.594725Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:6a7bea9aa9cd745c3a2c23709efd8d11af864b7222727367de8f86bec873531c","observation_id":"68ce2f9d-80df-4d32-bebd-37c02a704f6a","resolution":{"observed_at":"2026-08-06T19:06:30.973100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.965110Z","title":null,"venue":null,"work_id":"b926e5f7-0055-4af4-8fc3-1b4f15dbea46","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.596658Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:92e9bec4ead7d4f424ca9badde363b2a0a34dbf1ce1985c5fa9f76a2a564dab2","observation_id":"5a895d0d-b2bf-4cf3-a310-e974164f8323","resolution":{"observed_at":"2026-08-06T19:06:30.967224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.959531Z","title":null,"venue":null,"work_id":"b50586bf-c9dc-434d-b153-55f071a250c0","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.598452Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e6b1bcbc56bf2abf917beae249b2c550ca04999d1e09b5378aa719613a94a9e4","observation_id":"c7b71b9d-4ed4-47a0-a191-48ccbfaea515","resolution":{"observed_at":"2026-08-06T19:06:30.961533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.953807Z","title":null,"venue":null,"work_id":"ffb8f826-fdd3-4d63-9020-e8c2b7795953","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.600376Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:c14cae30d0bd71d9abad3e5cc00c218b0f04469e2aea74a9cc795d422afa1ba7","observation_id":"edd7ff91-2ff5-4a66-9e2d-534b016258f7","resolution":{"observed_at":"2026-08-06T19:06:30.956048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.948164Z","title":"Zhang, S","venue":null,"work_id":"b8074455-5012-4736-bbdb-e897fdde2aaf","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.602063Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:5319148582346d96c3d1c4f7161bbee31e647116977ea16a45e641bdb70883bf","observation_id":"0b163358-69e8-4b6b-9660-bf3f12a3dfdb","resolution":{"observed_at":"2026-08-06T19:06:30.950151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.942488Z","title":null,"venue":null,"work_id":"a4ee2538-784a-45f9-b91c-5b81f3e5a1c9","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.604090Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:07259105a9796307295ce06b65bfb94be1bce4c6d3b520341dfbd6ef1302c390","observation_id":"4be0df52-d5c1-4331-861c-59591ce1b5cb","resolution":{"observed_at":"2026-08-06T19:06:30.944499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.936470Z","title":"Xiong, X","venue":null,"work_id":"795d9c11-3fba-4f0c-8be5-46d0f4a27271","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.606023Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d6ac93df8b8641aba15a3ca1157c6aff32dda45792518a485ca3fe29a55bef11","observation_id":"0d9b8b18-7ad1-4e8e-b63b-ead30e7031f1","resolution":{"observed_at":"2026-08-06T19:06:30.938633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.930587Z","title":"Carion, F","venue":null,"work_id":"d5a6edfb-e5c8-4a66-97ee-0c8a9bccc64f","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.607886Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:f1f26ca8d301c4e3d17261381b67546ec8fde1b41e604b95ddcf2f3773d24f28","observation_id":"54016b51-5ae3-4287-a755-c5f7ac9ef0ff","resolution":{"observed_at":"2026-08-06T19:06:30.932780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.924956Z","title":null,"venue":null,"work_id":"e7d29a23-ba74-4e3e-b414-0296516889cd","year":2015},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.609814Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:b4ca374d56e904d90179c5ac4314582c362c81ff4103f6f9d37a6b7faff87d75","observation_id":"7c1d977d-e041-49ce-886e-fe40a5b49c68","resolution":{"observed_at":"2026-08-06T19:06:30.926969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.919246Z","title":null,"venue":null,"work_id":"acf706e3-fb08-4dc0-842f-ae990c5c35b2","year":2016},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.611777Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:04ca672ea1ac257c38903315015ceb7092b5dc1d405af1fe2695212fd3f71e05","observation_id":"d98f04a2-0e0e-42b1-9d32-3bc6638aabd9","resolution":{"observed_at":"2026-08-06T19:06:30.921169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.913476Z","title":"Loshchilov","venue":null,"work_id":"6bcefc96-5973-4246-a60f-4695e8a779ea","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.613611Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d14147fe3513372d2b9a0b6cffa350d5565f5240eb7780776bef7a8f541ada65","observation_id":"4118d0f1-a990-4d41-a1e7-927315f32147","resolution":{"observed_at":"2026-08-06T19:06:30.915531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.907907Z","title":null,"venue":null,"work_id":"9e2b0429-bd1e-4a0c-9982-91f9bb628b5a","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.615875Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:184d5006fda413b994695ce7e1227da8dc0f627f05708a27a1d845d965213376","observation_id":"5dcc6e56-50f8-4963-9d35-b86de4303400","resolution":{"observed_at":"2026-08-06T19:06:30.909979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.902111Z","title":"Bansal, S","venue":null,"work_id":"23807e21-f402-4ca4-92da-04e331638666","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.617889Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ace0b8416fc4446474e8115d7058fd2b38a4caa8b217e558305fa2e70a29f181","observation_id":"59867246-07e5-4375-8720-c34a4d773117","resolution":{"observed_at":"2026-08-06T19:06:30.903968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.896537Z","title":"Gupta, A","venue":null,"work_id":"1de660db-968a-4663-a0d8-90397723340d","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.620080Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e9e3e93fd227d83d9b537b1e9b676444b0edf4a94137b5cae29a4aa375175ba7","observation_id":"e773e787-f1db-412a-bebd-8ae486c21d37","resolution":{"observed_at":"2026-08-06T19:06:30.898532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.890416Z","title":null,"venue":null,"work_id":"80266adc-7bab-45f8-bc80-8862e0876459","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.622005Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:6f8ba47f7db4e7f6dc371f5bc44511d7f933751499d2b6102e8c53744113dde3","observation_id":"93ca6fd4-d75a-4260-a36d-f40ba15ef849","resolution":{"observed_at":"2026-08-06T19:06:30.892641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.884275Z","title":null,"venue":null,"work_id":"0e71584d-7cf9-4d78-b693-12358e138035","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.623862Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:36be7c41b02fd825ec2919c6d7ac7c1f1e7219be9e39aef0c353289394aa028e","observation_id":"c83081f9-f0ab-4ad8-adad-f622f8d6223d","resolution":{"observed_at":"2026-08-06T19:06:30.886689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.878431Z","title":null,"venue":null,"work_id":"e57d10f7-6f2f-4187-b925-21d4e9f3572d","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.625735Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a7af98addafa9974e8b4b1c6c9ef5344f6a6850e086ce477f49cf8122076e033","observation_id":"3e6b089e-d851-4eeb-b3c4-7f93d38db674","resolution":{"observed_at":"2026-08-06T19:06:30.880357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.872600Z","title":"Peyre, I","venue":null,"work_id":"706e356e-9ec6-4d48-a20a-235d143b49f4","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.627652Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ff0a33c5a28ec91dac90cb83f13eb60f91e60dbc293468037c7430cb6f340660","observation_id":"a04bc32c-f999-455b-a266-6e03be624833","resolution":{"observed_at":"2026-08-06T19:06:30.874570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.866722Z","title":null,"venue":null,"work_id":"58ccc530-3c80-4209-9955-ff8748c11ddf","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.629521Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:2ae8d7e672c2234c9a61d576949d869022de6af39cb54a39abe33d88cab961c6","observation_id":"e41795fb-91af-4040-a743-a22ce00fd019","resolution":{"observed_at":"2026-08-06T19:06:30.868770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.861076Z","title":null,"venue":null,"work_id":"ebae1c84-bf50-45c2-8f1f-88cb84679a75","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.631662Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0e70afd100fa895fe3d5e8d769dc51b067d97a8df903db4fae67516b6a2ba418","observation_id":"98f7e3e3-d0a7-4928-a81f-c985665b119e","resolution":{"observed_at":"2026-08-06T19:06:30.862972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.855378Z","title":null,"venue":null,"work_id":"9b924d9f-9101-4997-9efe-cf582463805b","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.633593Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e5bac8a6f2c2d6f4d6797398bf4cf1a70209c957d2a2e927de4921c9a6548226","observation_id":"2b40dd2f-1635-4a6b-8c21-cf7eaa2b2432","resolution":{"observed_at":"2026-08-06T19:06:30.857335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.849852Z","title":null,"venue":null,"work_id":"692533c6-3fda-4489-870a-941747192cf5","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.635489Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:964b5c2ffa13cda05283f82bb51c829cddc68205dc2a48d648f61be5b673ad70","observation_id":"08714303-8c01-4acd-814d-c12ce6bbcb0a","resolution":{"observed_at":"2026-08-06T19:06:30.851781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.844057Z","title":"Zhang, D","venue":null,"work_id":"c8bf6b69-a305-4fd7-872f-675b181c9dc6","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.637424Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:50852c4621065550620202119d31dc201072b0bcb7a616e8bf988cb60dc8235d","observation_id":"2b98c2b4-06da-40b6-8a02-2c02b5a7ace4","resolution":{"observed_at":"2026-08-06T19:06:30.846207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.838072Z","title":null,"venue":null,"work_id":"d2d81a1f-37f7-432e-909e-8f0db870876e","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.639268Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:bb7edc9decb643b593c49b1760bb915a1a85483dd7adde73eef5de72813bcd10","observation_id":"31e5c11d-0e83-4891-92c9-34b7fb8691a2","resolution":{"observed_at":"2026-08-06T19:06:30.840176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.832310Z","title":"Iftekhar, H","venue":null,"work_id":"422b4426-1d09-422e-a37f-57617c390a30","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.641397Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7c3b14629eaec6816f88099bd850031b1f63743fceaab9b1c7d737b262d6a52d","observation_id":"9773363a-5e11-464a-b9df-111a63920c79","resolution":{"observed_at":"2026-08-06T19:06:30.834398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.826248Z","title":null,"venue":null,"work_id":"1e801d98-43ca-4744-ab62-550d77d8ffb7","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.643272Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:42f94b8def054c4a05110b6083bea2a19cf70be1989cf1e48430c30e6b6691f4","observation_id":"1beb2d65-bcc8-4201-ae26-fe909d29d446","resolution":{"observed_at":"2026-08-06T19:06:30.828229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.820499Z","title":null,"venue":null,"work_id":"9b268aaf-5b78-4986-9b85-7d75c744b58e","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.645064Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:1f3516376919ccc9933ab0cd6dc4531b2f8b21baf602c8b30e84c29790a6f0e7","observation_id":"94fcb759-a9c8-4cf1-92dc-1f6588e527e2","resolution":{"observed_at":"2026-08-06T19:06:30.822548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.814474Z","title":null,"venue":null,"work_id":"057abc01-a139-4dbb-a43f-ef2d3245bf77","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.646876Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:19d9a84c194f16c84192e3b2854ebff8532f5b533a083ace63b6f0631b7a9e9c","observation_id":"9ce8ba8a-a69f-4de3-8e8f-982248a00b94","resolution":{"observed_at":"2026-08-06T19:06:30.816581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.808715Z","title":null,"venue":null,"work_id":"f5132207-4deb-49ff-a3bb-08034773efae","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.648854Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7664e33c743a3d35f57a0127ae2f80c1d1957a6a857e00922719f8d157f3192a","observation_id":"d14d5fef-231d-4dac-8bcd-cd446bfa3a32","resolution":{"observed_at":"2026-08-06T19:06:30.810805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.802674Z","title":null,"venue":null,"work_id":"5910ccd6-0d64-457b-b65e-04eda480fefa","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.650620Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e5c869572597ce1f1909d6fda142e66dd821aed89aa150f53a91ef144470a184","observation_id":"aaa781e3-cce0-4e55-b24a-7522ae4dd61c","resolution":{"observed_at":"2026-08-06T19:06:30.804799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.797005Z","title":null,"venue":null,"work_id":"81e49950-62f5-46cb-a071-c2211633a31b","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.652707Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9b724842e210c20149aa5e24740f90e232922a96ff168b40979d2dce50b1c3ce","observation_id":"38f94b91-fd82-45f9-bb41-7ee052706a31","resolution":{"observed_at":"2026-08-06T19:06:30.798997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.790896Z","title":null,"venue":null,"work_id":"711585ab-69bc-4122-9ad3-5d1396167988","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.654755Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:8b82c934d2f6f1121229a606748bb690d4b40ca6b61e791f1a9a1a6c1f4d1a2c","observation_id":"ee425de8-7647-4ba0-80ed-9a709c2036fd","resolution":{"observed_at":"2026-08-06T19:06:30.793210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.784394Z","title":"Dosovitskiy, L","venue":null,"work_id":"3f493790-d97c-4dc3-90f4-5fa73d3e1d97","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.656794Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:b57b586da45f399dfbbe819cca3a31fffc615171ba2e46df2b217d67d10685f9","observation_id":"18eddb26-b027-4f34-98b0-5f9d075bc770","resolution":{"observed_at":"2026-08-06T19:06:30.786595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.778374Z","title":null,"venue":null,"work_id":"05a4bbc1-d0a7-46c3-b669-1b1c626d36e9","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.658714Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a0aaa3834e55a9eed7a9692b728175a93d5e32480c35459bc3c0bfd317df4d4d","observation_id":"a2142139-3ce5-48fe-88ab-cbfd429137fd","resolution":{"observed_at":"2026-08-06T19:06:30.780448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T19:06:30.660532Z","title":"Zhang, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.660532Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0a48e7f376911bd82b01603cc5cbd2d56721e45b1674668c623650757ff683c0","observation_id":"948353d1-6474-487a-b5de-b74294e8260b","resolution":{"observed_at":"2026-08-06T19:06:30.660532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.772560Z","title":null,"venue":null,"work_id":"cc0db442-64af-4bc7-b798-bb2387ceb97a","year":2018},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.662860Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a2f7342daf58337af6300dc96b728ef2cb3addf77b8550d77ba98e9d958dfec9","observation_id":"19d18244-06c6-42ed-afe3-5437ec0b58f4","resolution":{"observed_at":"2026-08-06T19:06:30.774466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.766680Z","title":null,"venue":null,"work_id":"8f292724-0428-4476-99bc-e013d6fcbafd","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.664724Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:c85afb1fa7037cf37011ed886bc1f28fe5914ee49e9aea41956f5f3278a30488","observation_id":"90c76da4-0567-4ec1-b912-550c70ecef75","resolution":{"observed_at":"2026-08-06T19:06:30.768689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15657","last_updated":"2024-10-21T05:51:51Z","snapshot_observed_at":"2026-08-16T13:07:33.184079Z","submitted_at":"2024-10-21T05:51:51Z","title":"CL-HOI: Cross-Level Human-Object Interaction Distillation from Vision Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.15657","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15657","snapshot_observed_at":"2026-08-06T19:06:30.707983Z","title":"CL-HOI: Cross-Level Human-Object Interaction Distillation from Vision Large Language Models","venue":"cs.CV","work_id":"69f79538-fe07-4b99-9ef1-6e29455591d2","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.666682Z"},"links":{"cited_paper":"/paper/2410.15657","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0b54ffc19f06e1f184adf0793ad0fa26bd9c1a74baee61d9053ddc032d99e9f4","observation_id":"a5d16240-30d0-468a-afd4-72470474a9a4","resolution":{"observed_at":"2026-08-06T19:06:30.712217Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.760195Z","title":null,"venue":null,"work_id":"9d3f5bde-1b6a-42cb-a088-3b8cd13a6ddf","year":2014},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.669016Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d3a682a0c35e717862d5880ba57ad45651debb802228fd9acb8a724ae5bb085b","observation_id":"06d7c4d4-f7e0-4685-84e5-7910ac52ca30","resolution":{"observed_at":"2026-08-06T19:06:30.762352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T19:06:30.670859Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.670859Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9d7531fe23b182456a1068ba1bcc595faabcaba8405d81a1a3e9f01e801ff023","observation_id":"5c19eb7e-18d2-4d05-9e55-df881a629782","resolution":{"observed_at":"2026-08-06T19:06:30.670859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.753910Z","title":"Vaswani, N","venue":null,"work_id":"2dfe651e-1a56-4791-9a2f-f10c3c0fe664","year":2017},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.673067Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:532ce1782c9bfe74612016ff6231fbbbf0ea672a9169d65612ff112a445c3839","observation_id":"8ebf5ebe-0b95-46e5-be55-1925d0c25e1a","resolution":{"observed_at":"2026-08-06T19:06:30.755829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.747699Z","title":null,"venue":null,"work_id":"bcdf4725-cf3f-4347-bbf8-08a2dce97137","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.674872Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d037a18a769236dfb8d876e8c8fbdb77ea2d327df2c458bd30a8d163cb23e329","observation_id":"c59552ad-cd67-464c-bd5b-a7fd14a6058e","resolution":{"observed_at":"2026-08-06T19:06:30.749834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.741400Z","title":null,"venue":null,"work_id":"b87814f2-1eb1-4381-854f-ef9e7703d5ef","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.677026Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a3122e4c1b9d7e04c9067cde4ce92d6a1e0bcf2e745445a53889a3e35e21b30f","observation_id":"b6b579a6-389a-4d22-86fc-6cdb9093c394","resolution":{"observed_at":"2026-08-06T19:06:30.743566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.735197Z","title":null,"venue":null,"work_id":"835903ca-f533-458f-b025-0cbcf5ab8ab0","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.679056Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:cd725fb823172151bc7cec4c18e4775a846394d6ff2f64c3c66f308a7eeb11c9","observation_id":"bb21e392-49fa-43b2-a76a-18c7be3253e8","resolution":{"observed_at":"2026-08-06T19:06:30.737267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.728761Z","title":"EF Only” and “EF+LSG","venue":null,"work_id":"30c31b2f-845b-44ed-8b15-fda994f53548","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.680985Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:fc8eb4114fb3882671a322616c0f113c4b1c3dd3b0008b10a17d47699097c585","observation_id":"6a0cca0a-f73b-471a-8488-b8594f25ca9b","resolution":{"observed_at":"2026-08-06T19:06:30.730867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection"},"reference_resolution":{"displayed":85,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":85},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 85 of 85 outbound references and 0 inbound Pith citation observations for arXiv:2507.06510."}