{"as_of":"2026-08-16T20:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:749bf37d5dd4d1e91bd7bc70c3c990f572b3ee925b2d90e3c17ce85a0354d1e7","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:26:14.733705Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:40:28.704106Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T20:40:29.157784Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"cited_work":{"arxiv_id":"2501.08597","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.08597","snapshot_observed_at":"2026-08-15T20:40:29.157784Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","venue":"cs.CL","work_id":"ca5596b5-d767-431d-b492-b850ddca2981","year":2025},"citing_paper":{"arxiv_id":"2505.12343","last_updated":"2026-06-27T08:01:07Z","snapshot_observed_at":"2026-08-15T20:33:29.646295Z","submitted_at":"2025-05-18T10:15:42Z","title":"Mitigating Hallucinations via Inter-Layer Consistency Aggregation in Large Vision-Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:40:28.704106Z"},"links":{"cited_paper":"/paper/2501.08597","citing_paper":"/paper/2505.12343"},"observation_digest":"sha256:2294904b8ca36d2e0d70351741d351341d89ac47c7ce4377523d5a01ae195e2f","observation_id":"3281fca1-ded0-4ba8-9883-0c1df7969fdc","resolution":{"observed_at":"2026-08-15T20:40:29.163997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08597/citation-record","integrity":"/paper/2501.08597/integrity","json":"/paper/2501.08597/citation-record.json","paper":"/paper/2501.08597"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.594470Z","title":"In: IEEE Conference on Computer Vision and Pattern Recognition, CVP R 2021, virtual, June 19-25, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.594470Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:31e0101c805f8ffeac2572435667d0c8e75bb21047e8323e9b724ac9ef5475ba","observation_id":"30d76a88-f162-403f-91a6-39597a88ccaf","resolution":{"observed_at":"2026-08-10T20:26:14.594470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.349476Z","title":"In: Proceedings of the IEEE/CVF International Conference on Co mputer Vision","venue":null,"work_id":"c182b8d4-58fc-4664-bce6-117f0a78eef8","year":2023},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.600813Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:1d9a260a047df0c180e7f354c39e79e400bb6d6a7289aad508a368d47a057263","observation_id":"e83fc71a-0caf-46c4-ac10-c7a0aeea6ded","resolution":{"observed_at":"2026-08-10T20:26:15.355258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.329724Z","title":"In: Pro- ceedings of the 2021 Conference of the North American Chapte r of the Associa- tion for Computational Linguistics: Human Language Techno logies","venue":null,"work_id":"39d6356e-7bac-4d14-bb93-632839ed8921","year":2021},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.606901Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:2dc848d23083d77264015ebefaff8d419e11eb57d773db0c3ce059b08e2d1c92","observation_id":"da115f58-2fce-4b52-9674-9425fec06cf1","resolution":{"observed_at":"2026-08-10T20:26:15.335599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.309679Z","title":"In: Chaudhuri, K., Jegelka, S., Song , L., Szepesvári, C., Niu, G., Sabato, S","venue":null,"work_id":"93c10fc8-7982-477c-8837-9b2b6904212e","year":2022},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.612783Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:edab706ba71772e82996c7ab9651ee8eff191fd44f376379151e9d2cdd4f3084","observation_id":"3ff0f8ec-4a26-4107-bf41-3e281cb80b65","resolution":{"observed_at":"2026-08-10T20:26:15.315990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.619189Z","title":"In: Moens, M., Huang, X., Spec ia, L., Yih, S.W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.619189Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:3a880607523caaef37db2410dc412d51de009e38918a623579a7cd3095ba5245","observation_id":"7c4ae5d5-2a36-4bf7-8a5b-a01173104d67","resolution":{"observed_at":"2026-08-10T20:26:14.619189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10226","last_updated":"2024-04-16T02:11:46Z","snapshot_observed_at":"2026-08-16T14:00:39.090495Z","submitted_at":"2024-04-16T02:11:46Z","title":"Find The Gap: Knowledge Base Reasoning For Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10226","snapshot_observed_at":"2026-08-10T20:26:14.624428Z","title":"CoRR abs/2404.10226 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.624428Z"},"links":{"cited_paper":"/paper/2404.10226","citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:46d5e5fd26aa5f2523d98b0fa22fe24631e3121ad59015788a6c5cadb87eb919","observation_id":"b509c0df-5801-4ca9-8d12-2ca6d5b34eae","resolution":{"observed_at":"2026-08-10T20:26:14.624428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.631125Z","title":"In : Proceedings of the AAAI Conference on Artiﬁcial Intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.631125Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:b545372bc3a487765e7f43b58463ba233a5dc3a4687fab09e6f6bc38e7879cfa","observation_id":"8a1adc1a-fb24-4151-a1f3-95662a802ced","resolution":{"observed_at":"2026-08-10T20:26:14.631125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.262866Z","title":"In: 8th Internationa l Conference on Learn- ing Representations, ICLR 2020, Addis Ababa, Ethiopia, Apr il 26-30, 2020","venue":null,"work_id":"0b4aec73-9d56-417d-b4ac-74addadeab21","year":2020},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.636116Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:41423ed3f5faaf528be69d9f6f68218a73e7f191ca392ba7e714bb56d9316a64","observation_id":"886549d2-9ab3-4d36-a8b1-39f19e65b018","resolution":{"observed_at":"2026-08-10T20:26:15.268680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.641034Z","title":"In: Proceedings of the 60th Annual Meeting o f the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.641034Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:965d16d67ac50c6603f11ff594f0c355495ed841c66a7b488a31776767727017","observation_id":"150d22e4-780e-4eea-9675-f7ceaaeb1e03","resolution":{"observed_at":"2026-08-10T20:26:14.641034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.234282Z","title":"In: Proceedings of the ACM Web Conference 2022","venue":null,"work_id":"0a230077-d7b5-46c6-bf8c-54579d793ae6","year":2022},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.645859Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:7bdc74b8d0e6744e5e4d2f240cd0d6c0c8e2810f0d1947e30f672fd53ec613f3","observation_id":"e4b81384-843e-45cc-818f-3c0444d49f7a","resolution":{"observed_at":"2026-08-10T20:26:15.239376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.217021Z","title":"In: 8th Internationa l Conference on Learn- ing Representations, ICLR 2020, Addis Ababa, Ethiopia, Apr il 26-30, 2020","venue":null,"work_id":"f4499641-00d5-4cd7-9659-208aafb29663","year":2020},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.651322Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:504463244802cc46f82735b009d8acc54448332082014cf6e2aeef13c8d8f68a","observation_id":"1f5495ac-5d81-45c8-ba5b-8fe4bd6f4df8","resolution":{"observed_at":"2026-08-10T20:26:15.222820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.197490Z","title":"In: Proceedings of the 17th Conference of the Eu ropean Chapter of the Association for Computational Linguistics","venue":null,"work_id":"343689c1-2836-48ce-aca3-c23ca5b348e5","year":2023},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.656667Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:4ef9db0b0fd0b885aff1a7992f344b7931ba4b7938e03dc16a0a5a595aeec3ab","observation_id":"38eac974-b0cf-4c65-97b1-229293fae40f","resolution":{"observed_at":"2026-08-10T20:26:15.203491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-naacl.5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.846491Z","title":"In: Duh, K., Gómez-A dorno, H., Bethard, S","venue":null,"work_id":"6a2bdba3-5502-4ddc-a519-52f579105ab5","year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.662482Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:a02e332bc45deb4bb2eac95fecd5b88a7676d3b3c3a70eeecf9cc6253ebf48e3","observation_id":"a8213494-1171-4008-9f53-6aa954b7314d","resolution":{"observed_at":"2026-08-10T20:26:14.851822Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.178572Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":"6659f002-a89b-4201-87b2-64846b65d7a3","year":2021},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.669391Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:47db9c35937479f669197065da31fe112a26745bba5118551dca923065844226","observation_id":"b91141d1-7ccc-4d00-b00b-b33d5f29822c","resolution":{"observed_at":"2026-08-10T20:26:15.184015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.154460Z","title":"Expert systems with applications 141, 112948 (2020)","venue":null,"work_id":"5b98e5e2-d13b-4cc3-81c6-12bcbbbe9bbb","year":2020},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.675994Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:952321959f49fc31ca16cb41c56ba5e0f5ffde672ab7a77e98922a695ed36adb","observation_id":"c3a9eb62-2cc7-4a09-b248-d8bbc5a04732","resolution":{"observed_at":"2026-08-10T20:26:15.160054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jlamp.2018.09.001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.827178Z","title":null,"venue":null,"work_id":"79362431-7037-446e-a8d6-2dd9bc9898e3","year":2018},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.681807Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:05d3e8c828d5d5ee85f7efc4880789b9b3a08068d4c4ef4984c9c2514f9239f4","observation_id":"ef159604-7be8-45ad-b30b-6c435b417435","resolution":{"observed_at":"2026-08-10T20:26:14.833651Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03320","last_updated":"2024-07-03T17:59:21Z","snapshot_observed_at":"2026-08-14T16:53:05.474750Z","submitted_at":"2024-07-03T17:59:21Z","title":"InternLM-XComposer-2.5: A Versatile Large Vision Language Model Supporting Long-Contextual Input and Output","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03320","snapshot_observed_at":"2026-08-10T20:26:14.687257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.687257Z"},"links":{"cited_paper":"/paper/2407.03320","citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:afc850a359e2e41134930f1be9e0c7d62f299cf8bc287f94aa4a120d1b72f041","observation_id":"02f1c7f7-afac-44c5-8793-fdd47b216359","resolution":{"observed_at":"2026-08-10T20:26:14.687257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T20:26:14.696322Z","title":"arXiv preprint arXiv:2308.12966 1(2), 3 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.696322Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:2ecbdc3b0cfb91ebb02d995f94e892a59371b5dd4fefd05df8626104b07b695b","observation_id":"ee3723c8-f70f-4d95-8453-b2016c63647c","resolution":{"observed_at":"2026-08-10T20:26:14.696322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.702381Z","title":"In: ICASSP 2021-2021 IEEE Inter national Conference on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.702381Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:edbf0473fd73fd0821132f5f43dabd22ed45feba4db2231d3133e9e1470e9c01","observation_id":"5a0d142d-d8b3-422c-a75c-408337b1b556","resolution":{"observed_at":"2026-08-10T20:26:14.702381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:15.122128Z","title":"IEEE Transactions on Pattern Analysis and Machine I ntelligence (2024)","venue":null,"work_id":"d6bb95f0-13fd-41b7-a468-ebace472d554","year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.709356Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:9baef99ce74fc328d429c24d2bba263bef26ca6cd883bce7a928392899695641","observation_id":"f3ae059e-533a-4e31-90dd-980fe3e50403","resolution":{"observed_at":"2026-08-10T20:26:15.130156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19732","last_updated":"2024-12-20T16:19:17Z","snapshot_observed_at":"2026-08-16T13:05:52.745982Z","submitted_at":"2024-10-25T17:59:09Z","title":"Rethinking Visual Dependency in Long-Context Reasoning for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19732","snapshot_observed_at":"2026-08-10T20:26:14.716769Z","title":"arXiv preprin t arXiv:2410.19732 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.716769Z"},"links":{"cited_paper":"/paper/2410.19732","citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:c35e32b5760d06df96e02aa667ea498d2256d570bd04b2479f0ffcb46067bb03","observation_id":"7bf5d5c0-f1da-40da-89a5-a4e35c904da8","resolution":{"observed_at":"2026-08-10T20:26:14.716769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:14.723496Z","title":"In: Findings of the Association for Comput ational Linguistics, ACL 2024, Bangkok, Thailand and virtual meeting, August 11- 16, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.723496Z"},"links":{"citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:6540826029c39f7a180b4b451a58e0780e80697303a2d04586c8052a592ff2a2","observation_id":"c32cba02-761c-457c-b739-6000bb325ae5","resolution":{"observed_at":"2026-08-10T20:26:14.723496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10292","last_updated":"2024-10-07T19:13:47Z","snapshot_observed_at":"2026-08-16T13:52:04.740660Z","submitted_at":"2024-05-16T17:50:19Z","title":"Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10292","snapshot_observed_at":"2026-08-10T20:26:14.728488Z","title":"CoRR abs/2405.10292 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.728488Z"},"links":{"cited_paper":"/paper/2405.10292","citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:3ac709cb9e4a35c1392a58481ed8fada4c5bb9fa2229cb3b1006546a1a98226d","observation_id":"44d5c870-070d-4de4-99e3-785240b86460","resolution":{"observed_at":"2026-08-10T20:26:14.728488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04236","last_updated":"2025-03-02T09:39:57Z","snapshot_observed_at":"2026-08-16T14:20:53.769481Z","submitted_at":"2024-02-06T18:43:48Z","title":"CogCoM: A Visual Language Model with Chain-of-Manipulations Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04236","snapshot_observed_at":"2026-08-10T20:26:14.733705Z","title":", Hou, L., Li, J., Dong, Y., Tang, J.: Cogcom: Train large vision-la nguage models diving into details through chain of manipulations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:14.733705Z"},"links":{"cited_paper":"/paper/2402.04236","citing_paper":"/paper/2501.08597"},"observation_digest":"sha256:542dffa867e27a573223f3df1d91fd8887f5af5da6e59476c8c55c6275c7a3cd","observation_id":"5379d69f-c8d9-4a68-84a1-75f0a3ff716c","resolution":{"observed_at":"2026-08-10T20:26:14.733705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08597","last_updated":"2025-01-15T05:45:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T01:48:06.073049Z","submitted_at":"2025-01-15T05:45:04Z","title":"Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":10},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2501.08597."}