{"as_of":"2026-08-12T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e50a80af5a0182a2cb9230241f3c5c60795792fd6c6fab804a13e245eb8604e","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:43:26.168569Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20511/citation-record","integrity":"/paper/2607.20511/integrity","json":"/paper/2607.20511/citation-record.json","paper":"/paper/2607.20511"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T08:43:22.449328Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:22.449328Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:c76de2e9303d8f763c50cdc6b55d8ff5b3b333086add23e08fb93cb0650d24ff","observation_id":"b9a91c86-c35b-4c7d-ad6e-bab6e950f9be","resolution":{"observed_at":"2026-08-02T08:43:22.449328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:22.518105Z","title":"Advances in neural information processing systems32(2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:22.518105Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:d41b009863db7bd6a08083fb80890d2ce961731aace8629c0c2189d4dcb94375","observation_id":"75e5251c-7084-49ad-b6a9-37b59ba55880","resolution":{"observed_at":"2026-08-02T08:43:22.518105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-02T08:43:22.603014Z","title":"arXiv preprint arXiv:2308.12966 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:22.603014Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:ae762e0dd4475f5558e6af48104a5e4f973ec23b0bd84b5c7499247c5d2350c3","observation_id":"0be6bda0-6973-48c7-8799-4feefd64adf2","resolution":{"observed_at":"2026-08-02T08:43:22.603014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08545","last_updated":"2022-11-15T22:31:38Z","snapshot_observed_at":"2026-08-09T22:32:24.524992Z","submitted_at":"2022-11-15T22:31:38Z","title":"MapQA: A Dataset for Question Answering on Choropleth Maps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.08545","snapshot_observed_at":"2026-08-02T08:43:22.776469Z","title":"arXiv preprint arXiv:2211.08545 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:22.776469Z"},"links":{"cited_paper":"/paper/2211.08545","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:ee1bfff4070c951af87c58f21266f1d26dcf7594fadc76d2c70f2812682a6b19","observation_id":"a1473f0e-ef71-4b43-a30d-4d03eb9db4ab","resolution":{"observed_at":"2026-08-02T08:43:22.776469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:22.897583Z","title":"Advances in Neural Information Processing Systems37, 57817–57840 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:22.897583Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:e726353650ca74b6da1ed00a393b6c45620314c4e8cd0db1d3e414d5434cd2cb","observation_id":"f6778f60-9cdc-4fa4-89dc-86d9c5a42ca1","resolution":{"observed_at":"2026-08-02T08:43:22.897583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.016912Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.016912Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:601141acbe4e332f46eac35268333900538523027a93317098ec8645c1679441","observation_id":"78d7c45e-8767-47d2-a6e3-c753265ed171","resolution":{"observed_at":"2026-08-02T08:43:23.016912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.147456Z","title":"Advances in neural information processing systems36, 49250–49267 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.147456Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:fc1f8838c9f354adcfb9644cee2b1d2e44e87a31fe7ba9de1dd865e82fb38ba9","observation_id":"7e9f1c12-f8f2-4d61-b517-1af85ee41d60","resolution":{"observed_at":"2026-08-02T08:43:23.147456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.260181Z","title":"In: Che, W., Nabende, J., Shutova, E., Pilehvar, M.T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.260181Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:468a5a33eb2d9eb492a60ff952aba702ee9f66918b8d10c0ce605e44c5eb07b8","observation_id":"9e468800-2745-4af0-81d3-f7dc8805bf89","resolution":{"observed_at":"2026-08-02T08:43:23.260181Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.332095Z","title":"In: Proceedings of the IEEE/CVF Inter- national Conference on Computer Vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.332095Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:2711a31ce3a37e01291eaca3909b3c2e21e6b75718d4fe8679470db9d193209f","observation_id":"03c22f92-c8f0-42ad-ba31-2949cf20ee58","resolution":{"observed_at":"2026-08-02T08:43:23.332095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.409187Z","title":"In: Findings of the Association for Computational Lin- guistics: ACL 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.409187Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:806b6fd165d664a2a1e51300f789f26ff91020befa0dbfbec4aa7b36abe3e0d0","observation_id":"2ddd060d-39c8-489d-b84f-41f22aa8c163","resolution":{"observed_at":"2026-08-02T08:43:23.409187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.549092Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.549092Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:2175977453dd6bbc599af29407f5823ea225a91f555b4f82bf9bf826d4a49d84","observation_id":"1e3ee992-56b3-4fbd-95df-ad6f399cc01e","resolution":{"observed_at":"2026-08-02T08:43:23.549092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-02T08:43:23.625663Z","title":"arXiv preprint arXiv:2003.10286 (2020)","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.625663Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:c906a83422cb4dea33f319cf3543c7a42cb2dde7c8fef207c17513ff614690a8","observation_id":"c55c5b42-1470-44e7-aef4-aa662af06a8e","resolution":{"observed_at":"2026-08-02T08:43:23.625663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.738535Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.738535Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:d73a2eea6d69e04a50ffb72c231c14bbcac4f10d31fad026a7ee13bafc9b6314","observation_id":"90130ee6-006e-4bdd-9450-0f1b00be228e","resolution":{"observed_at":"2026-08-02T08:43:23.738535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:23.885528Z","title":"In: International Con- ference on Learning Representations (2022),https://openreview.net/forum?id= nZeVKeeFYf9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:23.885528Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:04aa7c0860f056fea0dba67f9e25d513122c3b0ad7bb92c3e3ea0cc7d18d7fea","observation_id":"5fe9a4a2-0382-44c2-b3b3-8fb2c963ee7b","resolution":{"observed_at":"2026-08-02T08:43:23.885528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.014961Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.014961Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:bcdefb5e57b22076344a4ca2abd2e4f8e2041bbf00c705102d516531bc051f18","observation_id":"117f5408-cf53-4ce0-a85f-fe4166150397","resolution":{"observed_at":"2026-08-02T08:43:24.014961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.164039Z","title":"Neural computation3(1), 79–87 (1991)","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.164039Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:6b2b64176bc5f4a4b1ac94506fc3df4b85d35a861df944dd8cc31122428ae8f0","observation_id":"d2941d3e-3a0e-4a11-88ec-836f2ea7e43d","resolution":{"observed_at":"2026-08-02T08:43:24.164039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-02T08:43:24.391339Z","title":"ArXivabs/2310.06825(2023),https://api","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.391339Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:1a78653867e0aba1949bae891a1698ae564a37704d51bbccac0f6c4e3092740a","observation_id":"b5e26e07-0a68-4895-9fd3-995b22641daf","resolution":{"observed_at":"2026-08-02T08:43:24.391339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.603127Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.603127Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:f0175a6bbdf3f3adf211740d8c649617845dc32a1796dada832c547009233477","observation_id":"527341e2-4c8f-4fd1-b3fb-d0acedd5c2d8","resolution":{"observed_at":"2026-08-02T08:43:24.603127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.772928Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern recognition","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.772928Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:7e607ac2381e89b139c1dbd102a1f0b14bc91e674b6414306a8dba7afd180aa1","observation_id":"ba8837ef-6cb7-4cfc-ba47-25b7c7277dd2","resolution":{"observed_at":"2026-08-02T08:43:24.772928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.806854Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.806854Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:44cdf99e58911119d65516c75515a320df2fdda032674c869a9366c44f6fe6dd","observation_id":"1bd83790-9812-4c54-ba58-ed38e1ad8966","resolution":{"observed_at":"2026-08-02T08:43:24.806854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.857232Z","title":"In: proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.857232Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:38945e7b4e29afcdf05e35282607236619c100a9867eed8a770e4d14d5308ea3","observation_id":"a74db45e-b1ba-4472-8f73-3e65f592539e","resolution":{"observed_at":"2026-08-02T08:43:24.857232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.902015Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.902015Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:c72dafd8491aca1bde25b7fb3c912fe02628edfb7a9ad044801e49c502d026a0","observation_id":"fbfc575c-8d61-4b4f-9fc5-262ccdd9c996","resolution":{"observed_at":"2026-08-02T08:43:24.902015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:24.984216Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:24.984216Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:80174ef5531b7446e3a02b0d1b85ffddcee8564a7de8f437e1e1d3731902438f","observation_id":"4bbb9eaa-5b04-4ca6-9384-01f38da676e3","resolution":{"observed_at":"2026-08-02T08:43:24.984216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.057275Z","title":"Advances in neural information processing systems36, 34892–34916 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.057275Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:4cf393c24e76c184bda48a675bc2fe1cc1c67f7b196f7bd86e867e274bbf22a3","observation_id":"b4ba42d7-912a-410d-9ece-5fc5354896a5","resolution":{"observed_at":"2026-08-02T08:43:25.057275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.105252Z","title":"IEEE Transactions on Geoscience and Remote Sensing 58(12), 8555–8566 (2020) SiGMA 17","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.105252Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:a66754611ef0330911c26d08165501305f0880d38002eb7aa2aca5b87d232dfa","observation_id":"206c6c66-5b4f-45c8-b5f8-533d725468e4","resolution":{"observed_at":"2026-08-02T08:43:25.105252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.153685Z","title":"In: The Twelfth International Conference on Learning Representations (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.153685Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:2fde6417d7b6ccb8e259104380f1c807133f23d38b0e24364c664135adeec475","observation_id":"66524933-1b5e-4407-960e-5e0098c59e71","resolution":{"observed_at":"2026-08-02T08:43:25.153685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.13214","last_updated":"2022-07-25T04:05:29Z","snapshot_observed_at":"2026-08-02T20:16:21.986025Z","submitted_at":"2021-10-25T18:52:26Z","title":"IconQA: A New Benchmark for Abstract Diagram Understanding and Visual Language Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.13214","snapshot_observed_at":"2026-08-02T08:43:25.286683Z","title":"arXiv preprint arXiv:2110.13214 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.286683Z"},"links":{"cited_paper":"/paper/2110.13214","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:b8faef02d81907e58c942e3a56954bc3efb64bbb9452c413e1f2ddb0cbd7b336","observation_id":"4eebf3ef-aced-4a2a-a21a-3c9dba41ed1f","resolution":{"observed_at":"2026-08-02T08:43:25.286683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.318428Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.318428Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:8b6a01e81926bdd5fec749d3823a17961f03d2326485ecd0517d554b25a6433b","observation_id":"f272b67e-2881-49df-b695-aa203dec8faa","resolution":{"observed_at":"2026-08-02T08:43:25.318428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.360926Z","title":"In: Proceedings of the IEEE international conference on computer vision","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.360926Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:8dc0e392cef78830de48433ce022da4571af6b71bf8032db21472b7bad7f3034","observation_id":"365ab85d-4046-41e6-ac9a-67800b7dba1d","resolution":{"observed_at":"2026-08-02T08:43:25.360926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.473249Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.473249Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:57de73fe54740538c6dc293f5f4dffd20d9857ef5a5639eb4f6d35d70e781c59","observation_id":"4fdbc4e2-769c-4f09-825f-1069d44c801d","resolution":{"observed_at":"2026-08-02T08:43:25.473249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.584366Z","title":"In: International Conference on Learning Representations (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.584366Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:941b2539acfe1624481d84fc07989c8f5907fcf561056b17f3410569f62e22bc","observation_id":"b7e05e5e-8d8d-4a6b-840e-0c1c24bd798e","resolution":{"observed_at":"2026-08-02T08:43:25.584366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.611389Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.611389Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:cec0a00308776836636ead9cdef3136407e31884e091a6bff77266763a7a54df","observation_id":"49ce985a-a2f7-49af-a6d0-bfc15e076d1a","resolution":{"observed_at":"2026-08-02T08:43:25.611389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.720079Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.720079Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:4f79760a696b337a2fb2988ec9fac88a2e02a7adf0328780ce76a95958246dbd","observation_id":"43819c0b-485d-47ad-b7c2-1d383cb684e9","resolution":{"observed_at":"2026-08-02T08:43:25.720079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-02T08:43:25.838477Z","title":"arXiv preprint arXiv:2307.09288 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.838477Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:db1884d796e17e7f0dee87b4c6aeea8ccb6af8805d9dce7b1612dcfd3c8df471","observation_id":"dc3ab7cd-a7c6-44f1-9c8f-a9ca0b3c6748","resolution":{"observed_at":"2026-08-02T08:43:25.838477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:25.872043Z","title":"In: Findings of the Association for Computational Linguistics: EMNLP 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.872043Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:0caf6e671906d3ef8a498847aad49e0c206f02b6041b28850b4dcb2ae6e02f41","observation_id":"cc41ccc5-a542-49c1-be13-ee39c6a19964","resolution":{"observed_at":"2026-08-02T08:43:25.872043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01430","last_updated":"2023-07-31T07:44:15Z","snapshot_observed_at":"2026-08-10T16:53:44.955195Z","submitted_at":"2023-07-31T07:44:15Z","title":"FinVis-GPT: A Multimodal Large Language Model for Financial Chart Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01430","snapshot_observed_at":"2026-08-02T08:43:25.966057Z","title":"arXiv preprint arXiv:2308.01430 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:25.966057Z"},"links":{"cited_paper":"/paper/2308.01430","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:94328aa5e6f4f7410afebacb83e4fd71c08654423ceaddfd6c6868e7be211a1c","observation_id":"e2e6877e-b9b5-4f49-ab2c-de2f3f4c49dd","resolution":{"observed_at":"2026-08-02T08:43:25.966057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:26.019842Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:26.019842Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:a7b7a9bc60cb431b24b62502b37fe053e2d47b9c2bd75b264993e5d46c178d68","observation_id":"6052cd14-92f3-464c-87f9-0b26aa2718c1","resolution":{"observed_at":"2026-08-02T08:43:26.019842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:26.066650Z","title":"In: Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:26.066650Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:99d8fc6a029ca699a7feb5e9cc538b0658028710af726847bbf2e7df9bccdc60","observation_id":"b95ae8d1-fd27-49d0-bb23-2e26bc287c13","resolution":{"observed_at":"2026-08-02T08:43:26.066650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:43:26.127444Z","title":"arXiv preprint arXiv:2506.05453 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:26.127444Z"},"links":{"citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:67959f8182fce1e56d470928483e1af23c9695defcfca74ca928284190adb986","observation_id":"6108ddf9-d9a4-4f4d-8596-1b90b243281b","resolution":{"observed_at":"2026-08-02T08:43:26.127444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-02T08:43:26.168569Z","title":"arXiv preprint arXiv:2304.10592 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T08:43:26.168569Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2607.20511"},"observation_digest":"sha256:15667e7599f2ce47f7805d57eea4d61ad164a8d1387f603ceeb1591e5a0585a9","observation_id":"871ed918-5126-4049-945a-b7629e77c931","resolution":{"observed_at":"2026-08-02T08:43:26.168569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20511","last_updated":"2026-07-05T08:27:52Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T02:37:10.408443Z","submitted_at":"2026-07-05T08:27:52Z","title":"SiGMA: Sign-Guided Merging and Adaptation for Multimodal Continual Instruction Tuning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2607.20511."}