{"as_of":"2026-08-06T10:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21bc9634c40f3b95da95b17c80a6fe94dbe48449287cbb1682ad5fd5caef2e44","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T22:13:22.015938Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:28:16.457842Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:28:16.754295Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2605.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12374","snapshot_observed_at":"2026-08-05T00:28:16.754295Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","venue":"cs.CV","work_id":"cd25fd86-6821-4022-9636-74bdbdc1daca","year":2026},"citing_paper":{"arxiv_id":"2608.00743","last_updated":"2026-08-01T16:27:45Z","snapshot_observed_at":"2026-08-06T10:12:12.936731Z","submitted_at":"2026-08-01T16:27:45Z","title":"LUT: Latent Utility Training for Visual Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:16.457842Z"},"links":{"cited_paper":"/paper/2605.12374","citing_paper":"/paper/2608.00743"},"observation_digest":"sha256:c18da587cea7cc5eebc3aeacd6906d483cd48d671aa9324aae6c875ba594040d","observation_id":"02be4c2c-655d-4632-b4e9-83dc11a6b19b","resolution":{"observed_at":"2026-08-05T00:28:16.806836Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.12374/citation-record","integrity":"/paper/2605.12374/integrity","json":"/paper/2605.12374/citation-record.json","paper":"/paper/2605.12374"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.282848Z","title":"Extending the same analysis to other pre-norm MLLMs is necessary before claiming cross-backbone universality","venue":null,"work_id":"c977a8f8-68bd-4fda-8676-561f04fb00be","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:0b01693a48d94e7c25cecf26b9aafa9c7389a380a5329ecdc535abe852d419b6","observation_id":"63aecf26-bfe9-4aa9-acbd-bcd60be42b6e","resolution":{"observed_at":"2026-07-07T14:43:52.284361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.285303Z","title":"Retraining prior output-as-input methods on the same 49K curated data would further separate data effects from latent-feedback design effects","venue":null,"work_id":"9c85d755-fdcc-4170-982d-754485e1d074","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:af3995cc5f344cd7ac0c9b09f32fb6c518188a6b7a94951549f13ea4e3c730e9","observation_id":"29b95761-43c7-424a-8cf2-e7cfedf7550d","resolution":{"observed_at":"2026-07-07T14:43:52.286623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.271086Z","title":null,"venue":null,"work_id":"52da9cbd-5ec1-4939-b7fe-7531e04745d5","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:016fad03bb7cbfbc52fcf35181e484f048f31f2fa8ac180a07f317a195e8e726","observation_id":"045a9bed-65cf-4efa-a503-1d5df56d2bf5","resolution":{"observed_at":"2026-07-07T14:43:52.271982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.279335Z","title":"Section D adds a component-count sweep, but random-basis, no-mean, and matched-parameter full-head controls remain incomplete","venue":null,"work_id":"01cd5693-815c-4719-b7b1-2559a4457071","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:3aff5c79f2444c3d5e7b8e6e48869938b53cb1cab1c47c8475f3199e39cb9a4b","observation_id":"d11169a0-1a62-4fa4-8734-e725d260f1db","resolution":{"observed_at":"2026-07-07T14:43:52.280573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.287174Z","title":"Stronger parser-latent faithfulness tests are left for future work","venue":null,"work_id":"7d960e99-442e-4adf-842c-be067b26bd81","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:44f809d6eee01c23469a10e8d510d5bcf53c0b5d0bddc895fcda0bc9707a5ade","observation_id":"f4746b9f-0020-44bd-8e5a-575538d49f73","resolution":{"observed_at":"2026-07-07T14:43:52.288411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.277684Z","title":null,"venue":null,"work_id":"3c041482-3adc-4cc0-9b3f-2ac340912691","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:b5557aa321f7b7a1ef2a43c5d412cd7c64e82c5f558db5927131ac5ca3692407","observation_id":"c00c0b22-a9dc-4f4e-ac7b-33e0766405f6","resolution":{"observed_at":"2026-07-07T14:43:52.278753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.267581Z","title":"How many bricks are missing in the wall?","venue":null,"work_id":"722cc130-8c8c-4647-82ca-ff4480d3b8f5","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:10cf3059c598a69a5c9a727efaa6a0dac33b87a2084cef67a72f4ab5c7ec6ac3","observation_id":"37fa57a4-7d0e-468c-867d-8c206d579d16","resolution":{"observed_at":"2026-07-07T14:43:52.268827Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.274152Z","title":null,"venue":null,"work_id":"d876462f-f398-4201-b33e-d1b0bb81648a","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:56e6e258bc357305990b59966e113a11acc8d066b93bf3fa7eabf18e31128e0f","observation_id":"668ce728-7afb-493e-9386-6386dfed5967","resolution":{"observed_at":"2026-07-07T14:43:52.277093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.281333Z","title":null,"venue":null,"work_id":"b79ddb1f-0dba-40cc-9a48-b25b18b4b9bc","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:a25999cc64eee93a8dae3a6b6d7abf8b73234538d3f1be9bc073e386e80cd3a8","observation_id":"4b55c07f-b144-455a-97a2-7210e267953a","resolution":{"observed_at":"2026-07-07T14:43:52.282366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.269352Z","title":"By the angle bisector theorem, the ratio of the segments created by the angle bisector is equal to the ratio of the other two sides","venue":null,"work_id":"ce346d3e-9d8f-40b4-b5df-3371d3660cb4","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:f1a8cd161b56f1220b35d5291518cdb622dc4ccfbd4cc22fbc32540f28be71d2","observation_id":"d34fede7-e70d-4c15-ab19-743a3e1ac1a2","resolution":{"observed_at":"2026-07-07T14:43:52.270539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.272445Z","title":"According to the angle bisector theorem, 𝐷𝐸 𝐴𝐸 = 𝐶 𝐷 𝐴𝐵","venue":null,"work_id":"7ef8ead7-8949-4f12-9a53-f76da86383a0","year":null},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T22:13:22.015938Z"},"links":{"citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:0ef225976cf01c5b26cdf382d2ec4c5fd18fd5b9e883580f513c919e8c978cba","observation_id":"3ef2c7a2-2080-48f3-a01b-8179bc1b4248","resolution":{"observed_at":"2026-07-07T14:43:52.273652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 1 inbound Pith citation observation for arXiv:2605.12374."}