{"as_of":"2026-07-30T03:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1e233eef799e3ce2f960244fdb5fc1acd5ffcd62bd31983b6fc0f90de4ee594","coverage":[{"denominator":8,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:16:26.251230Z","state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-29T08:13:00.99439+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.11005/citation-record","integrity":"/paper/2604.11005/integrity","json":"/paper/2604.11005/citation-record.json","paper":"/paper/2604.11005"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.13737","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:35:39.274123Z","title":"arXiv preprint arXiv:2505.13737 , year=","venue":null,"work_id":"9bc19527-4ba2-42c7-91e8-07be89a8b006","year":2025},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:8622638ccc31a7e5bc82260c0d66c2ded683b9ba37b4143ec171eabde8a46c40","observation_id":"fdd6058c-aac5-414c-b31a-67209e6e8a73","resolution":{"observed_at":"2026-05-11T09:05:59.041211Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14880","last_updated":"2025-01-14T01:57:44Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-04-04T20:06:07Z","title":"Dissecting Query-Key Interaction in Vision Transformers","version":4},"cited_work":{"arxiv_id":"2405.14880","doi":"10.48550/arxiv.2405.14880","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14880","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"why should i trust you?","venue":null,"work_id":"964e460f-c801-4870-8fd5-a7c679d40438","year":2024},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"cited_paper":"/paper/2405.14880","citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:0aa8d1915d60447f9c482448c9595797667a86a08d606e23c92bf9b8e2c4b581","observation_id":"1887cd19-de72-411a-929b-f580392fca15","resolution":{"observed_at":"2026-05-11T09:05:59.046714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:2a9416a5b100d8ecd3dbc5f01e18501650d236eb2ea9ec5435962cfa1f0bbc07","observation_id":"9ffd4bf2-8bcf-43f6-8217-ab3c90739e1a","resolution":{"observed_at":"2026-05-11T09:05:59.031918Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15017","last_updated":"2024-12-04T09:54:59Z","snapshot_observed_at":"2026-07-06T18:49:33.987133Z","submitted_at":"2024-07-22T06:15:59Z","title":"Knowledge Mechanisms in Large Language Models: A Survey and Perspective","version":4},"cited_work":{"arxiv_id":"2407.15017","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15017","snapshot_observed_at":"2026-07-03T05:57:41.529711Z","title":"InProceed- ings of the IEEE/CVF conference on computer vision and pattern recognition workshops, pages 24–25","venue":null,"work_id":"3a916d5d-f2e3-4cbe-90e9-44f9de4ed32d","year":2024},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"cited_paper":"/paper/2407.15017","citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:1109c0d4fba84d15566edb9b9344f5533902b2253be18fdd080229183cd6f5f7","observation_id":"776d4043-f295-46fc-a41e-74903ab9247f","resolution":{"observed_at":"2026-05-11T09:05:59.054377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:0d020b1dd8f6d0e5804249f2f1bea45ed07983e333da4d1a656331880b95df8a","observation_id":"3512949d-9b34-402d-b93f-365a08edaeb7","resolution":{"observed_at":"2026-05-11T09:05:59.027297Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let a classifier be de- noted by f:X →R C, which maps an input image x∈ X to class logits y∈R C","venue":null,"work_id":"a8a1affd-38a9-41ea-b66c-c77091de5dce","year":2016},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:7c8ec065cca324ccb34ff72394b3e87bb0ca6cca1a9cdf96dcda26ca1a62bba4","observation_id":"bb62e852-7d32-4d93-94b7-7a7abefd0cd4","resolution":{"observed_at":"2026-05-17T16:11:56.279455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Describe this image in one sentence","venue":null,"work_id":"7181bdf9-6bf7-42af-8eff-e49a96d84efc","year":2021},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:d717497dfe5ea9643faec04dc7645bda191e74eb2acdecab129c1510ace18798","observation_id":"f016c3d2-32af-4717-b7fe-f16020f3e772","resolution":{"observed_at":"2026-05-17T16:11:56.285059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"linguistic economy","venue":null,"work_id":"e4da173f-c9d1-4d25-b0ff-f1209e47c38d","year":1942},"citing_paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:26.251230Z"},"links":{"citing_paper":"/paper/2604.11005"},"observation_digest":"sha256:0289fa0098ae188b02ed41eedcbfc0c535d0f30aebf629fcb39925f233ebe6ae","observation_id":"42e8f5e1-7b40-441e-80eb-30351842f682","resolution":{"observed_at":"2026-05-17T16:11:56.282219Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.11005","last_updated":"2026-04-13T05:14:18Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T05:14:18Z","title":"Diffusion-CAM: Faithful Visual Explanations for dMLLMs"},"reference_resolution":{"displayed":8,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":8},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"thesis":"As of 30 July 2026, this Paper Citation Record lists 8 of 8 outbound references and 0 inbound Pith citation observations for arXiv:2604.11005."}