{"as_of":"2026-08-08T23:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:81acacffd70aaf3f7728a282ead66657e205b3b787dbccfae53ac87894aa6fd5","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:39:07.976373Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:51:46.051954Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T05:49:36.597322Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"cited_work":{"arxiv_id":"2507.08064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08064","snapshot_observed_at":"2026-07-04T05:49:36.597322Z","title":"Lamra: Large multimodal model as your advanced retrieval assistant","venue":"cs.MM","work_id":"284dcbc6-beb2-4d6a-9efe-5bb7f782457c","year":2025},"citing_paper":{"arxiv_id":"2509.24621","last_updated":"2026-05-25T10:53:36Z","snapshot_observed_at":"2026-08-08T21:41:13.842209Z","submitted_at":"2025-09-29T11:28:42Z","title":"FreeRet: MLLMs as Training-Free Retrievers","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T13:00:31.952588Z"},"links":{"cited_paper":"/paper/2507.08064","citing_paper":"/paper/2509.24621"},"observation_digest":"sha256:fd27f1da066a2e21ef7693b880d9c22182fb99eae60dc1721c25636eaf2c34ea","observation_id":"e8f2e695-f1a0-4b73-a34b-fea32747b5f7","resolution":{"observed_at":"2026-06-02T04:04:24.233400Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.08064","snapshot_observed_at":"2026-08-04T13:51:46.051954Z","title":"Lamra: Large multimodal model as your advanced retrieval assistant","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24621","last_updated":"2026-05-25T10:53:36Z","snapshot_observed_at":"2026-08-08T21:41:13.842209Z","submitted_at":"2025-09-29T11:28:42Z","title":"FreeRet: MLLMs as Training-Free Retrievers","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.051954Z"},"links":{"cited_paper":"/paper/2507.08064","citing_paper":"/paper/2509.24621"},"observation_digest":"sha256:f10b80e5fc614fc05f6015158b79f3bf995aa6aaeed38d2316a9e0fb34351f45","observation_id":"2c283fa7-683b-44cf-b708-c95e3bc8b952","resolution":{"observed_at":"2026-08-04T13:51:46.051954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"cited_work":{"arxiv_id":"2507.08064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08064","snapshot_observed_at":"2026-07-04T05:49:36.597322Z","title":"Lamra: Large multimodal model as your advanced retrieval assistant","venue":"cs.MM","work_id":"284dcbc6-beb2-4d6a-9efe-5bb7f782457c","year":2025},"citing_paper":{"arxiv_id":"2606.20280","last_updated":"2026-07-04T09:32:50Z","snapshot_observed_at":"2026-07-12T13:16:44.503259Z","submitted_at":"2026-06-18T14:23:23Z","title":"ELVA: Exploring Ranking-Driven Universal Multimodal Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T15:34:55.062016Z"},"links":{"cited_paper":"/paper/2507.08064","citing_paper":"/paper/2606.20280"},"observation_digest":"sha256:c1235b11757a270c65b0f1c618c8dcf4a98d96235468c2f535de6a20c145bb2d","observation_id":"4063b479-e973-4976-b89d-c9ff72f4afb2","resolution":{"observed_at":"2026-07-04T05:49:36.599478Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08064/citation-record","integrity":"/paper/2507.08064/integrity","json":"/paper/2507.08064/citation-record.json","paper":"/paper/2507.08064"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:18.564431Z","title":null,"venue":null,"work_id":"656908ab-04a9-49f1-b3ad-37db4bb80205","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:58.653660Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:4a7ad57013193c0d9b9baeff8cd9b0ab80a835cdd0b844249bb1239972ebca78","observation_id":"b434ceaf-0c66-4fbd-9f8d-78fa0f76c0fb","resolution":{"observed_at":"2026-08-06T18:39:18.666013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:18.402957Z","title":null,"venue":null,"work_id":"b4173198-66db-47ec-9487-b90c20e1c218","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:58.730940Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:c4c8226615b62c2863ea302dae8bd36bb2f78e7d32eeca530fc3c46d67c1a422","observation_id":"5be539f8-d800-476e-8261-e3940899ee6f","resolution":{"observed_at":"2026-08-06T18:39:18.466240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.01152","last_updated":"2021-07-02T15:50:43Z","snapshot_observed_at":"2026-07-06T11:25:29.232817Z","submitted_at":"2021-07-02T15:50:43Z","title":"Simpler, Faster, Stronger: Breaking The log-K Curse On Contrastive Learners With FlatNCE","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.01152","snapshot_observed_at":"2026-08-06T18:38:58.838494Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:58.838494Z"},"links":{"cited_paper":"/paper/2107.01152","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:e9753e38dbdb4326ce3aca18763a025ebefe03bd73f74943c316a418d8ef41fb","observation_id":"1ce6fe69-5fe2-48d3-b97e-06bc40f37ef4","resolution":{"observed_at":"2026-08-06T18:38:58.838494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:38:58.946730Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:58.946730Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:893bab1b5912ec6561ef7d4f475e03e5efb13521f0c9272a94ffcbc15e40727c","observation_id":"f30fcd25-6dd1-41a5-801a-0ef090b32bbd","resolution":{"observed_at":"2026-08-06T18:38:58.946730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:38:59.182251Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.182251Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:2a451bbfe225769664a4cc0cd190a9e1d0ac5e33041e102f507fe11cdb66e424","observation_id":"0451eaa3-72f5-46de-aec9-60f437b41e06","resolution":{"observed_at":"2026-08-06T18:38:59.182251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:38:59.287928Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.287928Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:f3cd213957b8a389c0e1c636dc325c0c63c9c8bf304c6e5a8d211dd98ae42989","observation_id":"68e4cecd-48d4-4643-826d-914c57890f4d","resolution":{"observed_at":"2026-08-06T18:38:59.287928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:38:59.460459Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.460459Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:4e5a3b74cb86e0c8b0a395948b499fc972ae1935d0baba3cc1a8201b7b6b6bb2","observation_id":"b3d81001-1e1c-4b1e-9a5d-e288c53704b7","resolution":{"observed_at":"2026-08-06T18:38:59.460459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18570","last_updated":"2024-06-06T20:29:21Z","snapshot_observed_at":"2026-07-06T18:21:35.476139Z","submitted_at":"2024-05-28T20:28:07Z","title":"It's Not a Modality Gap: Characterizing and Addressing the Contrastive Gap","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18570","snapshot_observed_at":"2026-08-06T18:38:59.598360Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.598360Z"},"links":{"cited_paper":"/paper/2405.18570","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:300ed5dc24d0c4c7f15a5d22ef7598a473d50ff80a7a711a4cf957f004cfbae3","observation_id":"1807116d-86de-461f-b148-6c2dd650472d","resolution":{"observed_at":"2026-08-06T18:38:59.598360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02181","last_updated":"2024-07-09T11:59:01Z","snapshot_observed_at":"2026-07-06T17:39:16.540553Z","submitted_at":"2024-03-04T16:23:58Z","title":"Not All Layers of LLMs Are Necessary During Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02181","snapshot_observed_at":"2026-08-06T18:38:59.698293Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.698293Z"},"links":{"cited_paper":"/paper/2403.02181","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:316248cfb6fc1021a21e73bcf437c0b548b2dd4db76bd5f7b9993fc73fc9093c","observation_id":"efce8ef1-28f1-416c-b1fe-982961308b2c","resolution":{"observed_at":"2026-08-06T18:38:59.698293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14578","last_updated":"2024-10-18T16:26:45Z","snapshot_observed_at":"2026-08-05T05:12:00.907040Z","submitted_at":"2024-10-18T16:26:45Z","title":"Large Language Models Are Overparameterized Text Encoders","version":1},"cited_work":{"arxiv_id":"2410.14578","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.14578","snapshot_observed_at":"2026-08-06T18:39:11.065979Z","title":"Large Language Models Are Overparameterized Text Encoders","venue":"cs.CL","work_id":"9baeed75-cca2-4818-9fc6-61cfe7a5cbe7","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.859206Z"},"links":{"cited_paper":"/paper/2410.14578","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:7e1d0698e0a94edf959ed8652db017bbcf2704b489d589ae2d32d4e6f8ff1366","observation_id":"0db4c401-19d1-49e8-aa46-6698d8ac62d5","resolution":{"observed_at":"2026-08-06T18:39:11.192948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:18.201148Z","title":null,"venue":null,"work_id":"f50d7669-e659-4087-a0c0-d9b3c47b75ce","year":2021},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.011222Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:4e60edcac200d0a424fe7b36577fd8e3a8de919bec29a71a29d052fb5c635755","observation_id":"102de4e3-cd38-4145-bcd3-7de0a4c0da25","resolution":{"observed_at":"2026-08-06T18:39:18.269444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:39:00.149318Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.149318Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:6508af0d3bd7089cec52b1b283b31d6d80ae6ba69f8417bfc9a4074a915df234","observation_id":"e293bd62-5062-4e20-a5d0-b5b6017fd96c","resolution":{"observed_at":"2026-08-06T18:39:00.149318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:18.028482Z","title":null,"venue":null,"work_id":"b9e828dc-46ed-4bed-97a7-205e213102c9","year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.272749Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:1f65ac5b5ca1033f2e715babef86d306513938aac65842f0933d9b6a2a3177c0","observation_id":"37aa5eb1-7725-4025-83ef-67db8b855ccd","resolution":{"observed_at":"2026-08-06T18:39:18.087323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:17.854123Z","title":null,"venue":null,"work_id":"0bd9eb19-0534-46c3-a112-053d4d645df2","year":2020},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.642317Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:2759c88e3502e27c9537337e78da4e1f63230d262e7c6adff167ed5bbf77b992","observation_id":"6487d5f9-7d60-4987-8467-bb0237be3320","resolution":{"observed_at":"2026-08-06T18:39:17.937680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-03T06:33:46.668360Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-06T18:39:00.502583Z","title":"org/abs/2403.17887 ([n","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.502583Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:a650f60ce6eb5f39e10a0876c42d29c06e108606dd07305d2f948222a235e5cd","observation_id":"4779f547-3305-4fa8-922a-a5d87963794a","resolution":{"observed_at":"2026-08-06T18:39:00.502583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:17.640319Z","title":null,"venue":null,"work_id":"f48c1399-b6fe-419c-a22c-6aa656022389","year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.945247Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:ca5252c542b7ae8a9c8d3a329e6f176aaa5279d3cae00973b59d195df6a371d7","observation_id":"959cc486-60e5-4b7f-8736-1d0c4f33faf8","resolution":{"observed_at":"2026-08-06T18:39:17.713882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:00.782461Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:00.782461Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:7e9dc8d48c0299a09ac95bc11cedfd66b85f860a72b725334c58538a7e924819","observation_id":"ecfc61d9-b130-44d4-bfdc-51e8f2cc4b31","resolution":{"observed_at":"2026-08-06T18:39:00.782461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:01.228367Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.228367Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:bd90a0f0fcd9fca4d03d4d265f0c27de1efcbb2a102aed0c97fedc743a2694ae","observation_id":"0bcfcdff-72fc-495e-a819-cce48ffeb89b","resolution":{"observed_at":"2026-08-06T18:39:01.228367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20008","last_updated":"2025-02-27T11:41:55Z","snapshot_observed_at":"2026-08-07T17:43:11.140465Z","submitted_at":"2025-02-27T11:41:55Z","title":"Joint Fusion and Encoding: Advancing Multimodal Retrieval from the Ground Up","version":1},"cited_work":{"arxiv_id":"2502.20008","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.20008","snapshot_observed_at":"2026-08-06T18:39:09.548377Z","title":"Joint Fusion and Encoding: Advancing Multimodal Retrieval from the Ground Up","venue":"cs.CV","work_id":"db981e29-41da-4854-8325-461a9e7fa00f","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.070939Z"},"links":{"cited_paper":"/paper/2502.20008","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:81ebd09fc24588dad2c5c482a00fb950a728cde14391240f91b0e75694b4d531","observation_id":"5d1d25e0-ef6a-4b2e-8a3a-e1587d0e8c5e","resolution":{"observed_at":"2026-08-06T18:39:10.785251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12580","last_updated":"2024-07-17T14:04:12Z","snapshot_observed_at":"2026-08-05T07:40:31.916436Z","submitted_at":"2024-07-17T14:04:12Z","title":"E5-V: Universal Embeddings with Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12580","snapshot_observed_at":"2026-08-06T18:39:01.529178Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.529178Z"},"links":{"cited_paper":"/paper/2407.12580","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:e39c56574fe75df77def65db31e3e3b94b0629e7318c8ad401ec49bea5e7220c","observation_id":"709b55df-0c93-403a-87c3-3d5eca919da0","resolution":{"observed_at":"2026-08-06T18:39:01.529178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T18:39:01.391567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.391567Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:1faa6c2c788b55a766cf354f8e323ed42c573242ebece70bb5a19bf3799cd888","observation_id":"84a17aab-f0a3-4424-892f-6755fe77c815","resolution":{"observed_at":"2026-08-06T18:39:01.391567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:17.368787Z","title":null,"venue":null,"work_id":"a8c73e6d-3ad0-4417-a663-07361ad8c315","year":2020},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.743496Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:6d62ea3f0ea29096fc27cfa3939ce7c7518fb81b3f92133203bd248ad2f329e9","observation_id":"1968173e-6243-44fa-9347-acf90a4ee937","resolution":{"observed_at":"2026-08-06T18:39:17.483832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17491","last_updated":"2024-11-26T14:59:06Z","snapshot_observed_at":"2026-07-06T19:57:18.481261Z","submitted_at":"2024-11-26T14:59:06Z","title":"What's in the Image? A Deep-Dive into the Vision of Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17491","snapshot_observed_at":"2026-08-06T18:39:01.636238Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.636238Z"},"links":{"cited_paper":"/paper/2411.17491","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:7d356dab31228d1f540899c1ab495e1b2356bf532377755e118f05bb907cedd4","observation_id":"fd8974b9-4d49-436a-8611-a22b476e4d89","resolution":{"observed_at":"2026-08-06T18:39:01.636238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T18:39:02.002954Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.002954Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:3a6aa17c7f5b72cf7644f35e165ce9b5f3efe2303ccd3fcc9d4fb644f7d093b2","observation_id":"59d7727e-02e4-4c88-93cb-62449d083700","resolution":{"observed_at":"2026-08-06T18:39:02.002954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:17.131336Z","title":null,"venue":null,"work_id":"db7e080e-4095-4a5b-8af6-1dd106a6558b","year":2018},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:01.856244Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:56fa8bf59d040ab1b9580fd04caa747c674422204de2a439678dcc39caa242ac","observation_id":"effd8f7e-5f7b-4d1b-bfe7-bb8bd24f1166","resolution":{"observed_at":"2026-08-06T18:39:17.251664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:02.292489Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.292489Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:d7c24270debe410258f4c77d2aaac57de8a66a6c1ecd15dcab3fa18c116b5947","observation_id":"5d01a507-42b0-4e13-ba57-074f56cecc2e","resolution":{"observed_at":"2026-08-06T18:39:02.292489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:16.880001Z","title":null,"venue":null,"work_id":"9acf8fb1-6833-4015-833b-bb7b04cc6dff","year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.150966Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:35e05749be584ebf20e4a817711eac9ce39f12c309eca29ce38f3309d08aca7a","observation_id":"36da6f23-aaa0-464b-a447-57bceb1f859d","resolution":{"observed_at":"2026-08-06T18:39:16.988026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:02.552669Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.552669Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:06dd85cba78f457a98681462c7944901073bb5933ffffce3641c0474c06b276f","observation_id":"f9254666-418a-44de-a4a9-4c961729e4e9","resolution":{"observed_at":"2026-08-06T18:39:02.552669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:02.413507Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.413507Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:045c1cffc321f0a2ec1d83b28772ef4c1fdd1f2ae47faf51d8d56bb9571277d5","observation_id":"8074b7f6-b5a9-45e4-a980-8336b2386348","resolution":{"observed_at":"2026-08-06T18:39:02.413507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:02.858286Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.858286Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:3252bdac05a9f393960511b58dc57769141ae7c60a3a3e3ae224d54be6c8d6ec","observation_id":"c96bb9c9-5817-43fb-8147-49f59ca5d4a8","resolution":{"observed_at":"2026-08-06T18:39:02.858286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:16.645949Z","title":null,"venue":null,"work_id":"8019ae4f-e7a3-4d51-9480-8c249836210c","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.717253Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:1685066ae469dd06707582e0f901bda81dd8f80addbfa98a25b48b9f8ba34874","observation_id":"97cd7a66-6b5b-4379-aaba-f1e864c4d180","resolution":{"observed_at":"2026-08-06T18:39:16.720720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:16.289688Z","title":null,"venue":null,"work_id":"34c078fc-7ed4-4af4-a0be-dd92a2b7d620","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.079608Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:f1c3f73b515d1b17b8f8d1666fe2cef7e417279d744d38e19494a3df0f481e0a","observation_id":"c7c209f5-7532-4f24-9787-925a67454fde","resolution":{"observed_at":"2026-08-06T18:39:16.367283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:16.482321Z","title":null,"venue":null,"work_id":"838720fa-92f4-4b01-b727-f03b89a5059e","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:02.944579Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:4d6f2fac944426b367d6dc0625e1078530565ca1bf0798e013e67df49c14b63f","observation_id":"1318a1b4-2bdf-447b-808a-085cb6383786","resolution":{"observed_at":"2026-08-06T18:39:16.556061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:16.070273Z","title":null,"venue":null,"work_id":"1a2d28da-9199-4272-b9b9-a1a3d0bc98a1","year":2022},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.227482Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:5f7f50ecfd5c4baf28146674a964c95505176df2e8cdfc81283a11f9aaa1ab4c","observation_id":"7096dcb3-44d9-41c9-8569-cf7f104b046a","resolution":{"observed_at":"2026-08-06T18:39:16.174928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03281","last_updated":"2023-08-07T03:52:59Z","snapshot_observed_at":"2026-08-04T23:10:23.964516Z","submitted_at":"2023-08-07T03:52:59Z","title":"Towards General Text Embeddings with Multi-stage Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03281","snapshot_observed_at":"2026-08-06T18:39:03.166151Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.166151Z"},"links":{"cited_paper":"/paper/2308.03281","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:1bf12204398497b2279a58de35fdce4e419c23475e37a6c01c4532e94a63198d","observation_id":"268da76d-266d-4eb3-96e6-4f1f663971a5","resolution":{"observed_at":"2026-08-06T18:39:03.166151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:03.480728Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.480728Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:c55470ec800cecfb5305e38dc442bf5fce343abff0961e07701214af8ad077da","observation_id":"e1d52031-07a5-4fd9-b3c6-c89f9c4ad633","resolution":{"observed_at":"2026-08-06T18:39:03.480728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:15.836319Z","title":null,"venue":null,"work_id":"ccb9b9c7-1664-4c80-b3de-cb6fdcdcf94c","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.362707Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:1987fca91a73d3e251564fbc06967d4607d9900d9d9dae4a4646536899d0bd88","observation_id":"c91794b8-94f6-4dd8-8c99-c148b2e2b21d","resolution":{"observed_at":"2026-08-06T18:39:15.920326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:03.761391Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.761391Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:9755443c7f0ac9628a8e85667cb0bf01f4ffdebba804f63046e0771a4b55da17","observation_id":"0c349e22-4008-4065-87f2-457d5db4dd3b","resolution":{"observed_at":"2026-08-06T18:39:03.761391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:15.642981Z","title":null,"venue":null,"work_id":"5b3434d5-29f0-4ff4-b0e9-5c5338edcfbd","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.602016Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:0986facc30fbf32fd80323d7f13ff607dc1a0b03ab651836bee959b588383153","observation_id":"4fdf4cdb-533d-4480-ba97-6bf0f9bbe435","resolution":{"observed_at":"2026-08-06T18:39:15.731517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:15.372305Z","title":null,"venue":null,"work_id":"41e4abe6-f4e7-4f63-9a46-aeac48d9e16a","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.002658Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:5cd767e8de58c3054eb40fed7bc83c829300d07126c8e30e908dafabebf9a3c3","observation_id":"82c9b19d-a03f-4683-80a2-0a2fe4a89f73","resolution":{"observed_at":"2026-08-06T18:39:15.482630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:03.910514Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:03.910514Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:5bb640312439cc14d32f0ee08a05b970b7c2803763655e34307118302fdb95ca","observation_id":"b52c4b85-c9d8-4666-b1d7-0af956122713","resolution":{"observed_at":"2026-08-06T18:39:03.910514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:15.125978Z","title":null,"venue":null,"work_id":"2f63bbc5-4582-4924-8475-580f33f7f81a","year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.197334Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:ff1b5d634111de6a6c974d72f0c897b2942a8092123943fde3d812575202a210","observation_id":"42888e08-05a5-4264-897a-a1a1cafb7636","resolution":{"observed_at":"2026-08-06T18:39:15.209787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:04.109406Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.109406Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:bf6c2d3232a0f97b838a7106eb6b9f7277eb5e71856843585529c81606507fa6","observation_id":"51d76f73-2115-49c5-bfa0-6aceae9f2a1f","resolution":{"observed_at":"2026-08-06T18:39:04.109406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:14.986251Z","title":null,"venue":null,"work_id":"a2f93503-dccf-4735-bca7-fa383140c19b","year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.360335Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:97e6eb13ce4476c28a03dea026f73762b78c06210ceb3b03feebc638f84870ac","observation_id":"01c14683-5ce7-4cad-93b4-d0d09edc473d","resolution":{"observed_at":"2026-08-06T18:39:15.015025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T18:39:04.265969Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.265969Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:c5c07012e72da6929fffd518beb81b598d6da1aa900ae97427e152aca4009dea","observation_id":"81a27b5d-0063-4120-bb8c-6e6c0b099401","resolution":{"observed_at":"2026-08-06T18:39:04.265969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:14.721772Z","title":null,"venue":null,"work_id":"41fa6e9b-5e19-4aea-8333-428f3ddc1ef5","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.568793Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:51f7e54de0aa78f4d7373781b72706e41084a42e1755059480f45dd599b4b33e","observation_id":"e039054c-65cd-48d5-a109-58d7fd2c9a3a","resolution":{"observed_at":"2026-08-06T18:39:14.858049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:04.427903Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.427903Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:6ffa34d8197898b470a19773b67060c24164b58a8c0220ce1e539f4ba35dfb24","observation_id":"c26ec25e-baee-4097-8add-da14deee70d0","resolution":{"observed_at":"2026-08-06T18:39:04.427903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:14.431894Z","title":null,"venue":null,"work_id":"41581679-5c74-429f-835d-edd6c99d1165","year":2021},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.025892Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:6d97f4a41664e274bc00bc9c342454ae24e34ea6637b25caab35f1b1b4fac0ae","observation_id":"c260dafe-7de1-4ab1-84c3-c93af749a8d0","resolution":{"observed_at":"2026-08-06T18:39:14.544816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:04.743209Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.743209Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:0093f926ce739b18f580944a234d0219266b81be747f6d8fc19f322789e5bcf2","observation_id":"0070b075-933f-4a07-8d8c-2bc59f815a3d","resolution":{"observed_at":"2026-08-06T18:39:04.743209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-06T18:39:05.282745Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.282745Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:855ff8a22d1a3bdc8c650fb609119b6d480da05b0dced9fe5a9a6ab928f317fa","observation_id":"eb9ee77b-de7d-4771-a26c-105af8a33424","resolution":{"observed_at":"2026-08-06T18:39:05.282745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-07-06T20:08:56.278699Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13435","snapshot_observed_at":"2026-08-06T18:39:05.411301Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.411301Z"},"links":{"cited_paper":"/paper/2412.13435","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:96273d7de08d7765eb37629cae565d40e273ab80112fbc115728500acb921fe2","observation_id":"476a462b-a819-46aa-a5cd-fd0632411bc6","resolution":{"observed_at":"2026-08-06T18:39:05.411301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03703","last_updated":"2025-05-06T17:24:41Z","snapshot_observed_at":"2026-08-07T15:49:26.020500Z","submitted_at":"2025-05-06T17:24:41Z","title":"Fill the Gap: Quantifying and Reducing the Modality Gap in Image-Text Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03703","snapshot_observed_at":"2026-08-06T18:39:05.154618Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.154618Z"},"links":{"cited_paper":"/paper/2505.03703","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:3d5222196b220a0d87c7a6b95e3edcdb58f365fe0ac84670cb5080edac80dec8","observation_id":"54cde237-0bc4-4ebc-acaf-e3f5582b2e54","resolution":{"observed_at":"2026-08-06T18:39:05.154618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:14.179896Z","title":null,"venue":null,"work_id":"c6aebbf1-292c-43b2-9414-8d4c331ccca2","year":2019},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.679917Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:245aad9af73b85fccece3b857a58d38f62beb9dd26d60f18693ddda9901d2682","observation_id":"f598a98a-bc62-4f64-a378-cb9d6bf9df7f","resolution":{"observed_at":"2026-08-06T18:39:14.286755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:13.917412Z","title":null,"venue":null,"work_id":"9197760b-5c4f-41aa-a700-5d674231e1ba","year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.813186Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:92b963a70abc14308e68c9dab3237f0c283ef9a1fdfc3bfbad6106a1cf0e1c23","observation_id":"3f9dd856-e2ad-47aa-85bd-6ed5c4d2fc44","resolution":{"observed_at":"2026-08-06T18:39:14.022870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:05.548145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.548145Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:41d29500075c82c916147732bcba2cec8b20c095268737f819bb22dde8195f9f","observation_id":"5ce7ac65-9e06-4bdd-9fc4-935008496e78","resolution":{"observed_at":"2026-08-06T18:39:05.548145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:13.475657Z","title":null,"venue":null,"work_id":"19bc0bf6-ff42-485c-8084-70c5476642ff","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.039918Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:7334747746419f99de80239e5c1d0dcf399cfc75df716218f01226ca38edd25e","observation_id":"7a3a5848-a017-424c-9771-1b65a0f9a024","resolution":{"observed_at":"2026-08-06T18:39:13.584664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T18:39:06.161928Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.161928Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:f76b6555214a99617b04079f273f8c6019803103c7bf6f0fe9e7d8842746a37b","observation_id":"42251750-148e-4975-a64d-da64df71dc12","resolution":{"observed_at":"2026-08-06T18:39:06.161928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:13.709106Z","title":null,"venue":null,"work_id":"82a1e431-e1dc-4ee0-813d-cddc75fd5113","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.935322Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:f6e563d782314a6623023f3cb886080e8b94003fbd84e28955b9c21249c710bb","observation_id":"c8374806-0281-4bdd-8c53-9682d24382c9","resolution":{"observed_at":"2026-08-06T18:39:13.798545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:39:06.374837Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.374837Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:08869a6bc536fe9bd2093c8ec9e2da70f4bd54fa5107dc947c4ad6ad7e48241b","observation_id":"7c57918c-25fa-40d5-8106-0b11c9c7654e","resolution":{"observed_at":"2026-08-06T18:39:06.374837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:13.015860Z","title":null,"venue":null,"work_id":"527ddf81-2271-49f9-9cfb-ccc9d86d060d","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.477057Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:dc7c38810631d78c37c91ee9ca72d342489630dced85e570fbf3f3b13c5e8de2","observation_id":"df2e1663-d6cf-4360-a76e-9cead43d5e5e","resolution":{"observed_at":"2026-08-06T18:39:13.123939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:13.225587Z","title":null,"venue":null,"work_id":"8a965f94-498b-475b-b954-77533e2077b6","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.278475Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:bab1f4fb25a19cb88e28269c9317254b911d51031f091b45043d2099ca1553b8","observation_id":"18177e43-c166-4574-94b5-2be453a453c6","resolution":{"observed_at":"2026-08-06T18:39:13.344656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:12.740254Z","title":null,"venue":null,"work_id":"ad34dd86-4248-4011-a680-cbbe2d164d92","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.703368Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:c4811cee300021efe011b956c02e80d4fb4c2b8c5c7a0c9114c59695f7d23f47","observation_id":"f948eb0e-e82a-4340-a3ef-dbeaba221f4d","resolution":{"observed_at":"2026-08-06T18:39:12.866309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:12.498516Z","title":null,"venue":null,"work_id":"6b523adb-aa12-4c41-be9e-e788e74c4c03","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.831292Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:e0c74547169e65c4158205619489416ad927efcf8eb86b5ed8aaa3db61e2f53e","observation_id":"602b7e49-45c2-42be-8d1b-f308c9bc1fa9","resolution":{"observed_at":"2026-08-06T18:39:12.607961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14072","last_updated":"2024-10-17T22:45:13Z","snapshot_observed_at":"2026-08-01T18:36:22.499708Z","submitted_at":"2024-10-17T22:45:13Z","title":"Efficient Vision-Language Models by Summarizing Visual Tokens into Compact Registers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14072","snapshot_observed_at":"2026-08-06T18:39:06.590851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.590851Z"},"links":{"cited_paper":"/paper/2410.14072","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:3f357e261718db43cf8b9420d90cebba9e3f751dfeb869fe065686e19faaa026","observation_id":"cc86dd3a-0cd2-4c62-9ca1-94c6bc54c6a6","resolution":{"observed_at":"2026-08-06T18:39:06.590851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:12.264724Z","title":null,"venue":null,"work_id":"88eacdd9-24d4-4eb6-ac12-c6860fd1fcf4","year":2023},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.191828Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:55af6b1947d88d3096c63617ea6f0692d4337e0c2ccfe4561b5ca6991d259957","observation_id":"70dc836b-1bf7-40e0-a47c-645f101b3d11","resolution":{"observed_at":"2026-08-06T18:39:12.364550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14439","last_updated":"2024-07-19T16:11:15Z","snapshot_observed_at":"2026-08-07T08:50:49.699503Z","submitted_at":"2024-07-19T16:11:15Z","title":"Token-level Correlation-guided Compression for Efficient Multimodal Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14439","snapshot_observed_at":"2026-08-06T18:39:07.316277Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.316277Z"},"links":{"cited_paper":"/paper/2407.14439","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:4f739bd164e9349717a122678335e8ddc713d48a09a77366cdeb857136f895b2","observation_id":"455e88a4-ecc0-4d36-827f-c603feca1362","resolution":{"observed_at":"2026-08-06T18:39:07.316277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:06.940330Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:06.940330Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:dffabc2d45cafacf3778a9cbea92059a4264f9017a20d1dc9b31d8edb92ee1d2","observation_id":"b080fb93-d383-48a7-8fce-e3da73355c36","resolution":{"observed_at":"2026-08-06T18:39:06.940330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12275","last_updated":"2025-03-03T09:05:52Z","snapshot_observed_at":"2026-07-06T18:32:44.452493Z","submitted_at":"2024-06-18T05:05:12Z","title":"VoCo-LLaMA: Towards Vision Compression with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12275","snapshot_observed_at":"2026-08-06T18:39:07.070965Z","title":"arXiv preprint arXiv:2406.12275 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.070965Z"},"links":{"cited_paper":"/paper/2406.12275","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:33749368cabcccd7008e9d4c8f377b40e8cdd4f7cc096a434c7adc6d7b6d35cd","observation_id":"451ae934-c65c-42c8-9c5d-bad3c4c82881","resolution":{"observed_at":"2026-08-06T18:39:07.070965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:11.860236Z","title":null,"venue":null,"work_id":"646464cd-6f51-4c0d-9eda-74803a2f0889","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.714014Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:f8b3bbbedf744f521e4a41e3de3f3c67de35f9761a1dc318ffeee4d1d56c7693","observation_id":"6d60e715-e826-461c-bd06-3d3f3ad44554","resolution":{"observed_at":"2026-08-06T18:39:11.913755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:11.643589Z","title":null,"venue":null,"work_id":"98a5df00-28a3-4191-a618-033332f999d0","year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.838054Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:b4ab772ab74e1f0dab55c73d9e86d0023cef14b32b0de4b427f6846a762564d3","observation_id":"bb0a81c2-c2f7-4da4-9b5d-13d85ed729f0","resolution":{"observed_at":"2026-08-06T18:39:11.739602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:12.054212Z","title":null,"venue":null,"work_id":"2b9200ef-1e07-4850-b782-1c9c505bda28","year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.424243Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:fac56ad0a281ef9fa85bb5ad1708c8904b47f942a036b1669546b4d864268a6d","observation_id":"3e2a0dd8-9541-4e23-9359-f624e81aeb3d","resolution":{"observed_at":"2026-08-06T18:39:12.160472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03895","last_updated":"2025-03-02T15:55:07Z","snapshot_observed_at":"2026-07-06T20:17:43.203959Z","submitted_at":"2025-01-07T16:03:14Z","title":"LLaVA-Mini: Efficient Image and Video Large Multimodal Models with One Vision Token","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03895","snapshot_observed_at":"2026-08-06T18:39:07.591851Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.591851Z"},"links":{"cited_paper":"/paper/2501.03895","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:c9cfb60cfc3fd93343d9f3aa75575690f5866b34672b45cbfd09bf491ed072b8","observation_id":"a9433110-79f7-4096-895e-e2f652542aaa","resolution":{"observed_at":"2026-08-06T18:39:07.591851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:11.471009Z","title":null,"venue":null,"work_id":"f67bb7b8-5e72-4fa2-98c3-f0dcc52ec3b1","year":2018},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:07.976373Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:d25096211eb034c3b01161d57f2e0a0a34e7a05ae276171635136e419f7cd833","observation_id":"9f52d83f-d128-42ae-b796-6b67f7c34d49","resolution":{"observed_at":"2026-08-06T18:39:11.530078Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:39:04.874891Z","title":"In International conference on machine learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:04.874891Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:f6a174a502e93e75233687441a238bf3a9f8e5b4cd3d9641db222255d1553a8f","observation_id":"814cafe6-636b-4fae-8cf2-841e46b9097c","resolution":{"observed_at":"2026-08-06T18:39:04.874891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:38:59.057572Z","title":"In Findings of the As- sociation for Computational Linguistics: ACL 2024 , Lun-Wei Ku, Andre Martins, and Vivek Srikumar (Eds.)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:38:59.057572Z"},"links":{"citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:2985d596d341d1c0caf85492cd0259940bbb84a7ff5d5dafd3b5a9c593112723","observation_id":"f01b10d5-f3fb-43df-9abb-bb21d408cf75","resolution":{"observed_at":"2026-08-06T18:38:59.057572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","latest_version":4,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-06T18:26:57.432317Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 3 inbound Pith citation observations for arXiv:2507.08064."}