{"as_of":"2026-08-11T11:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6268da74f01278e7ff0055b29781d22462a241a188933b929fbb5f3d6b0cac11","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T19:46:19.985312Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.00241/citation-record","integrity":"/paper/2502.00241/integrity","json":"/paper/2502.00241/citation-record.json","paper":"/paper/2502.00241"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-09T19:46:19.866429Z","title":"A., Bach, N., Bahree, A., Bakhtiari, A., Bao, J., Behl, H., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.866429Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:a4d3d0024bbccb3216491f3a755e58efd716efeb8bb189f62011f6d14329789b","observation_id":"bec4c05d-551a-413f-b924-54def418d6b5","resolution":{"observed_at":"2026-08-09T19:46:19.866429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-09T19:46:19.888073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.888073Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:a81c002213e9a116871f3e7795d126dabbd5eaa2412e58a83dc5e3628e2f2d0e","observation_id":"7b6c6e59-e266-4d53-90de-df79d193246a","resolution":{"observed_at":"2026-08-09T19:46:19.888073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T19:46:19.892394Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.892394Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:70159f15d7008af79814042634b28c3f5674c8fde4ccbf6fefb6e15e3ecf8343","observation_id":"1d1fd062-0332-49d1-9a53-85ea2494422e","resolution":{"observed_at":"2026-08-09T19:46:19.892394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-09T19:46:19.911043Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.911043Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:1430e81112578fa1a5a104b7338622fb32cb3ccfd25dac5ef0b94349929a4bc5","observation_id":"90d6fd78-725b-4db2-89b1-4f9d1d0c4589","resolution":{"observed_at":"2026-08-09T19:46:19.911043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07865","last_updated":"2024-05-30T13:08:48Z","snapshot_observed_at":"2026-08-05T12:05:09.343843Z","submitted_at":"2024-02-12T18:21:14Z","title":"Prismatic VLMs: Investigating the Design Space of Visually-Conditioned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07865","snapshot_observed_at":"2026-08-09T19:46:19.914910Z","title":"Prismatic vlms: Investigating the design space of visually-conditioned language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.914910Z"},"links":{"cited_paper":"/paper/2402.07865","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:5d8977124972fb5710a560384385a95b249419eb990d38ccf6d9b01e3569a24f","observation_id":"35fecdfa-ef75-40bd-b19e-979db3f42ba3","resolution":{"observed_at":"2026-08-09T19:46:19.914910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02314","last_updated":"2024-05-28T16:16:42Z","snapshot_observed_at":"2026-08-09T17:55:41.119656Z","submitted_at":"2024-02-04T01:55:00Z","title":"Selecting Large Language Model to Fine-tune via Rectified Scaling Law","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02314","snapshot_observed_at":"2026-08-09T19:46:19.922978Z","title":"Selecting large language model to fine-tune via rectified scaling law.arXiv preprint arXiv:2402.02314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.922978Z"},"links":{"cited_paper":"/paper/2402.02314","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:1cf2730a5daff96996923e93a6dbdf961611ce11731bb80b3a41c35c79171ac8","observation_id":"9b077f7b-fb24-485c-a199-e9f957af083f","resolution":{"observed_at":"2026-08-09T19:46:19.922978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-09T19:46:19.926793Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.926793Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:4daf03efc1534d92500e21be1c3414213b6ffdbb3f7a0bdaf294b955c4645796","observation_id":"4671bf80-a271-4821-81f0-af4a69bbef7f","resolution":{"observed_at":"2026-08-09T19:46:19.926793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-08-11T03:45:43.920485Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-09T19:46:19.930509Z","title":"X., Tan, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.930509Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:e7f84501e7dd809ba2e09bc6c59a349aadc5078188b5bd4d669c3e9772d088d1","observation_id":"77851c57-13ca-415b-83dd-d0019802b5d0","resolution":{"observed_at":"2026-08-09T19:46:19.930509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-09T19:46:19.938708Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.938708Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:bdade985468af683102c670f44297359a697735cb692f87d845fcb7d9e9cd95a","observation_id":"eb5187f8-49e3-4e22-bc0c-43f3a93ba8af","resolution":{"observed_at":"2026-08-09T19:46:19.938708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10938","last_updated":"2024-10-01T23:38:10Z","snapshot_observed_at":"2026-07-06T18:15:54.402568Z","submitted_at":"2024-05-17T17:49:44Z","title":"Observational Scaling Laws and the Predictability of Language Model Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10938","snapshot_observed_at":"2026-08-09T19:46:19.942383Z","title":"J., and Hashimoto, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.942383Z"},"links":{"cited_paper":"/paper/2405.10938","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:aa7d413497e9d9362dc57933ca9a3f0eeebd5e94134f54daedd06c4c83ed0a60","observation_id":"e4b300bb-5e98-47f1-a0a1-b36ddc1f8eaf","resolution":{"observed_at":"2026-08-09T19:46:19.942383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-07-06T15:08:34.018146Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-09T19:46:19.946327Z","title":"Eva- clip: Improved training techniques for clip at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.946327Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:a8c9854cdee3cf88f4538b2ad2fb713443250222dcb437cde237f2697904b2eb","observation_id":"bf4dcb7f-4fef-44e1-a6c9-553d63dc8f8a","resolution":{"observed_at":"2026-08-09T19:46:19.946327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-09T19:46:19.950152Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.950152Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:cfe0ce1c719c08632f29d89c9e637ddad9f6a790c8248d3b3f9dea7e98089fce","observation_id":"bdd6982c-a46c-401f-bc37-e4730079990d","resolution":{"observed_at":"2026-08-09T19:46:19.950152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16860","last_updated":"2024-12-04T17:57:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-24T17:59:42Z","title":"Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16860","snapshot_observed_at":"2026-08-09T19:46:19.954305Z","title":"C., Yang, J., Yang, S., Iyer, A., Pan, X., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.954305Z"},"links":{"cited_paper":"/paper/2406.16860","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:aff181805fc5d39d546dcf96902499a6bf09875ce972a38384336bed9c51a051","observation_id":"3af2ca88-3707-44b7-92dc-fe475830cd35","resolution":{"observed_at":"2026-08-09T19:46:19.954305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-09T19:46:19.958360Z","title":"Llama: Open and efficient foundation lan- guage models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.958360Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:5f6ac3487039155bda207d8410f00b841a7be27265d08e85c03ec6af63457095","observation_id":"8ff81fba-60df-44f2-b28e-a69734d8a0e9","resolution":{"observed_at":"2026-08-09T19:46:19.958360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00770","last_updated":"2020-10-06T18:49:48Z","snapshot_observed_at":"2026-08-11T03:12:53.049403Z","submitted_at":"2020-05-02T09:39:36Z","title":"Exploring and Predicting Transferability across NLP Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00770","snapshot_observed_at":"2026-08-09T19:46:19.962287Z","title":"Vu, T., Wang, T., Munkhdalai, T., Sordoni, A., Trischler, A., Mattarella-Micke, A., Maji, S., and Iyyer, M","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.962287Z"},"links":{"cited_paper":"/paper/2005.00770","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:352104cc70d59b8efe3c940e3f163c94f90bd3743617a87fcdb9cfd4f7339d88","observation_id":"eb120aa1-bdd7-46e1-8e7b-ae0afff127fa","resolution":{"observed_at":"2026-08-09T19:46:19.962287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09265","last_updated":"2023-06-15T16:39:24Z","snapshot_observed_at":"2026-07-06T15:43:03.878575Z","submitted_at":"2023-06-15T16:39:24Z","title":"LVLM-eHub: A Comprehensive Evaluation Benchmark for Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09265","snapshot_observed_at":"2026-08-09T19:46:19.966277Z","title":"Lvlm-ehub: A comprehensive evaluation benchmark for large vision- language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.966277Z"},"links":{"cited_paper":"/paper/2306.09265","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:f90f9fb868295cf5a07ccf5e52ed72845f0a8b66a00481194f4ff61ea58cba63","observation_id":"af5bed81-1076-4e7a-a157-0d6db8b74234","resolution":{"observed_at":"2026-08-09T19:46:19.966277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T19:46:19.970562Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.970562Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:06f3b6d2372f68b4afa7277410586d059b5ed8eed20527444021eac94c8fdb69","observation_id":"e791b7bd-c42c-4b90-a7b5-3d88b0c99dec","resolution":{"observed_at":"2026-08-09T19:46:19.970562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12772","last_updated":"2025-05-05T04:48:45Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T17:51:53Z","title":"LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12772","snapshot_observed_at":"2026-08-09T19:46:19.974377Z","title":"A., Hu, K., Liu, S., Zhang, Y ., Yang, J., Li, C., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.974377Z"},"links":{"cited_paper":"/paper/2407.12772","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:ad0174eab78ef57d323cb23c98b11f086a615469eebc37f79accb9ec9f7219ac","observation_id":"22a8c01b-60d0-4d79-9f99-e02db2c23309","resolution":{"observed_at":"2026-08-09T19:46:19.974377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:46:20.303095Z","title":"In LLM clustering, we use the last hidden state from LLM as the sentence representation for CKA computation since it produces the best clustering performance","venue":null,"work_id":"4b1204fe-66f1-4fb0-872a-972039914e63","year":2021},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.978129Z"},"links":{"citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:430c4e4ff816899206981b3cc73636b261fe9864b80af37064ceb50ca55df84a","observation_id":"142f0774-44e9-44b9-819d-b2bfd02d3b8c","resolution":{"observed_at":"2026-08-09T19:46:20.307624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:46:20.291406Z","title":"For ConvNeXt, we interpolate the output embeddings to 16x16 patches following Cambrian-1 (Tong et al., 2024)","venue":null,"work_id":"d191bcc8-0d3e-483b-a469-3451858d0eb9","year":2019},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.981642Z"},"links":{"citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:8d43382aac1f65c11698f48cbe539747c6aebbb52a04f2dbc005d66e90877eca","observation_id":"28ff9466-7f85-479b-8cdd-27d94d7cb194","resolution":{"observed_at":"2026-08-09T19:46:20.295597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:46:20.278007Z","title":"Recently, some proprietary models have employed end-to-end training without using any pretrained models (Bai et al., 2023), but it is not common due to the excessive training cost","venue":null,"work_id":"89985cd3-b22c-4e60-b365-2e2dfc7ca1b1","year":2023},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.985312Z"},"links":{"citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:059b0805363032e238a39a7170c3b9e2e8180953a9bfe1edda25828542eae16e","observation_id":"c4af7bd7-4481-45a7-b670-e16f107c9c8a","resolution":{"observed_at":"2026-08-09T19:46:20.283292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-09T19:46:19.871514Z","title":"Qwen-vl: A frontier large vision- language model with versatile abilities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.871514Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:dc6f0808312d6704b61469608ecd5248e929894b94755a6e041e177e287cc794","observation_id":"120bcc3f-5689-4384-bdf4-85e971de888b","resolution":{"observed_at":"2026-08-09T19:46:19.871514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-09T19:46:19.907772Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.907772Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:249252bd455bc26a73e26aac5012a049f11cc9753a72b62f64cd924c11b8835e","observation_id":"668d5e7c-d887-45ec-9f43-82533af7dd21","resolution":{"observed_at":"2026-08-09T19:46:19.907772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-09T19:46:19.899686Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.899686Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:e5b51404c806351dee2ab6224af28dfafe0da9f679d8351d8100b91f1628b8d4","observation_id":"151d75c1-6967-4e2e-9896-c2c3ce5e5c38","resolution":{"observed_at":"2026-08-09T19:46:19.899686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:46:20.334363Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":"e5f2d4dd-b9ba-4e79-80e7-ed6edd1356c8","year":1901},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.880318Z"},"links":{"citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:bae9a61b2e812c905bbbdebac0b8a5defa6a5fb529f19520af5af3eff3ffcf75","observation_id":"2159f985-2c93-4955-b790-4ab8a1a02c52","resolution":{"observed_at":"2026-08-09T19:46:20.338125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-09T19:46:19.884215Z","title":"Minigpt-v2: large language model as a unified interface for vision-language multi-task learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.884215Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:e365161c2779fe1a84eec6bf940b8238dbf8cda3cb529a6a40405f0df98d8454","observation_id":"900e0c72-6566-4462-ac90-c465f7acfa5a","resolution":{"observed_at":"2026-08-09T19:46:19.884215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15327","last_updated":"2021-04-10T01:44:17Z","snapshot_observed_at":"2026-08-07T05:42:08.213531Z","submitted_at":"2020-10-29T02:57:21Z","title":"Do Wide and Deep Networks Learn the Same Things? Uncovering How Neural Network Representations Vary with Width and Depth","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15327","snapshot_observed_at":"2026-08-09T19:46:19.934437Z","title":"Do wide and deep networks learn the same things? uncovering how neural network representations vary with width and depth","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.934437Z"},"links":{"cited_paper":"/paper/2010.15327","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:6887d752b21617b7881bbb42d9be1734369364b4893329ca3ceef056bdbb0570","observation_id":"e41a09d0-393d-49cd-9928-cbc6189312e0","resolution":{"observed_at":"2026-08-09T19:46:19.934437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-09T19:46:19.903358Z","title":"J., Shen, Y ., Wallis, P., Allen-Zhu, Z., Li, Y ., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.903358Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:9bd6afca8cbf8010aa0bb5f1e6337839b8c98f4586a517ec955f927e876bee71","observation_id":"f96f9348-e38f-4fa3-a8ad-cc9a3a380e92","resolution":{"observed_at":"2026-08-09T19:46:19.903358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07931","last_updated":"2020-04-30T16:06:37Z","snapshot_observed_at":"2026-08-09T18:46:06.597890Z","submitted_at":"2019-10-17T14:09:42Z","title":"PLATO: Pre-trained Dialogue Generation Model with Discrete Latent Variable","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07931","snapshot_observed_at":"2026-08-09T19:46:19.876108Z","title":"Plato: Pre- trained dialogue generation model with discrete latent variable","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.876108Z"},"links":{"cited_paper":"/paper/1910.07931","citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:93e9dfbd36886bfd8a4fc03006afc87c53f4d840dd3d4e492903de03243ecac0","observation_id":"a080b3f2-6cf6-4886-8c19-e4d76c9cfa33","resolution":{"observed_at":"2026-08-09T19:46:19.876108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:46:19.918707Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.918707Z"},"links":{"citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:9e09beb3f1b1b3a9200f8fb282edc39d09ed0459b43316dc732aaa4edc122f66","observation_id":"0ef3e349-2caf-46ea-955a-15e8c592f249","resolution":{"observed_at":"2026-08-09T19:46:19.918707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:46:20.321993Z","title":"Accessed: 2025-01-30","venue":null,"work_id":"e20fd4df-7dd1-4155-810b-34148e0ebf6d","year":2025},"citing_paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-09T19:46:19.896211Z"},"links":{"citing_paper":"/paper/2502.00241"},"observation_digest":"sha256:dec9e00bfe2e11c4aa12b9eb89cff906390c7e65cfabd78410ca85756ffef8f5","observation_id":"aff61c96-329e-49e3-806c-52e4cebaa9cd","resolution":{"observed_at":"2026-08-09T19:46:20.326767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00241","last_updated":"2026-06-16T02:11:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T21:52:32.849041Z","submitted_at":"2025-02-01T00:41:29Z","title":"Mordal: Automated Pretrained Model Selection for Vision Language Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2502.00241."}