{"as_of":"2026-08-09T00:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe1919f41c53a317232dfa06e87db91cef68aa51c493c6b0b0171a23479cafff","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:13:26.922092Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05249/citation-record","integrity":"/paper/2608.05249/integrity","json":"/paper/2608.05249/citation-record.json","paper":"/paper/2608.05249"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.949748Z","title":"Introducing GPT-5.4","venue":null,"work_id":"71fe9b4d-8f1c-4ebe-b4b3-186e2c2d53e0","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.189539Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:77a25d0d8223fc6ece25deacbde31f03063bde0ed6cea9495c6e2456d8a9fc88","observation_id":"bbbd0fb4-85f1-454b-b22f-ca54c55ef7ad","resolution":{"observed_at":"2026-08-08T17:13:28.955196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-08T17:13:25.253066Z","title":"Qwen3-VL Technical Report, November 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.253066Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:9fa724aad157925c170c86d26bab5464c3e919c1fb974b40ad08b7f761fcc6f7","observation_id":"d4f4be81-3b5c-4eb9-8d6d-d70c159e3316","resolution":{"observed_at":"2026-08-08T17:13:25.253066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05840","last_updated":"2024-12-31T14:46:47Z","snapshot_observed_at":"2026-08-01T14:19:40.337956Z","submitted_at":"2024-09-09T17:44:00Z","title":"MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05840","snapshot_observed_at":"2026-08-08T17:13:25.317701Z","title":"MMEvol: Empowering multimodal large language models with evol-instruct.arXiv preprint arXiv:2409.05840, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.317701Z"},"links":{"cited_paper":"/paper/2409.05840","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:1905bba8f759f19bcdd5a32d2f5f804c87b6c864cd5d8b2a963e69d77ba79b02","observation_id":"eab7a051-d5bd-43fb-9752-d1bf0a820f14","resolution":{"observed_at":"2026-08-08T17:13:25.317701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.805661Z","title":"Mulberry: Empowering MLLM with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":"bbb5153b-af7a-46e7-83ed-c63bfe77a971","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.350439Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:01141927c1940952a98ed016c1d1a5c256d9aefcddc9560bbe17f1043a34d420","observation_id":"fa99a0dc-e1d9-476c-a108-b9acad9731f4","resolution":{"observed_at":"2026-08-08T17:13:28.890230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-08T17:13:25.356753Z","title":"LLaVA-CoT: Let vision language models reason step-by-step.arXiv preprint arXiv:2411.10440, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.356753Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:78bb59ef93deced628d9180a676dec8fe5a97de8ff63a353199a260e6583831e","observation_id":"aee064f1-f62c-4416-acf7-cba6b9c06572","resolution":{"observed_at":"2026-08-08T17:13:25.356753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08741","last_updated":"2025-03-26T09:01:55Z","snapshot_observed_at":"2026-08-07T17:13:57.698335Z","submitted_at":"2025-03-11T08:25:40Z","title":"Oasis: One Image is All You Need for Multimodal Instruction Data Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08741","snapshot_observed_at":"2026-08-08T17:13:25.434877Z","title":"Oasis: One image is all you need for 14 multimodal instruction data synthesis.arXiv preprint arXiv:2503.08741, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.434877Z"},"links":{"cited_paper":"/paper/2503.08741","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:67de066b62c506afe53d143c8a2c3649c711e7b062fba7005531caaeda27e4c3","observation_id":"4d77cb9a-dc1b-4476-9f86-10805ddb2bde","resolution":{"observed_at":"2026-08-08T17:13:25.434877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.504828Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.504828Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:2df360209e8b8a1c480d05565709ee938892eed218029f3c24dbaf637c9001ba","observation_id":"c94405ad-f735-413f-b423-fcf14d6c2427","resolution":{"observed_at":"2026-08-08T17:13:25.504828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-08T17:13:25.538597Z","title":"Rubrics as rewards: Reinforcement learning beyond verifiable domains.arXiv preprint arXiv:2507.17746, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.538597Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:72dd0d228f3031550f94d5bd2eaa0e164bc9e600f1c203a889dc519aec41dcaf","observation_id":"20378077-12fd-4c83-a0e5-e7f1a8d56942","resolution":{"observed_at":"2026-08-08T17:13:25.538597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.611475Z","title":"Alternating reinforcement learning for rubric-based reward modeling in non-verifiable LLM post-training.arXiv preprint arXiv:2602.01511, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.611475Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:71a96b3335686a55e086ea91561d09c6047db2254dedeac2937da302a3caf0d3","observation_id":"d3ed71d4-d9be-44bd-af14-320fad3b5962","resolution":{"observed_at":"2026-08-08T17:13:25.611475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-08T17:13:25.668223Z","title":"Magpie: Alignment data synthesis from scratch by prompting aligned LLMs with nothing.arXiv preprint arXiv:2406.08464, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.668223Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:32067e0be1910ce2b917f20e89dc588e1416136ac17314fb8c3616fe88552503","observation_id":"074c7df1-d63a-4cde-be05-0ab561f3d6cd","resolution":{"observed_at":"2026-08-08T17:13:25.668223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.696284Z","title":"InFoBench: Evaluating instruction following ability in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.696284Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:251721f0215a0dfeec67fa6e67e55ef3131a718bcb6dbfdba1c6c54c2d7af977","observation_id":"31454cc5-5533-4379-aa2c-3d8b75e05f3a","resolution":{"observed_at":"2026-08-08T17:13:25.696284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16949","last_updated":"2026-08-01T14:42:28Z","snapshot_observed_at":"2026-08-06T23:10:34.815079Z","submitted_at":"2025-08-23T08:47:31Z","title":"Breaking the Exploration Bottleneck: Rubric-Scaffolded Reinforcement Learning for General LLM Reasoning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16949","snapshot_observed_at":"2026-08-08T17:13:25.707335Z","title":"Breaking the exploration bottleneck: Rubric-scaffolded reinforcement learning for general LLM reasoning.arXiv preprint arXiv:2508.16949, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.707335Z"},"links":{"cited_paper":"/paper/2508.16949","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:844ed5c9afb89262e4bbcace8f6510c89989cd8cb72c8b7e9c03c346156893fb","observation_id":"d6f4bcc6-1055-455a-9355-bf3c0db2bbdf","resolution":{"observed_at":"2026-08-08T17:13:25.707335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.790380Z","title":"Cambrian-1: A fully open, vision-centric exploration of multimodal llms.Advances in Neural Information Processing Systems, 37:87310–87356, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.790380Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:cc6c2269862291c1b153d940887579ea76edde6ad21c50b670e4299091d346cd","observation_id":"b3002793-658d-414a-90a3-7f8ac7c7dc11","resolution":{"observed_at":"2026-08-08T17:13:25.790380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.599822Z","title":"Seed 2.0 Model Card","venue":null,"work_id":"495f848d-f667-49b1-bf16-093648542946","year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.855352Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:c3ff7dea6f9114be16c3e5b689b4444c2511d250f7af0fdc7acf7947dfe38526","observation_id":"53b67008-da19-4ca7-b9fd-81067528ad38","resolution":{"observed_at":"2026-08-08T17:13:28.605107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-08T17:13:25.889313Z","title":"Allava: Harnessing gpt4v-synthesized data for a lite vision-language model.arXiv preprint arXiv:2402.11684, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.889313Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:4e6673e420db95953585fa2df725d1b555275870ad9c2b98c86d924837176c06","observation_id":"66725781-3aae-42f1-8df6-8a58e16f5012","resolution":{"observed_at":"2026-08-08T17:13:25.889313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.905148Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.905148Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:6df47844f518e08030c743b8220097279a01427ca8c3f8378550a7a5eda0fab8","observation_id":"cb8a6de7-a0d1-4dac-a638-8042208c8c64","resolution":{"observed_at":"2026-08-08T17:13:25.905148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06783","last_updated":"2023-11-12T09:10:51Z","snapshot_observed_at":"2026-07-06T16:46:10.142093Z","submitted_at":"2023-11-12T09:10:51Z","title":"Q-Instruct: Improving Low-level Visual Abilities for Multi-modality Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06783","snapshot_observed_at":"2026-08-08T17:13:25.910608Z","title":"Q-instruct: Improving low-level visual abilities for multi-modality foundation models.arXiv preprint arXiv:2311.06783, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.910608Z"},"links":{"cited_paper":"/paper/2311.06783","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:ab4591552dc630a6e46ffdda505b2d7df58c298fcb50e80e315eafa39db94fc8","observation_id":"f225b0fa-d5d9-4574-8a25-a4ac93456240","resolution":{"observed_at":"2026-08-08T17:13:25.910608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.567814Z","title":null,"venue":null,"work_id":"fa2e5e10-39cc-461e-bf94-b551561ce0a8","year":2020},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.916452Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:7a6c031c8fced20779bef1884d77fd84f79a00bfaafe5a74e31c0e088c234dfb","observation_id":"78783983-aa1b-438e-b0e4-4bc3bd6c4482","resolution":{"observed_at":"2026-08-08T17:13:28.579043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-08T00:07:32.122707Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-08T17:13:25.940793Z","title":"How many unicorns are in this image? a safety evaluation benchmark for vision llms.arXiv preprint arXiv:2311.16101, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.940793Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:40a7c45719b0fc12854ad826627b14133de081dc97163b0b7135542321f14fde","observation_id":"2cc8404a-8f16-4ec7-8f39-8bc631564e22","resolution":{"observed_at":"2026-08-08T17:13:25.940793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10292","last_updated":"2024-10-07T19:13:47Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:50:19Z","title":"Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10292","snapshot_observed_at":"2026-08-08T17:13:25.992116Z","title":"Fine-tuning large vision-language models as decision-making agents via reinforcement learning.arXiv preprint arXiv:2405.10292, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.992116Z"},"links":{"cited_paper":"/paper/2405.10292","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:53d3bc93b30fbc84ea12fa44db4940889db466e3765afacb65b1a6879e5bbd62","observation_id":"f1f80f45-9484-4442-bc68-1e528424f735","resolution":{"observed_at":"2026-08-08T17:13:25.992116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.996787Z","title":"Vizwiz grand challenge: Answering visual questions from blind people","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.996787Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:85138fb6740d9168c2be58e58d0e23c4ac40df9ef1fd3081d8cc5ef01ea24156","observation_id":"1d615319-06fa-4995-a5f3-564688c3b98c","resolution":{"observed_at":"2026-08-08T17:13:25.996787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09717","last_updated":"2024-02-15T05:22:04Z","snapshot_observed_at":"2026-08-02T21:09:22.790607Z","submitted_at":"2024-02-15T05:22:04Z","title":"Visually Dehallucinative Instruction Generation: Know What You Don't Know","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09717","snapshot_observed_at":"2026-08-08T17:13:26.001095Z","title":"Visually dehallucinative instruction generation: Know what you don’t know.arXiv preprint arXiv:2402.09717, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.001095Z"},"links":{"cited_paper":"/paper/2402.09717","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:b57ec793940f293451216bb5af9d15db289ffa7ed82f652516950fd94c8608f9","observation_id":"d6621171-0bb7-4cf9-a371-f652107c6574","resolution":{"observed_at":"2026-08-08T17:13:26.001095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.483085Z","title":"Shamma, Michael S","venue":null,"work_id":"c441233d-e283-4cf2-86cc-9850d6686881","year":2016},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.005536Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:a3290fa781ef6321814965a1432ec85b94534c0f98dffbf84001845f258d50f6","observation_id":"b6c036b1-8a5a-4a08-810c-667bd23e0559","resolution":{"observed_at":"2026-08-08T17:13:28.534941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.361290Z","title":"Hudson and Christopher D","venue":null,"work_id":"7e9fc7ac-ecec-4c95-9fb5-d291b4fec61d","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.011211Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:6463f48005b3e90a512d96a30e40aa211865643d0f5729bbea66e4d538f449fc","observation_id":"9ab7595b-4d01-4ca5-ae50-fa5b75d6cea9","resolution":{"observed_at":"2026-08-08T17:13:28.430154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.344700Z","title":"Dvqa: Understanding data visualizations via question answering","venue":null,"work_id":"96ed01bd-d50a-4148-8eb5-d70d8e4aaba7","year":2018},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.016063Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:a4c54604b0d562a6c83b2693874e890c8cdc921ce940a7930bc68cf7745acb25","observation_id":"cdfc299c-6d6c-423b-9d5a-1b6f30a74bef","resolution":{"observed_at":"2026-08-08T17:13:28.349913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.327661Z","title":"Donut: Document understanding transformer without ocr","venue":null,"work_id":"50a29af9-99de-41d5-ab65-84dffeba3cd9","year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.020619Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:8b70bc69d7450bfde09dc515f28f6493b1ed4c6c9674207801e2debc0c928cee","observation_id":"3baaa5d1-c38b-47e8-a1e6-b337a0f28737","resolution":{"observed_at":"2026-08-08T17:13:28.333073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00231","last_updated":"2024-06-02T15:47:16Z","snapshot_observed_at":"2026-07-06T17:37:52.514730Z","submitted_at":"2024-03-01T02:21:30Z","title":"Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00231","snapshot_observed_at":"2026-08-08T17:13:26.025156Z","title":"Multimodal arxiv: A dataset for improving scientific comprehension of large vision-language models.arXiv preprint arXiv:2403.00231, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.025156Z"},"links":{"cited_paper":"/paper/2403.00231","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:0670af28946de2bcd4312ad675c6b983d820747ce355ff3427869ade794699c8","observation_id":"c4c2cf58-85e1-4a9c-9d72-cfc0dda00e0d","resolution":{"observed_at":"2026-08-08T17:13:26.025156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.029929Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.029929Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:08a9252f3423a7b4e6f2a418738ec7b9de456ebb795d55b84846dbce154b0087","observation_id":"181bbf3e-25e8-4479-8ee5-781dc0e59989","resolution":{"observed_at":"2026-08-08T17:13:26.029929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08199","last_updated":"2025-02-09T21:09:17Z","snapshot_observed_at":"2026-07-06T13:53:13.702355Z","submitted_at":"2022-09-16T23:49:00Z","title":"ScreenQA: Large-Scale Question-Answer Pairs over Mobile App Screenshots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08199","snapshot_observed_at":"2026-08-08T17:13:26.034113Z","title":"Screenqa: Large-scale question-answer pairs over mobile app screenshots.arXiv preprint arXiv:2209.08199, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.034113Z"},"links":{"cited_paper":"/paper/2209.08199","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:8834e24ed0476afd167c7251f897eb8afd3f110786e4e7e8a1d8053df2e0427d","observation_id":"dd9c2897-ffbc-406d-b54b-63c56c1946b3","resolution":{"observed_at":"2026-08-08T17:13:26.034113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17107","last_updated":"2024-02-02T19:44:14Z","snapshot_observed_at":"2026-07-06T15:48:29.049336Z","submitted_at":"2023-06-29T17:08:16Z","title":"LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17107","snapshot_observed_at":"2026-08-08T17:13:26.039380Z","title":"Llavar: Enhanced visual instruction tuning for text-rich image understanding.arXiv preprint arXiv:2306.17107, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.039380Z"},"links":{"cited_paper":"/paper/2306.17107","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e3ba14b5e4444e6d9f4d6eaab2e4fd1eeb886e177a84646aa3551a3bcdc144f4","observation_id":"7cab4f00-62f7-40d1-9b1f-c814d20e9488","resolution":{"observed_at":"2026-08-08T17:13:26.039380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.260369Z","title":"Docvqa: A dataset for vqa on document images","venue":null,"work_id":"7372eeff-ef92-4b9d-9a19-a9cdd1949cd6","year":2021},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.044061Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:b2624725a9822b5e123ff55b4f647c8d3bc14f111c8d8bd9c1329fc365f59779","observation_id":"95793b90-2f10-46b9-b5fd-3a9f5965ed85","resolution":{"observed_at":"2026-08-08T17:13:28.300567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.048832Z","title":"Chartqa: A benchmark for question answering about charts with visual and logical reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.048832Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:43bee252c4f1f8d0bf3025cf7f07de88d33b937257c9405a148889389ea806e9","observation_id":"916d1ab7-c5cb-4d7f-97b0-475d858014dc","resolution":{"observed_at":"2026-08-08T17:13:26.048832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-03T05:45:09.122112Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-08T17:13:26.053348Z","title":"Seq2sql: Generating structured queries from natural language using reinforcement learning.arXiv preprint arXiv:1709.00103, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.053348Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:80e763f334b62a3d9e91eef1313f5ee863cb4e18026a13dd9fa7b188a11b808a","observation_id":"a365ac9b-178f-478a-86b1-ad3532ab30f7","resolution":{"observed_at":"2026-08-08T17:13:26.053348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.234852Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":"fc7062f2-2842-41ba-a40a-80a9015ef4da","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.104862Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:c6dcec1c92c8d3118b3f18283da3d3ae02cee54e821824587ce174c853835d62","observation_id":"c122808b-f685-494f-8df5-042bfd420964","resolution":{"observed_at":"2026-08-08T17:13:28.240012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.200471Z","title":"Compositional semantic parsing on semi-structured tables","venue":null,"work_id":"a7794d75-f23c-43c0-a810-45747c580120","year":2015},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.128073Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:b4216e2d9780e844de62f3b5a716dde74b0007188f5b959e392dddbcb26622df","observation_id":"f429713f-e621-4efc-b12c-0c68bc3e7a82","resolution":{"observed_at":"2026-08-08T17:13:28.223898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.113258Z","title":"Iconqa: A new benchmark for abstract diagram understanding and visual language reasoning","venue":null,"work_id":"7d0bc77c-845c-42f0-80d6-93e0b131782a","year":2021},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.155115Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:6bb8a7fd786f6e33126a38d1288a1dcc442ce381ca5734c0a131fe692136f9b0","observation_id":"c4c72c40-40e2-46ad-98d8-04d0ad4ce66b","resolution":{"observed_at":"2026-08-08T17:13:28.152949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.098236Z","title":"Clevr: A diagnostic dataset for compositional language and elementary visual reasoning","venue":null,"work_id":"c8eadcac-ef76-48cc-bf58-40efe36b6161","year":2017},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.184297Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:fcf576ad4b6f11d93265ebc2e94aafbbe6eb6a99bf149ff0106abbd1deca9c19","observation_id":"e6f73a19-1da4-41bf-a858-a685e4066792","resolution":{"observed_at":"2026-08-08T17:13:28.103105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.083828Z","title":"Tallyqa: Answering complex counting questions","venue":null,"work_id":"06d7dc12-917b-4f54-97cd-b3b3e9df142f","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.188249Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:afb485d780bb322b315fc0f90a609f50540bc23f1f8b1fd5324c58f2b8ad6f44","observation_id":"6d2607da-9cd2-400c-bd00-8d1fff846d10","resolution":{"observed_at":"2026-08-08T17:13:28.088458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11370","last_updated":"2025-08-20T15:45:11Z","snapshot_observed_at":"2026-08-02T03:18:39.824103Z","submitted_at":"2023-12-18T17:36:20Z","title":"G-LLaVA: Solving Geometric Problem with Multi-Modal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11370","snapshot_observed_at":"2026-08-08T17:13:26.193653Z","title":"G-llava: Solving geometric problem with multi-modal large language model.arXiv preprint arXiv:2312.11370, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.193653Z"},"links":{"cited_paper":"/paper/2312.11370","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:12dea6395d10345e1f89da3b1a316fed508fcc015fbbac997551b94802eb5a24","observation_id":"bdfc0a12-ee5f-4e2e-bc30-01955c88abf6","resolution":{"observed_at":"2026-08-08T17:13:26.193653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.198541Z","title":"Measuring multimodal mathematical reasoning with math-vision dataset.Advances in Neural Information Processing Systems, 37:95095–95169, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.198541Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:4b229bb5753637630cad581101632bb5a53387304796ba308ec92a6826dbbc19","observation_id":"ab97f596-b2db-4d68-800c-659f9b6dd19c","resolution":{"observed_at":"2026-08-08T17:13:26.198541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.058513Z","title":"Raven: A dataset for relational and analogical visual reasoning","venue":null,"work_id":"102bc6bb-fb20-4725-aeeb-d2e940b25127","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.202902Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:a95095e0a73bc2ff22e70ee47f9f71e9a8772efde1692fb8d99175191080cdcc","observation_id":"10dc1878-4909-4f33-b1c1-a9e56435416b","resolution":{"observed_at":"2026-08-08T17:13:28.064382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-08T17:13:26.207581Z","title":"Xing, and Pengtao Xie","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.207581Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:8c93afbe113d3adbbeb77846551e0d3998a396a7af83650d638a35c2676763fd","observation_id":"e1144657-2cef-4a6f-a92f-c5f128c1b7dc","resolution":{"observed_at":"2026-08-08T17:13:26.207581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.024727Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":"04585206-f115-42a2-96b6-8e3ea8a7004c","year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.236779Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:3ad2a71a8d31bc8e92722d2e8c4af750fffe23ea3a5bfa6b770784eea785f905","observation_id":"f596d7f7-ae26-4293-9dcd-e629250145de","resolution":{"observed_at":"2026-08-08T17:13:28.046794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-08T17:13:26.317500Z","title":"Internvl3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.317500Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:a7f5c8404b10083aac8e2e39fe9401334cb0df3d34bdfdc93b993769a4a046d0","observation_id":"63e9de72-b78a-4f9e-965f-0981542128b0","resolution":{"observed_at":"2026-08-08T17:13:26.317500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.928382Z","title":"Qwen3.5.https://qwen.ai/blog?id=qwen3.5, 2026","venue":null,"work_id":"907bceac-33c6-464d-aee2-601cb48f87f8","year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.415496Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d67cb74274335c9261b66d9cbab593e8a5941f7cc4bcc499a3adf61c92775e33","observation_id":"493a1714-0e5d-42b3-9e73-fa73398c8b58","resolution":{"observed_at":"2026-08-08T17:13:27.980922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-08T17:13:26.532378Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models.arXiv preprint arXiv:2407.07895, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.532378Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:4c197d390a2a3faba65b8131a1c6c1ef0849754ea5e43dc501d6b05a4e085445","observation_id":"0406641e-16e3-4a65-b912-43c1c0791f4d","resolution":{"observed_at":"2026-08-08T17:13:26.532378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.545256Z","title":"Mmbench: Is your multi-modal model an all-around player? In European conference on computer vision, pages 216–233","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.545256Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:93e20b027a191ab0818f4f3b126205360c4b89fda05bd9a3f190e64112ef7f94","observation_id":"8e4efd0d-59eb-416a-9989-6e7aa5f279b0","resolution":{"observed_at":"2026-08-08T17:13:26.545256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.881425Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":"62ab48de-a2e2-4fa0-b1c8-f4310df2ee2f","year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.557534Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:f3bec319eb837484a8523be300020854b4c59e8f931bb79f9ad1e196965f21f4","observation_id":"54d662d8-e2e9-4e53-bf17-da6b1aebd5cf","resolution":{"observed_at":"2026-08-08T17:13:27.903221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.594626Z","title":"Are we on the right way for evaluating large vision-language models?Advances in Neural Information Processing Systems, 37:27056–27087, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.594626Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:3c5eade5ca11a3b265bc5f812e2ed17ed3d150b8db34e48c1200d03ed65ce70f","observation_id":"dc02aaa0-93c2-421f-b76f-5ea8d3104256","resolution":{"observed_at":"2026-08-08T17:13:26.594626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.599460Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.599460Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:95cd5567accb72b44c03a8ecf91ee0ef18ea1d39f8356770a332acdba39f54fc","observation_id":"c996c68b-0240-4af9-908d-f5fe5e93e808","resolution":{"observed_at":"2026-08-08T17:13:26.599460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.682248Z","title":"Ocrbench: on the hidden mystery of ocr in large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.682248Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:64bf7928ec7659773e241a514f43aebc52d8bfb8c11291e93325697e5171e391","observation_id":"b5ac2766-49ff-4252-b7b6-7f1a9bc6296f","resolution":{"observed_at":"2026-08-08T17:13:26.682248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.740499Z","title":"Infographicvqa","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.740499Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:5b2add73644fcea4dc8cfaa5462e935c5c7c622eea94079a20ebd3cad35028f5","observation_id":"f85070c1-1962-4b10-9124-6dbfaace9535","resolution":{"observed_at":"2026-08-08T17:13:26.740499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.694210Z","title":"Charxiv: Charting gaps in realistic chart understanding in multimodal llms.Advances in Neural Information Processing Systems, 37:113569–113697, 2024","venue":null,"work_id":"e2c331b4-bee8-4901-963a-cf61c9f37378","year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.790069Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:7ff419dbfe998f8f90c864e46ba1a600a104ba2286ed2f89fead6c775d3e6b90","observation_id":"bb23239e-eaa4-4e9a-8a53-7063e9784fc6","resolution":{"observed_at":"2026-08-08T17:13:27.747015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.678880Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"ae0133c7-2418-4c6c-a459-352fb361b100","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.808841Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:0004cbb62f79d43abf370674aaff7cb5e56791c339c19e00561537aa3ea4fe2c","observation_id":"c5c58c3f-cf17-4536-b405-30d0bd95a173","resolution":{"observed_at":"2026-08-08T17:13:27.683662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-08T17:13:26.813213Z","title":"Logicvista: Multimodal llm logical reasoning benchmark in visual contexts.arXiv preprint arXiv:2407.04973, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.813213Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:f333593b90246e4683ecd655aa1e3ad536d3a31432b1b480f50e725be1472dd5","observation_id":"f055aed7-104b-45c2-b333-5414663d6db0","resolution":{"observed_at":"2026-08-08T17:13:26.813213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15279","last_updated":"2025-04-21T17:59:53Z","snapshot_observed_at":"2026-08-07T16:00:29.784743Z","submitted_at":"2025-04-21T17:59:53Z","title":"VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15279","snapshot_observed_at":"2026-08-08T17:13:26.818239Z","title":"Visulogic: A benchmark for evaluating visual reasoning in multi-modal large language models.arXiv preprint arXiv:2504.15279, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.818239Z"},"links":{"cited_paper":"/paper/2504.15279","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:04e20c5eb73a669f304e051a4a6ecc2e996ffa5ade8d9bc16ad2f40f056c6831","observation_id":"9c07e80c-8c6e-4c9b-bf64-63ffcb13b6a7","resolution":{"observed_at":"2026-08-08T17:13:26.818239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12066","last_updated":"2023-02-23T14:43:53Z","snapshot_observed_at":"2026-08-01T17:01:08.275374Z","submitted_at":"2023-02-23T14:43:53Z","title":"Teaching CLIP to Count to Ten","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12066","snapshot_observed_at":"2026-08-08T17:13:26.824188Z","title":"Teaching CLIP to Count to Ten.arXiv preprint arXiv:2302.12066, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.824188Z"},"links":{"cited_paper":"/paper/2302.12066","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:5adc7e870348d28a91f0c4f4dc1f70d060fd818ea09b6ab072f306b7db8ca6ea","observation_id":"5a064eed-8027-4c0d-aa53-ed40ede678cc","resolution":{"observed_at":"2026-08-08T17:13:26.824188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.554060Z","title":"Gemini 3 Flash: Frontier intelligence built for speed","venue":null,"work_id":"f5908791-8dcb-46d5-8eac-60d90a811947","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.829420Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:5f755f766114ecd6b55980c3dd6e033b924edd503ec76c16e29f080b752b1dcf","observation_id":"2e65b108-92c2-4bbe-87e8-bdf2f6443239","resolution":{"observed_at":"2026-08-08T17:13:27.624851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-08T17:13:26.922092Z","title":"usage intent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.922092Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d243dce51579b6f15fc3836dd44150faaa77c1da557322c538deb78b74a769fd","observation_id":"f30d611f-84a1-464d-9887-8b5bbaecf849","resolution":{"observed_at":"2026-08-08T17:13:26.922092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.626534Z","title":null,"venue":null,"work_id":"91117cef-aed2-4b08-a941-5dc856894563","year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":772,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.702217Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:37875099a93237b7e2bc1424c110578efef88396d1ea6b0bacc3aa92c58e0141","observation_id":"f90efd05-8d87-4757-830d-b03b58f172ba","resolution":{"observed_at":"2026-08-08T17:13:28.706527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-08T17:13:25.500185Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.500185Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:6cfba7f83f4d172a1e93e821282742baccd913bf1964c44aa037996f20714b14","observation_id":"7117009a-84ae-4a84-bcbf-78d3610513e2","resolution":{"observed_at":"2026-08-08T17:13:25.500185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:10:14.649784Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2608.05249."}