{"as_of":"2026-08-08T07:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b716cc4294a12ea56b94f8bb33d8d7cc491026272c1b6724be25faeccb7f3dd3","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:43:34.049540Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.13973/citation-record","integrity":"/paper/2505.13973/integrity","json":"/paper/2505.13973/citation-record.json","paper":"/paper/2505.13973"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:26.837843Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:26.837843Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:658a66bfe3d4b941b569b120092b34d29ef6abcd1ccff3e7ffba3d6c404d9950","observation_id":"c993af9c-0799-4b55-bc75-1b967876b1d8","resolution":{"observed_at":"2026-08-07T15:43:26.837843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.116351Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.116351Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:3486c3b3c906db37baa521bc0249501b065726eccc171bd5d040f8f6dc524bf4","observation_id":"0086c278-2456-4593-9740-5be1e49a590d","resolution":{"observed_at":"2026-08-07T15:43:30.116351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15558","last_updated":"2025-05-19T17:59:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-18T22:06:58Z","title":"Cosmos-Reason1: From Physical Common Sense To Embodied Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15558","snapshot_observed_at":"2026-08-07T15:43:30.245226Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.245226Z"},"links":{"cited_paper":"/paper/2503.15558","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:67b607e828dc07312575f4f981000a502128df94a33910781d2bcc673c733d75","observation_id":"d2625a23-56a5-45cf-900f-5be9c59664b9","resolution":{"observed_at":"2026-08-07T15:43:30.245226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:35.773788Z","title":null,"venue":null,"work_id":"7806bcdc-6fe5-49f0-ab37-ef00380cdf41","year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.351330Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:c74207dd280defa145dc69aca2251fa0ad9f608a19487e03d193b89d5caf03b3","observation_id":"e585a3a3-fa6d-4b21-9c28-ec369a8b097a","resolution":{"observed_at":"2026-08-07T15:43:35.830709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.454995Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.454995Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:0e853a7ab48129923d8de120d9b0cd6a3ee4e4301a7bd39d3e3ef3d343da139f","observation_id":"eca15f64-1a27-4119-821e-080a268450fd","resolution":{"observed_at":"2026-08-07T15:43:30.454995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00855","last_updated":"2024-10-30T14:45:00Z","snapshot_observed_at":"2026-08-07T12:15:46.504578Z","submitted_at":"2024-10-30T14:45:00Z","title":"Vision-Language Models Can Self-Improve Reasoning via Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00855","snapshot_observed_at":"2026-08-07T15:43:30.548612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.548612Z"},"links":{"cited_paper":"/paper/2411.00855","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:4c1e1d3d570718a3759cec7f7b8d7c6506bc70ba0d073f0b21c52b511d88aac6","observation_id":"39147750-bcef-4a0f-885f-f886e0ed0be5","resolution":{"observed_at":"2026-08-07T15:43:30.548612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.665481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.665481Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:85ef0ae79c786229a57fb99774d9d674bf8aac05f51cab2462fa178991f832f0","observation_id":"0353c2e0-0333-4069-944a-6ff0ea14d591","resolution":{"observed_at":"2026-08-07T15:43:30.665481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:35.479438Z","title":null,"venue":null,"work_id":"07ae3cf4-ff47-4756-8f38-798d08e2d673","year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.752803Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:105356fdb5d79f36c320a8d38ef8a79c517411c428f703c40f9a1ca10ceda2b5","observation_id":"7c12872c-2522-40a6-970b-18415343905b","resolution":{"observed_at":"2026-08-07T15:43:35.614745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14432","last_updated":"2025-05-02T16:03:31Z","snapshot_observed_at":"2026-07-06T19:53:56.407834Z","submitted_at":"2024-11-21T18:59:55Z","title":"Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14432","snapshot_observed_at":"2026-08-07T15:43:30.841430Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.841430Z"},"links":{"cited_paper":"/paper/2411.14432","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:e7314384f55634659bf3baf6056340361c5c43bf3da4a66b3f2f0cb8d7c2aa74","observation_id":"66edf0f7-809f-4720-b248-3123724d02d7","resolution":{"observed_at":"2026-08-07T15:43:30.841430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:43:30.931668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:30.931668Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:75ffb7bd0ea148e595535b8a64f63d3a4af9acca1e52b6c99adcf615410a88ca","observation_id":"2a0aab34-6632-4de3-b56f-189c9c036697","resolution":{"observed_at":"2026-08-07T15:43:30.931668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:43:31.075196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.075196Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:7d7d650801971730c86ed885e8f66eab48f098cef7753da73399065f37cd1287","observation_id":"4cdb0920-2151-4686-94cf-331907972674","resolution":{"observed_at":"2026-08-07T15:43:31.075196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.214749Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.214749Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:65c332479f4555d1519fac1ea80b5af9194401399ba6b8c0daa9d9f835b912f0","observation_id":"ccd43bf7-d09b-4d95-9382-1b4d39545788","resolution":{"observed_at":"2026-08-07T15:43:31.214749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T15:43:31.317058Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.317058Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:04046e324916456b142b6813e3fe78031c0b9bd1a089e98e1cec0d5f00fd4b31","observation_id":"2c09e7ae-55fe-4bb5-bc2d-714a569c4bb0","resolution":{"observed_at":"2026-08-07T15:43:31.317058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:43:31.423898Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.423898Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:b336d860a0667a5a0945e8feb30d336e2ee6db8e0308944cf4cd2455c809971d","observation_id":"98b9ac47-5b2f-41f1-a935-572a3768597d","resolution":{"observed_at":"2026-08-07T15:43:31.423898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21321","last_updated":"2025-03-24T09:34:38Z","snapshot_observed_at":"2026-08-07T17:38:55.347235Z","submitted_at":"2025-02-28T18:59:54Z","title":"LLM Post-Training: A Deep Dive into Reasoning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.21321","snapshot_observed_at":"2026-08-07T15:43:31.517756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.517756Z"},"links":{"cited_paper":"/paper/2502.21321","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:6420f34125a487c4e16362253467555c8b5b4b23fcd4962fa7642251138503e1","observation_id":"9a7f238e-3dc0-49c4-a70a-ea85c494cf12","resolution":{"observed_at":"2026-08-07T15:43:31.517756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10373","last_updated":"2024-07-17T09:34:00Z","snapshot_observed_at":"2026-08-02T05:31:09.782791Z","submitted_at":"2024-02-15T23:39:04Z","title":"BioMistral: A Collection of Open-Source Pretrained Large Language Models for Medical Domains","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10373","snapshot_observed_at":"2026-08-07T15:43:31.609026Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.609026Z"},"links":{"cited_paper":"/paper/2402.10373","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:83fc1684807923aad45207047ee5e68306509b654207da873eeaad18ba461b73","observation_id":"d3224970-441f-48be-9339-575cec1021d1","resolution":{"observed_at":"2026-08-07T15:43:31.609026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.706196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.706196Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:583e660a4c132758624b7b982ac444f063000cac766016bec7d1090a4d68f9a1","observation_id":"3db54ed8-b633-4a5d-8721-1bd9472187d9","resolution":{"observed_at":"2026-08-07T15:43:31.706196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:35.294746Z","title":null,"venue":null,"work_id":"782bef3b-5794-4698-a07e-343ef12624db","year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.790430Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:0a6fa43a36151bc3072ff78aa8afc554ad2ce031a4396a0ac74d3751e7dad68f","observation_id":"c59230b9-8a55-4f08-a5e8-635c00080c36","resolution":{"observed_at":"2026-08-07T15:43:35.372647Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.871537Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.871537Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:f7c123e2a0443372fd3f9a6d254c53ebc5dfd84ca4dad1a3faab0e7ef6096cb6","observation_id":"2bbb2501-e7b7-4296-9881-50c504fd81a5","resolution":{"observed_at":"2026-08-07T15:43:31.871537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-07T15:43:31.932837Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:31.932837Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:45f3eb7d980fc855bef7f9c40e44eeef5fd6071a7e12d1385d026b488ab0a960","observation_id":"ff045b84-e5de-4954-a5aa-fab2900f7ee1","resolution":{"observed_at":"2026-08-07T15:43:31.932837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:35.068318Z","title":null,"venue":null,"work_id":"e756f226-d6d4-494c-a3d5-46e53ca1456b","year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.056482Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:db5fec8b9c47b2461de6b1cc82c1bf50000214b4e7b0c38b376fb87f254ab512","observation_id":"c37a488c-14a6-4e37-930d-03174f64e814","resolution":{"observed_at":"2026-08-07T15:43:35.154763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-01T20:06:59.931737Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-07T15:43:32.164373Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.164373Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:59672a92c566228f726a9a8069326b0c9aa7793041178e59c6fb45cf0e761895","observation_id":"85bc92cc-e12d-40b5-bf4b-85aacc88b35b","resolution":{"observed_at":"2026-08-07T15:43:32.164373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.291467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.291467Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:37b70fa8498b5ee9a194f9e39f032562f3c6b955ddaec54637a5542d03381a07","observation_id":"10625c65-f303-48e7-9c90-4ced387d8e12","resolution":{"observed_at":"2026-08-07T15:43:32.291467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.391411Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.391411Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:b8874e9a2bfc4b9382ecc41e00a7de38c538370a233634e08f515fbfea315a28","observation_id":"cc79f665-816d-45ab-98a2-834e7b962796","resolution":{"observed_at":"2026-08-07T15:43:32.391411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T15:43:32.491701Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.491701Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:2d0dd236ca6ff5393fa117705aa050c56856511fe302ce28c9d4b7ac2f612b34","observation_id":"8a1e9c79-23c0-470c-9cb4-92c09170525a","resolution":{"observed_at":"2026-08-07T15:43:32.491701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T15:43:32.625665Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.625665Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:a68dac6124ee4533da003ebd4aaca60f5e5cb481aa48d5e93c7e533f682dfee3","observation_id":"2d97a5d0-1e19-4bfa-a1dc-496777c6c5cd","resolution":{"observed_at":"2026-08-07T15:43:32.625665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T15:43:32.721672Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.721672Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:08e056577ea7f5665ecdd695ad57663bcbc8ab29d50e925e2d3518d06c23e039","observation_id":"b69e7c64-86ed-48bb-8779-7f4c0fb824f7","resolution":{"observed_at":"2026-08-07T15:43:32.721672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.912379Z","title":null,"venue":null,"work_id":"6b20971f-cdab-46db-b776-41661c94f818","year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:32.849962Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:938a487f6d83b20ffd368c72f1c9050ae72d60ecc86bac9e39f9c88d4e9a8cd3","observation_id":"e0ffa0d3-726f-4542-871f-6a653604d65a","resolution":{"observed_at":"2026-08-07T15:43:34.968000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T15:43:33.001856Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.001856Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:7e41ef0263421cc455a4b87c5f0121f8bf9e5da0700668a9a8d4ec3fdfd888aa","observation_id":"e21db740-c644-4fd7-bdcd-e6fd90737047","resolution":{"observed_at":"2026-08-07T15:43:33.001856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:43:33.082866Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.082866Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:af1ba6b2897f3efd2412de219890d2786366c58242ad6e3aad75f6bd9f744c99","observation_id":"1947b600-f53c-449e-843c-2386d4acd9ef","resolution":{"observed_at":"2026-08-07T15:43:33.082866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.741104Z","title":null,"venue":null,"work_id":"be66dce3-be9b-49d0-bde5-dafdb58c1d99","year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.221448Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:8cb25bd42fb94adaa11d613428a482e863d23932d6ecaa0fe3f2cb9880a604b5","observation_id":"9a6b834a-b81e-450e-8489-5efb40855b7e","resolution":{"observed_at":"2026-08-07T15:43:34.834256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10458","snapshot_observed_at":"2026-08-07T15:43:33.341166Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.341166Z"},"links":{"cited_paper":"/paper/2504.10458","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:3c0cab05aa573b92fc99eecd286b83e22cd62a81f7522001b4c2cbbaf8c31628","observation_id":"9e3019e2-026c-4072-bb84-e23a7b886cd7","resolution":{"observed_at":"2026-08-07T15:43:33.341166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16198","last_updated":"2024-10-21T17:00:06Z","snapshot_observed_at":"2026-08-08T03:30:51.616377Z","submitted_at":"2024-10-21T17:00:06Z","title":"Improve Vision Language Model Chain-of-thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16198","snapshot_observed_at":"2026-08-07T15:43:33.432167Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.432167Z"},"links":{"cited_paper":"/paper/2410.16198","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:1591a2437c676eb9c7aa667f707ca5b0b28632504993209f7d4f22830d90cebb","observation_id":"06a2df12-52da-4aee-95e4-e9c4a025b307","resolution":{"observed_at":"2026-08-07T15:43:33.432167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.540806Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.540806Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:1b59b4a8de3cc62ffe3d1090b3d6f1a329f70d762a69aaf6d0669d45ca0f14f7","observation_id":"45eb7a77-1544-45be-9be2-8045541f163e","resolution":{"observed_at":"2026-08-07T15:43:33.540806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-07T15:43:33.648501Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.648501Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:9f11ec0197c1e8bfb674c0fd5b6c34fe7bde895562ee7ae2e9408c47063324e9","observation_id":"66a8f6d7-957d-4702-89d6-8ebcfda7b726","resolution":{"observed_at":"2026-08-07T15:43:33.648501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05379","last_updated":"2025-03-10T07:11:14Z","snapshot_observed_at":"2026-08-07T21:57:26.595540Z","submitted_at":"2025-03-07T12:46:42Z","title":"R1-Omni: Explainable Omni-Multimodal Emotion Recognition with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05379","snapshot_observed_at":"2026-08-07T15:43:33.729004Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.729004Z"},"links":{"cited_paper":"/paper/2503.05379","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:fce1a1bb661aee2d86bf1dac7d0e1cd7871bad4186a54eddcae5de71591d5932","observation_id":"e46c66b0-777a-4121-bda9-b6f6f8947210","resolution":{"observed_at":"2026-08-07T15:43:33.729004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.512079Z","title":null,"venue":null,"work_id":"d4e4046f-3fdc-4965-9fb4-7a46d793173d","year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.787424Z"},"links":{"citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:2c3af81cd7ec3dbd8a99670c58447471c5c668ccb5d650e2dc2a40328e7a9bce","observation_id":"4591e73e-4ce8-40f9-ae02-e5d880d8d484","resolution":{"observed_at":"2026-08-07T15:43:34.611405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-07-06T20:48:18.268075Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-07T15:43:33.968558Z","title":"aha moment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:33.968558Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:ed398a4349d88c95f5023a72eb48bf749532595aae2539186ec4207397239294","observation_id":"52a61e03-e4ca-4a96-86a6-fee5261db3a2","resolution":{"observed_at":"2026-08-07T15:43:33.968558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03987","last_updated":"2025-03-06T00:19:54Z","snapshot_observed_at":"2026-08-07T17:26:11.719746Z","submitted_at":"2025-03-06T00:19:54Z","title":"RetinalGPT: A Retinal Clinical Preference Conversational Assistant Powered by Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03987","snapshot_observed_at":"2026-08-07T15:43:34.049540Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:34.049540Z"},"links":{"cited_paper":"/paper/2503.03987","citing_paper":"/paper/2505.13973"},"observation_digest":"sha256:92645ee4690c61d7039a98cb947c55d4e5a75c2b4771eeef0be2a7f52d72e3f0","observation_id":"247b3255-68d8-431b-8ceb-1ecf28d49abd","resolution":{"observed_at":"2026-08-07T15:43:34.049540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.13973","last_updated":"2025-05-20T06:12:20Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:58:05.933360Z","submitted_at":"2025-05-20T06:12:20Z","title":"Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2505.13973."}