{"as_of":"2026-08-15T15:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5467cf9e4fc4cd148199847e1610215b5f00e749351841b3c6019be37d361a01","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:33:18.966385Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08623/citation-record","integrity":"/paper/2608.08623/integrity","json":"/paper/2608.08623/citation-record.json","paper":"/paper/2608.08623"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.118475Z","title":"Scaling Learning Algorithms Towards","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.118475Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:5b1980d9dac5236e4b2bf7c19582bc3fe49c2cbbc7ad51ba7a323ecb03fad3fc","observation_id":"48ce4dad-ebb8-41c6-9220-5b60bed6e53a","resolution":{"observed_at":"2026-08-14T04:33:18.118475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.132313Z","title":"and Osindero, Simon and Teh, Yee Whye , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.132313Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:e62edfb070bcfac0d93654411681b8bdf2580bc6d05fa45e2810977914c9f782","observation_id":"f23c137a-ad54-43d9-8c09-7f8a697ab059","resolution":{"observed_at":"2026-08-14T04:33:18.132313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.150239Z","title":"2016 , publisher=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.150239Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:7a5096391d01235e70aeb4710d196f7c03d0c2cc3a7779ce4c790a8fa17e121b","observation_id":"9e79287c-ee5c-408d-913b-6479c32a18ad","resolution":{"observed_at":"2026-08-14T04:33:18.150239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.162114Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.162114Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:13f25238aeefe01c784363833d96d64d4addda035d013a80842420d89a2574ef","observation_id":"5c34259f-6db9-4dca-961a-38df3a1a4793","resolution":{"observed_at":"2026-08-14T04:33:18.162114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.175044Z","title":"and Zhang, Songyang and Chen, Kai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.175044Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:02689b21ded76d1592934b746b9d2ae94b1f41f1843134cd66c37df760ea6981","observation_id":"d3471b54-c551-42fe-a625-c6a9cd8ba538","resolution":{"observed_at":"2026-08-14T04:33:18.175044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.191594Z","title":"Back to Basics: Revisiting REINFORCE -Style Optimization for Learning from Human Feedback in LLM s","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.191594Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:085d08cf9a284f0858260a4606829e0bc1e9c6afb50ef0a249f17b9879970a82","observation_id":"ceb1527a-8bb3-4d2a-b060-3fe3695bca6b","resolution":{"observed_at":"2026-08-14T04:33:18.191594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.224826Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.224826Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:0ea165bbec4d315cc29f61ea47045a76a653a538e9178b12f3ad5f8c44bfe783","observation_id":"2cad6f8a-80b3-4c10-9392-ff59c582c692","resolution":{"observed_at":"2026-08-14T04:33:18.224826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.249232Z","title":"arXiv preprint arXiv:2503.13939 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.249232Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:1baad6f8a33927ca9d99c312a88875f5e801aed2ea7b1b06f4bcc91a9bca24a4","observation_id":"54cf2d39-cd79-4e04-9097-fd38465a6ede","resolution":{"observed_at":"2026-08-14T04:33:18.249232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23829","last_updated":"2025-04-01T14:48:02Z","snapshot_observed_at":"2026-08-10T14:48:37.196526Z","submitted_at":"2025-03-31T08:22:49Z","title":"Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23829","snapshot_observed_at":"2026-08-14T04:33:18.256691Z","title":"arXiv preprint arXiv:2503.23829 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.256691Z"},"links":{"cited_paper":"/paper/2503.23829","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:ae4c38cf918b2c01edc394149689af1928b6001dd079ab4ffb9f1d85ec7e568e","observation_id":"4c2611e7-fe7e-4729-8abe-f6948bf32ead","resolution":{"observed_at":"2026-08-14T04:33:18.256691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.264282Z","title":"IEEE Journal of Biomedical and Health Informatics , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.264282Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:5d312943a16853aaf420c292843d6c25b23071ba2654db9d6015bc58c6ec4e48","observation_id":"835796f1-f1c1-44ad-a505-de66698f48c0","resolution":{"observed_at":"2026-08-14T04:33:18.264282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-14T04:33:18.276741Z","title":"arXiv preprint arXiv:2410.21276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.276741Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:5f8b1d72e6f3c3d294e6e8e8877782425e50be066d22fef92029213b16304169","observation_id":"51f55689-6869-41a1-9feb-8d95d3333d10","resolution":{"observed_at":"2026-08-14T04:33:18.276741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.284869Z","title":"Information Processing & Management , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.284869Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:5cdf613530adf2dd79bb8ac8a0f7fd2e40320ecb47fe5cf2c8cc6f7288ca21f1","observation_id":"3b18ffb4-a317-4de5-ab31-9370fe26fa7b","resolution":{"observed_at":"2026-08-14T04:33:18.284869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:23.589265Z","title":null,"venue":null,"work_id":"933a513f-6d5b-4d7a-8f2b-88d7b9e87653","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.298126Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:817ca2cd4853c047c9e8191c20c43283c220953f610b891565dea719457937db","observation_id":"1134af4d-27c1-4259-bc0e-f7f08c2b9b24","resolution":{"observed_at":"2026-08-14T04:33:23.596997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.312083Z","title":"Bowman , booktitle=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.312083Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:ea3d7379a0f5a38b4a3e5a2d6ccea7c62560de7c6c9d6f15c219aa183d13f973","observation_id":"15a3e621-1911-4c88-8cda-e3bafb38a180","resolution":{"observed_at":"2026-08-14T04:33:18.312083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-14T04:33:18.318982Z","title":"arXiv preprint arXiv:2501.12948 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.318982Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:27702f39cb5021866af39f9011cc5a3d62f18b00ae5e21db60b3be109a9c3a6e","observation_id":"176a1dfe-0a3a-4436-ad39-319c61ce7628","resolution":{"observed_at":"2026-08-14T04:33:18.318982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-14T04:33:18.329527Z","title":"arXiv preprint arXiv:2412.18925 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.329527Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:70e8711f1fe5c339cb56bae92d396060936ad03d2d9581c1d6ac76b0242ff010","observation_id":"7b0e6436-cc54-4644-a212-656a139ac932","resolution":{"observed_at":"2026-08-14T04:33:18.329527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-14T04:33:18.343454Z","title":"arXiv preprint arXiv:2503.09567 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.343454Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:fd10035589733ea7a0d0b8e5ea1ab2e541d12991aa9b77dfdd7c0fb42d0b0870","observation_id":"5e37d649-78fc-47ce-b82d-be8564cfc08e","resolution":{"observed_at":"2026-08-14T04:33:18.343454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:23.511612Z","title":"Navigate through Enigmatic Labyrinth A Survey of Chain of Thought Reasoning: Advances, Frontiers and Future","venue":null,"work_id":"ce769459-758e-4e28-80d9-8f589fcfce34","year":2024},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.353550Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:3cb7bb56ec6e64ca70ada1c0d2ca8edd0eeb45ec40fdae3cbb8f990255d836f4","observation_id":"14dbb5b6-bceb-4187-8dc0-d1b77db6816c","resolution":{"observed_at":"2026-08-14T04:33:23.524983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:23.460862Z","title":"The Thirty-eight Conference on Neural Information Processing Systems Datasets and Benchmarks Track , year=","venue":null,"work_id":"917317bc-6218-4c4d-a74a-a587f835909d","year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.364758Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:797698594afb4f73d9fc2d1a12df65efdc5780b6a9b3fe079dffdf531472f849","observation_id":"04b0784e-da74-4d1d-bdf8-fdd1ccca6be6","resolution":{"observed_at":"2026-08-14T04:33:23.472711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-14T04:33:18.373103Z","title":"arXiv preprint arXiv:2505.09388 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.373103Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:46a97562ec031154213ae6dee5c6bd89db7fdd663d883776133409c250fb9dc6","observation_id":"b50b0092-9886-4843-981f-89b7668c56dd","resolution":{"observed_at":"2026-08-14T04:33:18.373103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:23.398489Z","title":"Proceedings of the 41st International Conference on Machine Learning , articleno =","venue":null,"work_id":"e7ee623e-59a2-4244-a6b7-eae988aa38cf","year":2024},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.379447Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:8335939ca3a6d983f36a59e3e8d1c303d09334deb284c0bb2ca39d8898388824","observation_id":"963ffce7-7c90-4247-8a72-0ca45a36eb03","resolution":{"observed_at":"2026-08-14T04:33:23.437878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:23.212754Z","title":"2025 , issn =","venue":null,"work_id":"ed106e7d-a7db-442f-828b-319c9a10fa79","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.385933Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:dd24d5a144fe97dd639cd7334c70e914364e1d8a1f4358635c6edc3f1db08fa1","observation_id":"219326f7-8300-4d18-afbd-aa51a9832469","resolution":{"observed_at":"2026-08-14T04:33:23.304753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-14T04:33:18.395646Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.395646Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:543bf7e0652ef2e9d0eb630578eaa41d348070be33d973fcbc420b4cc11797f6","observation_id":"9ff4e527-1d00-421b-8dbc-17eba28d84e2","resolution":{"observed_at":"2026-08-14T04:33:18.395646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:23.029998Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"8ce5af55-3950-4b27-8505-0f213476fcf5","year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.401810Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:94c89ff42e0bb0b33a05fe8d9cd21d3db04ac9a4ac4cbcdfff5e35af20ddbc32","observation_id":"d2350728-d822-47aa-a114-9bbf20027f9e","resolution":{"observed_at":"2026-08-14T04:33:23.097911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10400","last_updated":"2025-02-24T08:57:10Z","snapshot_observed_at":"2026-08-11T21:30:49.960686Z","submitted_at":"2024-12-05T16:10:42Z","title":"Reinforcement Learning Enhanced LLMs: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10400","snapshot_observed_at":"2026-08-14T04:33:18.409999Z","title":"arXiv preprint arXiv:2412.10400 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.409999Z"},"links":{"cited_paper":"/paper/2412.10400","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:6534aff89e251bf1cd9ba23a4153aed8e304eb9a665ba856cd3b68be85e013fd","observation_id":"f8c660a6-aded-46ce-8586-1248e75404c5","resolution":{"observed_at":"2026-08-14T04:33:18.409999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12728","last_updated":"2025-06-01T17:07:35Z","snapshot_observed_at":"2026-08-13T06:40:12.269535Z","submitted_at":"2024-04-19T09:15:07Z","title":"Relevant or Random: Can LLMs Truly Perform Analogical Reasoning?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12728","snapshot_observed_at":"2026-08-14T04:33:18.417191Z","title":"arXiv preprint arXiv:2404.12728 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.417191Z"},"links":{"cited_paper":"/paper/2404.12728","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:a74a080023ae6bc1096a8ea65bb6f353a4264fe520cbe755b64fd1b4c5d7970f","observation_id":"ae7e8d22-4039-4ff6-b77d-94c952b96e97","resolution":{"observed_at":"2026-08-14T04:33:18.417191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-14T04:33:18.423736Z","title":"arXiv preprint arXiv:2401.14196 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.423736Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:040c5215f2c0d5648e778efdf69e069728014be7c8afe440e60728857f3792ae","observation_id":"251f07f0-7ef0-40c3-8105-ff227109e425","resolution":{"observed_at":"2026-08-14T04:33:18.423736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-14T04:33:18.430137Z","title":"arXiv preprint arXiv:2108.07732 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.430137Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:cbf4aa86507cd4e5c897b528e957e7ba0847937d7ca6447de9a37ddd4e7975c3","observation_id":"14594cf7-c067-4f35-b89d-782e00a08098","resolution":{"observed_at":"2026-08-14T04:33:18.430137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09100","last_updated":"2025-02-13T09:19:14Z","snapshot_observed_at":"2026-08-14T15:05:06.112388Z","submitted_at":"2025-02-13T09:19:14Z","title":"Logical Reasoning in Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09100","snapshot_observed_at":"2026-08-14T04:33:18.439574Z","title":"arXiv preprint arXiv:2502.09100 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.439574Z"},"links":{"cited_paper":"/paper/2502.09100","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:9279154df8ff62d082691391c09995b7377fd5289f3465b0832560dd239369de","observation_id":"4abde23a-e46e-4096-9571-f97429640d93","resolution":{"observed_at":"2026-08-14T04:33:18.439574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.447611Z","title":"arXiv preprint arXiv:2504.09037 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.447611Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:64e00980cca70bd9a1b545bf68b44bfae129ccf2bde2dce07780f3a363df10da","observation_id":"c57b3509-5bb2-4131-bd16-f7a9a9bbbccc","resolution":{"observed_at":"2026-08-14T04:33:18.447611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-14T16:00:41.902820Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-14T04:33:18.456951Z","title":"5-math technical report: Toward mathematical expert model via self-improvement , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.456951Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:2b365f452fb09b952aa4dc74399b82bbcc41fb4496dd2c148bee8b4d7fee7615","observation_id":"3c8eed5a-8508-468a-8da3-0857b27cd81f","resolution":{"observed_at":"2026-08-14T04:33:18.456951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.465403Z","title":"Advances in Neural Information Processing Systems , editor=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.465403Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:82f2febd0a4dc80e18d25ed5c5a4fc34ad08c470babe5b0bdc48bf1e4fe70466","observation_id":"ae693022-47bb-4c79-ba40-4854b78d8eb8","resolution":{"observed_at":"2026-08-14T04:33:18.465403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.475793Z","title":"Frontiers of Computer Science , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.475793Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:d111956366976b06cdc83ccefa0faa70a16788ad580dace7fadad1ee6bc71ab0","observation_id":"e9240500-a5fa-491c-983c-4e7a7d89542b","resolution":{"observed_at":"2026-08-14T04:33:18.475793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-14T04:33:18.486339Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.486339Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:47ebaa65ed9c35d24005a1789ef752b1fdb34523c2ebacbdab44cb672e007335","observation_id":"4a2b024d-a255-43f2-a07a-5867d0572544","resolution":{"observed_at":"2026-08-14T04:33:18.486339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-14T14:15:07.219394Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-08-14T04:33:18.492951Z","title":"arXiv preprint arXiv:2506.08446 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.492951Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:bae1c7c90b94f000c2c05b94cf3617bf1f4cd8f1dadc0024eba7bed43a7d8453","observation_id":"49ef8e72-1f4e-4c2f-8b03-d4e5f60927ba","resolution":{"observed_at":"2026-08-14T04:33:18.492951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:22.877101Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":"7045f5e7-39e7-4b43-b3fc-ae01c25ca871","year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.502842Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:76a2d99479f6806ecf1204abc6e32466a5168c0720c285ddee31cdbbcfa45da2","observation_id":"12f01496-7813-4539-a934-128dee9d70a5","resolution":{"observed_at":"2026-08-14T04:33:22.900609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-14T04:33:18.509367Z","title":"arXiv preprint arXiv:2110.14168 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.509367Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:492e84f2ac252883b82517eecaba47358945b57cca3f1debbb791c80fb0003f6","observation_id":"bddc041b-e461-497d-b62e-179a47aacda3","resolution":{"observed_at":"2026-08-14T04:33:18.509367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.516562Z","title":"Measuring Mathematical Problem Solving With the","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.516562Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:1d58ef938cfb14655ccec18f6822449aee9e18a7341ce20c42e4574ee71eb8f3","observation_id":"80a521ac-ecfd-49ae-9d1b-f9da4f4b2d04","resolution":{"observed_at":"2026-08-14T04:33:18.516562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.525870Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.525870Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:7a130ecbf90d151da8f7a69a441172b803056403b061fb308cfd2d5609e11558","observation_id":"c6cbcdb2-8e90-4a57-b9f8-9dbe31f89f02","resolution":{"observed_at":"2026-08-14T04:33:18.525870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.535219Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 5: Industry Track) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.535219Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:d2d5d6942429ff083280ebfbe712ce5385469a69d7ce1404817dd2aac0dc7227","observation_id":"6969dc09-e8cf-42ad-b889-93d1f157f04c","resolution":{"observed_at":"2026-08-14T04:33:18.535219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-14T04:33:18.541611Z","title":"arXiv preprint arXiv:2305.10403 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.541611Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:d519e50ce58186ad2ff8ee48b71709fa0a5e2d175f159a09df2bcd97aed45626","observation_id":"9aa052ad-09c0-4dbd-8d39-4797563a1186","resolution":{"observed_at":"2026-08-14T04:33:18.541611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.550875Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.550875Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:7f02278f836f0f3c6d0ee8d362e4eb5a544cf433e3435d64b1dc35bdf44865ac","observation_id":"31869adc-062a-4b3d-a9b4-6bfd8d1439e2","resolution":{"observed_at":"2026-08-14T04:33:18.550875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.559316Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.559316Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:9d0a1443c5858e5b7b40d8207dde86ce67653f21f81878a33fb2a844e586cab6","observation_id":"cf36f901-3d6c-489a-8b3a-ff2fb363deb5","resolution":{"observed_at":"2026-08-14T04:33:18.559316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.565892Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.565892Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:f97ec2653e32932999753d8c54478b181f27d4a36289e94e36799c2147fa190a","observation_id":"7b259cbc-d402-47a8-8b75-ee6d519fba49","resolution":{"observed_at":"2026-08-14T04:33:18.565892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.574721Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.574721Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:f8c67c183debfd2a6bec4442895096f1db8de5cf49bed0ba558aa734bbcd93d9","observation_id":"61e21d83-fe28-449b-b0de-5f7d7acc4dac","resolution":{"observed_at":"2026-08-14T04:33:18.574721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:22.337766Z","title":"Journal of the American Medical Informatics Association , volume=","venue":null,"work_id":"1f4ac959-e4fc-485a-a893-959f1ba97793","year":2024},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.586604Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:70f639043c3ef4502ec66ad86181831e3b25ee871fcf45dda57c52d005f4f04d","observation_id":"f1a6079d-39ea-4f8d-aca1-c2472d1fa9de","resolution":{"observed_at":"2026-08-14T04:33:22.374756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.593653Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.593653Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:98fa13988e64fa40c4ec1041f38f8639fa2b69b5bfc29198e21a3e6c23976990","observation_id":"77870585-73d0-4174-8fae-69603b66fa44","resolution":{"observed_at":"2026-08-14T04:33:18.593653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-14T04:33:18.601301Z","title":"arXiv preprint arXiv:2407.21787 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.601301Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:82e23b23d3a51b3226597e1f748d8853ebdcccd3eebaebfdd137e8391d92fa75","observation_id":"cef3d2b3-b402-4c94-997d-86a675ee2dcc","resolution":{"observed_at":"2026-08-14T04:33:18.601301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.608057Z","title":"5-thinking: Advancing superb reasoning models with reinforcement learning , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.608057Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:b36d79542e5f612c65ba20248729a4785c5908fd2501413f890c1766ae58c240","observation_id":"56f1876f-7741-45f8-ae9e-c5ba33998316","resolution":{"observed_at":"2026-08-14T04:33:18.608057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-14T04:33:18.615284Z","title":"arXiv preprint arXiv:2501.03262 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.615284Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:c1da4a15ac5407e17ceae2fe57fa8c4916d25bcc62377e5c7e5f45276b62cfbc","observation_id":"3814f142-a3a1-4532-aa73-28e9f9eb7533","resolution":{"observed_at":"2026-08-14T04:33:18.615284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.622865Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.622865Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:a0f7ea90a4b6f03c95a255b85b6550ca6d854e0a28b7781aa8c6875e3a2526cd","observation_id":"2f3be0da-5916-4df0-b5e1-6e82435a54b5","resolution":{"observed_at":"2026-08-14T04:33:18.622865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-14T04:33:18.628511Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.628511Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:db12db7504a0aa443423dd4c6d6a6173e5c54a15f9443eea1248b51f37a274c7","observation_id":"cb50718a-c96b-4b72-8d21-8fac5fd8dde1","resolution":{"observed_at":"2026-08-14T04:33:18.628511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-14T04:33:18.640659Z","title":"arXiv preprint arXiv:2412.16720 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.640659Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:764d77ae3a7ed9f39b17ff0cdedfd4a66abd571951d5f693cc0bd8a42b609942","observation_id":"d2d9b4b6-4f58-4d50-8038-1bafb2c20de7","resolution":{"observed_at":"2026-08-14T04:33:18.640659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.647783Z","title":"arXiv preprint arXiv:2504.02495 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.647783Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:b93b666fd7275e6d356ddfd4803a5a252a6a5db9827baedd851ad7a2eb1b1dd3","observation_id":"c8b03081-9b96-4781-957a-c4794deb57cd","resolution":{"observed_at":"2026-08-14T04:33:18.647783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.654919Z","title":"Nature medicine , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.654919Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:1e7ee4919d1672b357a96b1aba21ded8f684e1b219f9b728f399a3cfa23ca985","observation_id":"1ae99239-1e1a-4154-8191-743ef5262114","resolution":{"observed_at":"2026-08-14T04:33:18.654919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:22.034833Z","title":"A position statement and resource document from NAEMSP , author=","venue":null,"work_id":"3017fcf1-c6a5-433d-a1a9-e37c7343f363","year":2020},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.661369Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:830c3c4808767a33302eff3ebe9416cb347f430093657bfa9817a63b8e3d7522","observation_id":"1b8c66e2-4769-4cda-9ed3-a10052c23193","resolution":{"observed_at":"2026-08-14T04:33:22.066092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.678875Z","title":"Search-R1: Training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.678875Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:39322552315bebc9803f2dcd72f6b332c83cf8599e32cdd87fb4ba1f14d3da6e","observation_id":"c636487b-500c-43f9-ba18-f57557797f1f","resolution":{"observed_at":"2026-08-14T04:33:18.678875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-08-15T02:20:36.256055Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-14T04:33:18.686749Z","title":"arXiv preprint arXiv:2501.05366 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.686749Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:49369d9d453afbf3fde65fdd3cedad6a3dbe83200127c970fbdc3be56c82a32b","observation_id":"7b61a873-48e7-4428-92d8-15b6496b44b0","resolution":{"observed_at":"2026-08-14T04:33:18.686749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:21.863841Z","title":"Nursing Reports , volume=","venue":null,"work_id":"a870f146-b8af-48c5-bbe5-22f09b6b8ed1","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.693630Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:b5c0e8324727476ec8e3550fe2008fc86d4a3c8ac35d597508110bfad0075684","observation_id":"d02765f6-6eae-4c75-8679-db80169e9303","resolution":{"observed_at":"2026-08-14T04:33:21.873320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-14T04:33:18.699252Z","title":"arXiv preprint arXiv:2501.09686 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.699252Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:ca6d2c3d24ddeb0ebce76d17e6fd955b16c2f92e58152152ce851295fb7778d9","observation_id":"bd6ef9a0-44c2-4f53-a117-effec7dc96e8","resolution":{"observed_at":"2026-08-14T04:33:18.699252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.705521Z","title":"Questioning Our Questions: How Well Do Medical QA Benchmarks Evaluate Clinical Capabilities of Language Models?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.705521Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:049c349ff9d32f5157ae6897c85b338684ebbdb5319892f86f6e73443c28c569","observation_id":"8d1924d9-173d-4381-a916-524bb882572f","resolution":{"observed_at":"2026-08-14T04:33:18.705521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.bionlp-1.20","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:19.126732Z","title":"Effective Multi-Task Learning for Biomedical Named Entity Recognition","venue":null,"work_id":"71265eed-c6f0-4069-9bcb-87bb42c26562","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.712829Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:f6a832c3bfe05c25541b64e23960aa9b6b5b9cfbd53ea8482ee3680951962806","observation_id":"33b05900-3228-4490-855a-d79bae3e88a5","resolution":{"observed_at":"2026-08-14T04:33:19.142141Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.719492Z","title":"Proceedings of the ACM SIGOPS 29th Symposium on Operating Systems Principles , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.719492Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:fa514542135623b6955c5e0737ce4255e881f700cb19747545d5a549fc5e0593","observation_id":"6f431b60-e270-4667-aa5b-ba1f8341a827","resolution":{"observed_at":"2026-08-14T04:33:18.719492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.bionlp-1.7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:19.093347Z","title":"Transformer-Based Medical Statement Classification in Doctor-Patient Dialogues","venue":null,"work_id":"c0d32709-4047-49b2-80c7-1e894ea6a8e1","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.727476Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:fbe7a59061af18d819deb270675a012310ae421cb0ccebb416a45020fce7c8df","observation_id":"3e560dd6-c2f4-49c4-8c65-b0582e5bdefc","resolution":{"observed_at":"2026-08-14T04:33:19.102310Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.1298","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:19.055815Z","title":"MAM : Modular Multi-Agent Framework for Multi-Modal Medical Diagnosis via Role-Specialized Collaboration","venue":null,"work_id":"b218a639-2ab9-4a33-b396-86cd3c0d9e12","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.738725Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:326ae11cc878ff13cb228902cb937fc64fa048b3efb462e1030b86857944bef7","observation_id":"c1fb7397-93b9-4016-b270-47d31ad7334b","resolution":{"observed_at":"2026-08-14T04:33:19.066734Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:21.705094Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":"4400cd0e-9850-4eeb-a627-3adf5214cf7e","year":2025},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.745866Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:6284e02d258a2d5f728526a5e585485e92509df5eb00a6d36d257d39bd8040a7","observation_id":"01f80d75-0d3a-46ae-ad0a-4f4521a0e968","resolution":{"observed_at":"2026-08-14T04:33:21.735058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11211","last_updated":"2025-05-26T14:11:38Z","snapshot_observed_at":"2026-08-11T02:10:28.106349Z","submitted_at":"2025-02-16T17:21:05Z","title":"A Survey of LLM-based Agents in Medicine: How far are we from Baymax?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11211","snapshot_observed_at":"2026-08-14T04:33:18.754401Z","title":"arXiv preprint arXiv:2502.11211 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.754401Z"},"links":{"cited_paper":"/paper/2502.11211","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:f119642f8715a1254cd58cc3221d5897a46de38f3236a12c7053a2418cfb9b41","observation_id":"0591b254-caa1-494a-b398-26d2c6ffc6a0","resolution":{"observed_at":"2026-08-14T04:33:18.754401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-14T04:33:18.763578Z","title":"arXiv preprint arXiv:2412.15115 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.763578Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:9f849b5623763e00658dffc56b680dc6329e62af3faa2e32607a281a95bcef49","observation_id":"77144e2e-7a70-4c0c-b539-f0be5f866efa","resolution":{"observed_at":"2026-08-14T04:33:18.763578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.774213Z","title":"QwQ-32B: Embracing the Power of Reinforcement Learning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.774213Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:9771062fa78464cf5d045ae04cc17953972849bccf371519463bb8288975dc64","observation_id":"f5844179-db51-4573-b0e0-a3ab341e7457","resolution":{"observed_at":"2026-08-14T04:33:18.774213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.785625Z","title":"Communication, Simulation, and Intelligent Agents: Implications of Personal Intelligent Machines for Medical Education","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.785625Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:367d2c4a255b879e053aecd89e6064921a0a691e725d330635b57eaf91c9495a","observation_id":"c01f1c69-1de9-4dff-854d-9b597ba8c4d4","resolution":{"observed_at":"2026-08-14T04:33:18.785625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.794809Z","title":"Classification Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.794809Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:8997b6d45d64a91dffb1b4c55d6eb17434d91ccf5b0be8f7efd9274f8e93b9fc","observation_id":"67efb1f6-e75b-4934-acbd-343f2ddfc193","resolution":{"observed_at":"2026-08-14T04:33:18.794809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.803133Z","title":", title =","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.803133Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:1230ce10b504fbb305cbde09ee741ee3410c378e9daf6a400f85fbb6d3fdaf85","observation_id":"dcaddd64-a3da-4ef9-9403-e3dd8eb6eed7","resolution":{"observed_at":"2026-08-14T04:33:18.803133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.809882Z","title":"New Ways to Make Microcircuits Smaller---Duplicate Entry","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.809882Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:d9a59add7f300555aa352331f9975a0ff167a7240df58bcd0d8f604a02aed340","observation_id":"e5fa52c0-9791-42a2-83a9-e46edf7ae1d2","resolution":{"observed_at":"2026-08-14T04:33:18.809882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.821820Z","title":"1984 , issn =","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.821820Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:ed80f25d5ebcca38f90269568da43443a70a33a5d6906c29f552c7a629b2335f","observation_id":"7a7f4a04-ef1e-4305-913b-35f989947298","resolution":{"observed_at":"2026-08-14T04:33:18.821820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.829884Z","title":"and Rennels, Glenn R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.829884Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:81da4f42bbc122cca6b6a0a8b4d27e3ff49035264afdde3a9cf21fd388811498","observation_id":"faa51c29-9a42-4877-8695-7ac01371f9a6","resolution":{"observed_at":"2026-08-14T04:33:18.829884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.837786Z","title":"Poligon: A System for Parallel Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.837786Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:778eb07acfc06f4765ecce71c635a631931e78f99a619c9ffd56cf224af858eb","observation_id":"4401b641-7d8c-4cfb-8e86-ea9cb109cd0a","resolution":{"observed_at":"2026-08-14T04:33:18.837786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.846238Z","title":"Transfer of Rule-Based Expertise through a Tutorial Dialogue","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.846238Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:07a25f38dbb7afc5a9cec49def6250070106f5ef37623794cd9614869c1af72d","observation_id":"ec79d383-85f2-47bf-9bd3-00fef4de0f20","resolution":{"observed_at":"2026-08-14T04:33:18.846238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.860658Z","title":"The Engineering of Qualitative Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.860658Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:6ebbd5e9aad570dc0e903dc2907fa4471ae6fe6b5c621b481aff96c47f12c851","observation_id":"971f3d2a-25fc-4904-9f7d-39a558c8b6bd","resolution":{"observed_at":"2026-08-14T04:33:18.860658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.869758Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.869758Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:a3e37d25bdd773b79b2635e84fdc20fcbaf9ef5a7a0a289695ec604b7a3262aa","observation_id":"766e161b-f797-4ede-b31d-4cb20f951db7","resolution":{"observed_at":"2026-08-14T04:33:18.869758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.877228Z","title":"Pluto: The 'Other' Red Planet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.877228Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:6212b59589f9ecdb5c59da60f122125dbf63d5caff87a8ea71f2c53eed39eeb5","observation_id":"a8df920f-176e-4bb0-96da-0b5bc2e5c68b","resolution":{"observed_at":"2026-08-14T04:33:18.877228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.888727Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.888727Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:838f2d05d8ec1557f79c366b552a38f0bbeb3a9c24c78bf499d1e0a160a5ea83","observation_id":"8be06c36-54c9-4ba7-a798-c6ce368263d5","resolution":{"observed_at":"2026-08-14T04:33:18.888727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.894854Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.894854Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:115215b660c36a07b1c05e383899f7ed2b78557de1ec833152e8337c56910de6","observation_id":"07cc9b6c-3011-4e3d-add0-7696c76521fa","resolution":{"observed_at":"2026-08-14T04:33:18.894854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.903830Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.903830Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:0876d0a20e18ec684a5fd824eb7411d63d980f857ed038e8d479a8f996e6f9c5","observation_id":"236a2775-18a5-44b4-a488-e73d0d4bc210","resolution":{"observed_at":"2026-08-14T04:33:18.903830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.922106Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.922106Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:1fe1e4e30e676bcbabd5a320c70797a023cdd374545ebd45f8f6f496cd4b8d75","observation_id":"65c69e06-5d9c-46b7-ae4b-178ec3f8df9c","resolution":{"observed_at":"2026-08-14T04:33:18.922106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.946894Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.946894Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:44d1c50f0d46ad5c925f8eca8d29e407cbc9fc394579825723c1920cc6b9ee41","observation_id":"4b61cf13-826f-48b0-a4c7-fe3eceae66fb","resolution":{"observed_at":"2026-08-14T04:33:18.946894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.958576Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.958576Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:870f933a6ea31c6ffc5243175b01dbdb77be7f5fa50de6c493364d15595c5cb4","observation_id":"f0ae6c48-45b9-49bb-b05b-a74f4202ed8c","resolution":{"observed_at":"2026-08-14T04:33:18.958576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:18.966385Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:18.966385Z"},"links":{"citing_paper":"/paper/2608.08623"},"observation_digest":"sha256:10e73a38508982cf8b8918d0a60ee54b08501476e554986c4d76cd595390b533","observation_id":"2940a602-0bef-4779-8dee-c71d2903d0d8","resolution":{"observed_at":"2026-08-14T04:33:18.966385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.08623","last_updated":"2026-08-09T10:13:20Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T12:03:13.382115Z","submitted_at":"2026-08-09T10:13:20Z","title":"MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":74,"verified_exact":3,"verified_fuzzy":10},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 0 inbound Pith citation observations for arXiv:2608.08623."}