{"as_of":"2026-08-19T10:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c7f48faa8db9a9eb9dd06633afdba27b6a62b4f210f1c2ce2a876a8f0c168feb","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T22:25:35.119625Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:07:43.937980Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05861","snapshot_observed_at":"2026-08-01T07:07:43.937980Z","title":"Vl-rethinker: Incentivizing self-reflection of vision-language models with reinforcement learning.Advances in Neural Information Processing Systems, 38:30865–30891, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21556","last_updated":"2026-07-23T17:37:37Z","snapshot_observed_at":"2026-08-12T17:06:14.400229Z","submitted_at":"2026-07-23T17:37:37Z","title":"Visual Contrastive Self-Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T07:07:43.937980Z"},"links":{"cited_paper":"/paper/2607.05861","citing_paper":"/paper/2607.21556"},"observation_digest":"sha256:007088ca6c2b05cdba906f4c855b5eac0b5c9f3fc13a29f477e9db59072d14fd","observation_id":"015346d0-d947-4438-ae35-7f953e4d6a52","resolution":{"observed_at":"2026-08-01T07:07:43.937980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.05861/citation-record","integrity":"/paper/2607.05861/integrity","json":"/paper/2607.05861/citation-record.json","paper":"/paper/2607.05861"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.12041","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.486149Z","title":"Improving text-to-image generation with input-side inference-time scaling.arXiv preprint arXiv:2510.12041, 2025a","venue":null,"work_id":"8b20ed2b-c54e-4f90-8c12-b96ee3f41bd3","year":null},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f3df2877cf2dc7750aa6328ec8845d01447ce85cdddabf67d4a0ed7fc0c4dff5","observation_id":"f78885e2-a5d1-43c7-bcb4-82db19fde026","resolution":{"observed_at":"2026-07-08T22:25:39.488004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:5a213bca29d30a9c1a91be1468c875b6ff67a6c7192f20baf1a67d7594f9e354","observation_id":"4172036c-25e3-4fa3-a7d6-3ce61867d503","resolution":{"observed_at":"2026-07-08T22:25:39.498423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.07968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.513727Z","title":"Simpleqa verified: A reliable factuality benchmark to measure parametric knowledge","venue":null,"work_id":"3d4a65f9-9e86-4917-93c9-2ddb7dc78553","year":2026},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:db0dc2d9b175c09e15cc18e6dafcc77600a15ab176ffd382a1fdbbf7e29c9458","observation_id":"439de9c2-ba8c-4d7a-babb-2af5d81b7bc4","resolution":{"observed_at":"2026-07-08T22:25:39.515791Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23392","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.499990Z","title":"Your models have thought enough: Training large reasoning models to stop overthinking.arXiv preprint arXiv:2509.23392,","venue":null,"work_id":"34a3fd7c-9f90-41d9-9a6a-3aec784129a4","year":null},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:ee014811ec54fe40ee105665f851a9e2a128bfb46bff9061fb5b809892382560","observation_id":"378ae87d-3737-4926-9fb5-67d5ee7c0ad9","resolution":{"observed_at":"2026-07-08T22:25:39.502352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-08-16T03:03:21.512563Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":"2111.09543","doi":"10.48550/arxiv.2111.09543","metadata_source":"pith","pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","venue":"cs.CL","work_id":"480bf7dd-7121-4d1f-8b53-7cc6ce479835","year":2021},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:64e9f04a3aa7c9a62cde0a5b11de9e3eb4d1d8a685cf89b53264e50f27471208","observation_id":"5626b2da-b009-4083-a6a5-b40232e5cb46","resolution":{"observed_at":"2026-07-08T22:25:39.512464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-10T18:38:12.96464+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T18:38:12.96464+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-10T17:58:02.856512Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:ae094bfad330c1f75a2fb82364d1dc480fa84fa953f51828979ed98c0e27bac5","observation_id":"212e8307-e81a-479c-a1aa-106cd0950245","resolution":{"observed_at":"2026-07-08T22:25:39.476832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:7904f86b573e6c1a5e1b35d50d0249eb5a1837cbd49133e3ffa752b2a313277c","observation_id":"79c9d6de-ad71-41fa-b4ea-f910e311639d","resolution":{"observed_at":"2026-07-08T22:25:39.519029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05164","last_updated":"2026-08-08T06:26:16Z","snapshot_observed_at":"2026-08-13T23:15:38.974751Z","submitted_at":"2026-04-06T20:48:51Z","title":"Not All Turns Are Equally Hard: Adaptive Thinking Budgets For Efficient Multi-Turn Reasoning in Agents","version":3},"cited_work":{"arxiv_id":"2604.05164","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05164","snapshot_observed_at":"2026-07-08T22:25:39.523993Z","title":"Not All Turns Are Equally Hard: Adaptive Thinking Budgets For Efficient Multi-Turn Reasoning","venue":"cs.LG","work_id":"12526b58-abd0-4150-b6f7-ebe97866b15d","year":2026},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2604.05164","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:9d3265419c57ca9edc037b78066e2f93996eddfbc8ad60ae9fb6099d7eba21d9","observation_id":"97309de7-fb92-4a8f-9b92-3f424bfca6ce","resolution":{"observed_at":"2026-07-08T22:25:39.525478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.578171Z","title":null,"venue":null,"work_id":"4eaa8d8a-98f3-4d32-88ef-6e6a443520bd","year":2019},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:ec323a7e10f925e31d6f68df08a514e61183c606fcd507e1e05dfef105fe2823","observation_id":"ef48be6c-b42c-4735-bc2a-826ba7a60f0c","resolution":{"observed_at":"2026-07-08T22:25:39.579426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.579776Z","title":null,"venue":null,"work_id":"bb08629b-74a3-4cb6-8149-13c977839d6e","year":2020},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f36534678df0dea4f41022b6069efc33539abae18488dd8149e97fb993791f87","observation_id":"4e574cb2-ac5b-4bed-b051-d2b58a9a6bfb","resolution":{"observed_at":"2026-07-08T22:25:39.581612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:015c63fd4e5d4c41595f717ff8fd8ba220165dc4e4581c2d7bedb97659cbf820","observation_id":"14bb2cb9-c0cb-4a25-8be8-8f4093ddb6df","resolution":{"observed_at":"2026-07-08T22:25:39.521701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-08-16T04:48:18.978901Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":"2505.00127","doi":"10.48550/arxiv.2505.00127","metadata_source":"pith","pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Betweenunderthinkingandoverthinking: Anempiricalstudyofreasoninglengthandcorrectnessinllms.arXivpreprint","venue":"cs.CL","work_id":"b686084f-7501-4f71-bba5-86b60b1504f7","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:0166c438c2f24401cc15a80c0c712e2d622882b98d2ff35bc6b7f74059afc1da","observation_id":"ae6a39f5-3cca-4c85-af88-d055964d0cfc","resolution":{"observed_at":"2026-07-08T22:25:39.495002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12886","last_updated":"2025-05-19T09:16:40Z","snapshot_observed_at":"2026-08-15T20:22:03.928200Z","submitted_at":"2025-05-19T09:16:40Z","title":"Detection and Mitigation of Hallucination in Large Reasoning Models: A Mechanistic Perspective","version":1},"cited_work":{"arxiv_id":"2505.12886","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12886","snapshot_observed_at":"2026-07-08T22:25:39.515388Z","title":"arXiv preprint arXiv:2505.12886 , year=","venue":"cs.AI","work_id":"d1d6c48e-cd65-4a3e-a441-d1763a509d45","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.12886","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:ce8b9fdabbc329843532a8a61fc30ccb9018a760da14f3aa6176fc9539ac74a7","observation_id":"11939e0f-e700-4b7a-896e-822373b2318d","resolution":{"observed_at":"2026-07-08T22:25:39.516771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":"2506.18237","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-07-08T22:25:39.517114Z","title":"Adapthink: Adaptive thinking pref- erences for reasoning language model","venue":"cs.LG","work_id":"7604f65a-25dd-4e1b-ab08-765d419b68e1","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:357c64bbb44b21dab533614673dc8d78f6bf70779fadfd520f8745468af6c939","observation_id":"3131f75a-e836-4b65-9e7d-5f7bd9109e76","resolution":{"observed_at":"2026-07-08T22:25:39.518829Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27332","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.482773Z","title":"Unsafe by reciprocity: How generation-understanding coupling undermines safety in unified multimodal models.arXiv preprint arXiv:2603.27332,","venue":null,"work_id":"6813a34d-fbd4-4858-90c0-86bfc2f29da8","year":null},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:c7b5720cef33741e25383d9ada382005ea94b8b8920f80889dd5a19e7ffe5ec5","observation_id":"e5bc2b48-05af-47df-9f1d-0dd8583bdf76","resolution":{"observed_at":"2026-07-08T22:25:39.484751Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:23f0f89c1c3cbaa3a859ef30d64b9bda3a417d7b6a914b8e4e768e87de124f70","observation_id":"26238231-4439-42e6-b9b2-6e29b052237f","resolution":{"observed_at":"2026-07-08T22:25:39.508664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-08-17T10:08:57.374438Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":"2411.04368","doi":"10.48550/arxiv.2411.04368","metadata_source":"pith","pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring short-form factuality in large language models","venue":"cs.CL","work_id":"f8e490ab-7057-43fb-8c6d-06fc603836c7","year":2024},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:ce247e45aac5c90b5b5e3ae9d691804617f0b9c8835ce467a64674141cc202c0","observation_id":"d1dda002-d588-4465-9f9e-8b1129edf6d2","resolution":{"observed_at":"2026-07-08T22:25:39.472828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:55e4432fba036713a31454dbc8af87589f88555e28f324a6a44a92b1d91a49f4","observation_id":"3ddcd1b4-7d39-4b69-9707-b3622cd61e72","resolution":{"observed_at":"2026-07-08T22:25:39.494724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.582048Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":"a40e5111-5d02-4fc6-bc6a-7b205825fff3","year":2018},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f70628971095b060a67ebb7a9c19cb41935a91341abb21451bf0d305a6d55544","observation_id":"dc8f9468-bfc5-4825-9119-4b989cd0c30f","resolution":{"observed_at":"2026-07-08T22:25:39.583408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-14T17:02:28.739687Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:84ff5f6fc5ac3025f274327d890967d8f6759ab309fbc8691c190552f795231d","observation_id":"5d2ff7b9-f1d2-465b-bcd3-d1115e9ac8f4","resolution":{"observed_at":"2026-07-08T22:25:39.514165Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.17587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.471373Z","title":"Hallurnn: Mitigating hallucinations via recurrent cross-layer reasoning in large vision-language models","venue":null,"work_id":"721e46d6-f130-41f3-812e-4b0e41c89d2c","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:e1a05140f2081d0fdfdc54d506755a6928358a8ef61071d00216f4f1143f1911","observation_id":"c6683de8-a772-4165-857f-8bd5b86c4256","resolution":{"observed_at":"2026-07-08T22:25:39.473432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.573829Z","title":"Unraveling hallucination in large reasoning models: A topological perspective","venue":null,"work_id":"36c2d375-fb1a-4a4d-8882-82670e5d97e8","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:737df8991b296ed2248f3c06ee0946a3bff4b0c40fe6072894e7f9ed5f079fab","observation_id":"96dae197-bff3-4abd-8b7a-dada2a6c2ff1","resolution":{"observed_at":"2026-07-08T22:25:39.575179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09797","last_updated":"2024-10-07T04:28:04Z","snapshot_observed_at":"2026-08-16T15:39:13.160910Z","submitted_at":"2023-04-19T16:29:48Z","title":"Progressive-Hint Prompting Improves Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2304.09797","doi":"10.48550/arxiv.2304.09797","metadata_source":"pith","pith_arxiv_id":"2304.09797","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progressive-hint prompting improves reasoning in large language models","venue":"cs.CL","work_id":"9aa19a03-b5e5-4a8b-9a9b-c8f38d16c7d2","year":2023},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2304.09797","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:878fe83e1cabcb0d818fea69aa31a47ea8794689761379806108960a2a0bd014","observation_id":"1a8b30ef-032d-4beb-99f5-a9cdfb02e038","resolution":{"observed_at":"2026-07-08T22:25:39.491495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.03845","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.503631Z","title":"Parallel-probe: Towards efficient parallel thinking via 2d probing","venue":null,"work_id":"7d1cb8bf-5ba0-4eb3-8438-48cfad80c8ea","year":2026},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:10894efdfad8d57ee3defd102d529820d9253b82a18e98d21b6aafd3664f9fab","observation_id":"06880647-70f8-45c1-84dd-bd54ffdf7cbb","resolution":{"observed_at":"2026-07-08T22:25:39.505727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.582246Z","title":"A”, “B”, or “C","venue":null,"work_id":"43bbff17-f1d4-4132-ab8a-02cf93ec89a9","year":1998},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:54b21f51b6d9789d6d1f04c449974054411a13875cfa89fa0db47c94857e9155","observation_id":"92d0ab6c-4e9d-4e3a-8c3d-ea00a32bdf90","resolution":{"observed_at":"2026-07-08T22:25:39.583597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.577981Z","title":"it is possible that","venue":null,"work_id":"a79d64d0-5e2c-4a4c-8eb9-c13ea5c7bb32","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:68e734cc93159242ec7216c2e5737c41f48f4aee8935414fc32b121708880e08","observation_id":"b13bbe99-e567-4f84-b560-4a158f8b55aa","resolution":{"observed_at":"2026-07-08T22:25:39.579230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.584137Z","title":null,"venue":null,"work_id":"a9fac354-154d-4dbb-a5d7-ba01e949b882","year":2021},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:57a7218432fc24b5c586d8d1d40d77af3509752e095af15e53116992d52328c0","observation_id":"7a77d263-d036-4094-8f32-6d536bf31ae0","resolution":{"observed_at":"2026-07-08T22:25:39.586035Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":19,"verified_fuzzy":4},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2607.05861."}