{"as_of":"2026-08-05T23:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e204967bf00f38ca65ce4b1ef185730b14e044854dabdf44ae2314e2554cf326","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:12:20.864362Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:39:40.459071Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07316","snapshot_observed_at":"2026-08-01T18:39:40.459071Z","title":"Implicit compression regularization: Concise reasoning via internal shorter distributions in rl post-training.arXiv preprint arXiv:2605.07316, 2026a","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17247","last_updated":"2026-07-19T13:32:54Z","snapshot_observed_at":"2026-08-05T01:25:41.831733Z","submitted_at":"2026-07-19T13:32:54Z","title":"Distilled Reinforcement Learning for LLM Post-training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T18:39:40.459071Z"},"links":{"cited_paper":"/paper/2605.07316","citing_paper":"/paper/2607.17247"},"observation_digest":"sha256:e748f0b59730152d210b6a1a0ec40ae01d4155b18c23ab6bdbcdfb4dff426eb3","observation_id":"ecf09c03-2927-4a36-9243-d9819033cdab","resolution":{"observed_at":"2026-08-01T18:39:40.459071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.07316/citation-record","integrity":"/paper/2605.07316/integrity","json":"/paper/2605.07316/citation-record.json","paper":"/paper/2605.07316"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.595164Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"a3ac3b4d-8c58-4772-ad55-18e8fb162bd1","year":2022},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:4e55b78fe4c2046f8e1ddf50b81c2cc879932a6ea994b1ce34bf1538ef62b173","observation_id":"91e96891-59ce-46fb-bd14-4f1f141d98c6","resolution":{"observed_at":"2026-05-14T17:27:31.528208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:d4f4424c7462cf3adcf1e41ee2de4b80abce2fc2e2b015013b4427a4cc55f76c","observation_id":"7c324769-3218-465d-b791-1f58c8aaf5d0","resolution":{"observed_at":"2026-05-11T04:35:59.752966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":"2501.12599","doi":"10.48550/arxiv.2501.12599","metadata_source":"pith","pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","venue":"cs.AI","work_id":"bff96ab1-bd6a-4585-be23-74fdb51969c7","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:8640ab42314a9cae3e96f862c1f29cb7995fcccf36b57f29af0f9a5b05b3cf6b","observation_id":"dea649c4-6c98-4252-a624-c6b667204ecc","resolution":{"observed_at":"2026-05-11T04:35:59.869378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:a1473dac866fe32260be18cbe6ab1f1c4ad2eb8aeeb364f9eadb9d85530af54a","observation_id":"382a8b7e-f7e9-42ba-a869-99cea33ba63d","resolution":{"observed_at":"2026-05-11T04:35:59.853337Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-07-06T21:17:19.119854Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":"2505.00127","doi":"10.48550/arxiv.2505.00127","metadata_source":"pith","pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Betweenunderthinkingandoverthinking: Anempiricalstudyofreasoninglengthandcorrectnessinllms.arXivpreprint","venue":"cs.CL","work_id":"b686084f-7501-4f71-bba5-86b60b1504f7","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:f0f235353c89742bcebfa2bb77e88e65c6553ad533ea87e90c9de79f721742a0","observation_id":"4c7adc71-39bf-4e3d-b1f4-5aa3f0f4f6c8","resolution":{"observed_at":"2026-05-11T04:35:59.693494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-07-06T21:51:24.566962Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":"2507.02076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-04T10:39:45.816513Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":"ce2ea139-eaf6-4e82-a16d-cfa8657ac65c","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:315f784c69df6c1dd8237301e964b6af25b0672e8c77a0daca26ed7a24f089a2","observation_id":"a17cc85f-a316-4bef-adcc-640fb215f5ba","resolution":{"observed_at":"2026-05-11T04:35:59.813805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":"2412.21187","doi":"10.48550/arxiv.2412.21187","metadata_source":"pith","pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","venue":"cs.CL","work_id":"d79f8b7d-560d-4fbd-bd70-4d084f6d9ad6","year":2024},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:090ea78f10b37f8af69701d1a4ddbc5042d1705f4920a6c7536d83473085136b","observation_id":"5e516f3c-ad6d-4590-99d6-7dcaf053f4fe","resolution":{"observed_at":"2026-05-13T15:51:30.429014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-03T03:23:56.857266Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.16419","doi":"10.48550/arxiv.2503.16419","metadata_source":"pith","pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","venue":"cs.CL","work_id":"21afd80d-63a7-472b-800d-3b81161c39d3","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:673f202adae73823dba7fc19472bf97255cdad7f77ac83e08b3bb64d8e4a91d5","observation_id":"bc60c29f-e64e-4c1d-8d8c-ddc4ec6841ed","resolution":{"observed_at":"2026-05-14T01:29:57.879683Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:b0f6d9118626ed7c5ae8e86617b9bb014c6e583fa7c72f30bd102e727068666a","observation_id":"523ea300-591f-4fe0-8279-3dd872289080","resolution":{"observed_at":"2026-05-11T04:35:59.986351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.21370","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shorterbetter: Guiding reasoning models to find optimal inference length for efficient reasoning","venue":null,"work_id":"a147911b-5594-4394-a39d-f4e4768bdc48","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:95b0ae8a9b859506a13db052b2cc7ae86e1f0c08753f929b8c5a579e48d1deb4","observation_id":"858f7524-ac87-4673-934c-914e639251a6","resolution":{"observed_at":"2026-05-11T04:35:59.784194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05261","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.206934Z","title":"Length-unbiased sequence policy optimization: Revealing and controlling response length variation in rlvr.arXiv preprint arXiv:2602.05261","venue":null,"work_id":"f6f02ecf-aabd-4b03-a178-c1f92786f2d4","year":2026},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:f13d48e8ff6b612a6be48637246e8d5ef5d5b6e5bd29467b2a0f942fb8c29bc5","observation_id":"9c3f1357-e3e3-422c-884b-cff07b2a11f8","resolution":{"observed_at":"2026-05-11T04:35:59.946039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.09591","last_updated":"2026-06-10T09:27:06Z","snapshot_observed_at":"2026-08-03T02:51:55.634332Z","submitted_at":"2026-02-10T09:45:42Z","title":"On the Optimal Reasoning Length for RL-Trained Language Models","version":3},"cited_work":{"arxiv_id":"2602.09591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.09591","snapshot_observed_at":"2026-06-11T02:08:42.864067Z","title":"On the optimal reasoning length for rl-trained language models","venue":null,"work_id":"02684ab5-c10f-462b-b34c-67bbe0617c12","year":2026},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2602.09591","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:50a491e6f7b848513300a7699a7e34f386e59ce7802a4b820bc805be81e8904d","observation_id":"2bb18992-52ae-4298-8fb8-c4e1a17e6a09","resolution":{"observed_at":"2026-06-11T02:08:42.864067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":"2504.13837","doi":"10.48550/arxiv.2504.13837","metadata_source":"pith","pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","venue":"cs.AI","work_id":"d854765a-e664-41c0-8655-21c4bf2e0cc4","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:8604a13148df5d6b6e1c4e1b49e03865d6efdba953bc07e5a5364a330b1ec75b","observation_id":"d851b4fc-b9d4-4e7c-8dc5-3e7b345ffe8e","resolution":{"observed_at":"2026-05-11T04:35:59.845713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:42.002839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:42.002839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07686","last_updated":"2025-05-17T04:01:57Z","snapshot_observed_at":"2026-08-02T07:33:26.998080Z","submitted_at":"2025-05-12T15:50:44Z","title":"S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models","version":2},"cited_work":{"arxiv_id":"2505.07686","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07686","snapshot_observed_at":"2026-07-05T18:41:19.734115Z","title":"S-grpo: Early exit via reinforcement learning in reasoning models.arXiv preprint arXiv:2505.07686","venue":"cs.AI","work_id":"730f0353-5985-4718-8b70-09b5c5ffa80c","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2505.07686","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:29bc355d41b5f214923aa62001240f6185bd5491fdfc832c6138fcf04cb8a827","observation_id":"e29ec674-0fbe-463b-b15c-0e7904a9939a","resolution":{"observed_at":"2026-05-11T04:35:59.831136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.02249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T09:19:43.851648Z","title":"Explore briefly, then decide: Mitigating llm overthinking via cumulative entropy regulation","venue":null,"work_id":"9d4ad0c1-c2fa-4383-aef6-f7ee3921102b","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:4b9cd5e7917ed4f284aa6e6904af61b5a2d8cb2ab03d4f803740166537673a43","observation_id":"82a05dd3-6a45-44a9-834b-0ac172f5e82f","resolution":{"observed_at":"2026-05-11T04:35:59.877940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14755","last_updated":"2025-09-11T02:13:24Z","snapshot_observed_at":"2026-08-04T13:59:57.674812Z","submitted_at":"2025-06-17T17:50:16Z","title":"Optimizing Length Compression in Large Reasoning Models","version":2},"cited_work":{"arxiv_id":"2506.14755","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14755","snapshot_observed_at":"2026-07-01T23:26:22.299993Z","title":"Yuanlin Chu, Bo Wang, Xiang Liu, Hong Chen, Aiwei Liu, and Xuming Hu","venue":null,"work_id":"242a7a02-d28b-4da9-b88c-5e49bca6f907","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2506.14755","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:3e76564bfdf973a4641b69166587194ea463e6a0d49390903ea6dfe8393fe386","observation_id":"0809db36-c9f9-448e-83e8-83e98ef3a1c4","resolution":{"observed_at":"2026-05-11T04:35:59.740619Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06514","last_updated":"2025-04-11T02:36:28Z","snapshot_observed_at":"2026-07-06T21:06:27.043207Z","submitted_at":"2025-04-09T01:25:27Z","title":"Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?","version":2},"cited_work":{"arxiv_id":"2504.06514","doi":"10.48550/arxiv.2504.06514","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.06514","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Missing premise exacerbates overthinking: Are reasoning models losing critical thinking skill?arXiv preprint arXiv:2504.06514","venue":"ArXiv.org","work_id":"1529b935-8663-45f4-847e-3c0ed9965ba2","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2504.06514","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:d6883e1d64f57b3b6b558a079a7cc5d6b5ae69e3c58c8b03e099c65ae8981080","observation_id":"30a50862-f941-4f8c-8585-f242735d6ccf","resolution":{"observed_at":"2026-05-11T04:35:59.823484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , journal =","venue":null,"work_id":"5baa1156-8008-4fd3-a4b3-2885c5cf72dd","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:f97590aedacbaebac1e00b82f68e7ff4b701be9c837779e3d78bf1b49d3d1aee","observation_id":"d996b2c1-faa1-4792-bec6-3842afdbf886","resolution":{"observed_at":"2026-05-11T04:35:59.680569Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08235","last_updated":"2025-02-12T09:23:26Z","snapshot_observed_at":"2026-07-06T20:35:16.369243Z","submitted_at":"2025-02-12T09:23:26Z","title":"The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks","version":1},"cited_work":{"arxiv_id":"2502.08235","doi":"10.48550/arxiv.2502.08235","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.08235","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The danger of overthinking: Examining the reasoning-action dilemma in agentic tasks","venue":"ArXiv.org","work_id":"4600dc6b-7c39-4ddb-9872-e03cb8a7efae","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2502.08235","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:14779dc91d9396f28b731d221e47a0deba4b07c3b9e52b540b351efa040ac12e","observation_id":"e2efe663-dd40-4762-8852-1ebd6706bb78","resolution":{"observed_at":"2026-05-11T04:35:59.710465Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.04463","doi":"10.48550/arxiv.2502.04463","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to reason efficiently","venue":"ArXiv.org","work_id":"ddc0d049-f0ca-4946-aa25-6843f6072e08","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:5c67996ad9f4fe2ae490f7c3c87fc1d761b3ec7dd891b7f6cfc9576a83b8a89b","observation_id":"11a22fa5-d1c3-421b-85d2-0dedcfd2c553","resolution":{"observed_at":"2026-05-11T04:35:59.718679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15612","last_updated":"2025-05-21T15:03:26Z","snapshot_observed_at":"2026-07-31T03:41:47.823516Z","submitted_at":"2025-05-21T15:03:26Z","title":"Learn to Reason Efficiently with Adaptive Length-based Reward Shaping","version":1},"cited_work":{"arxiv_id":"2505.15612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15612","snapshot_observed_at":"2026-07-04T09:19:43.881659Z","title":"Learn to reason efficiently with adaptive length-based reward shaping","venue":null,"work_id":"6baef149-2491-431c-a612-c9fea9b25a16","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2505.15612","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:0418f4a187553bea671af4ff1420800d5571c08e1cf3981082f0098af66d3510","observation_id":"621aa321-98df-4cf1-8d43-93fc91d81e1d","resolution":{"observed_at":"2026-05-11T04:36:00.027949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22642","last_updated":"2026-06-18T19:10:56Z","snapshot_observed_at":"2026-08-04T14:01:22.477463Z","submitted_at":"2026-02-26T05:47:30Z","title":"Compress the Easy, Explore the Hard: Difficulty-Aware Entropy Regularization for Efficient LLM Reasoning","version":2},"cited_work":{"arxiv_id":"2602.22642","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.22642","snapshot_observed_at":"2026-06-23T01:12:02.291141Z","title":"Compress the easy, explore the hard: Difficulty-aware entropy regularization for efficient llm reasoning","venue":null,"work_id":"abd2f583-bff6-417e-8480-371f7e47a6c6","year":2026},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2602.22642","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:9eb53c4ba47229d6b140dd20ee2b4feb692b01d0581da362223f86e66bc43d81","observation_id":"902f5ff5-d894-4cdf-8cb7-c4071c5d5742","resolution":{"observed_at":"2026-06-23T01:12:02.291141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.27419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepcompress: A dual reward strategy for dynamically exploring and compressing reasoning chains","venue":null,"work_id":"768aa325-31d5-447f-9b68-d7f1a740195f","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:6c6174f045ce6613912c713980dc93cb3d6b9908dbdb17d8796870e087c7656f","observation_id":"e7c4f40f-4e81-4b8c-a167-3a09be53fdc0","resolution":{"observed_at":"2026-05-11T04:35:59.747885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.08000","last_updated":"2026-05-31T07:35:35Z","snapshot_observed_at":"2026-08-05T02:17:13.104115Z","submitted_at":"2026-03-09T06:08:14Z","title":"SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2603.08000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.08000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smartthinker: Progressive chain-of-thought length calibration for efficient large language model reasoning","venue":null,"work_id":"ce75c178-148d-457e-94b2-2ba4871a56c7","year":2026},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2603.08000","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:04a3200152322c1402b3d1b901e6125cc9086444cc9c5faf788eac809e0aa5cf","observation_id":"5898e4d1-b6b1-4d22-af7f-e5e754e60ac1","resolution":{"observed_at":"2026-06-02T02:04:15.814003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18298","last_updated":"2025-05-23T18:44:46Z","snapshot_observed_at":"2026-08-02T23:43:01.892569Z","submitted_at":"2025-05-23T18:44:46Z","title":"Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards","version":1},"cited_work":{"arxiv_id":"2505.18298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18298","snapshot_observed_at":"2026-07-04T09:19:43.854814Z","title":"Thinking fast and right: Balancing accuracy and reasoning length with adaptive rewards","venue":null,"work_id":"3e34189b-2679-47d3-96ef-27405bed04a7","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2505.18298","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:c6697d7de3a4037163cd464228e46f5d70ab1d1d4eeaae0379bc75335498e7dd","observation_id":"4369648a-efbc-44ca-b123-55488db6a1dc","resolution":{"observed_at":"2026-05-11T04:35:59.701953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptthink: Reasoning models can learn when to think","venue":null,"work_id":"cab1903a-91f5-4e7c-9943-0c503a03a470","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:0b36ad07c7a4bf1777bf92412d320d9735cc683926b1ae7e07069e002d4ab7fb","observation_id":"7aac7b12-34de-4f66-a37a-85817e8be6e5","resolution":{"observed_at":"2026-05-14T17:27:31.477271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-07-06T20:42:42.466871Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":"2502.18600","doi":"10.48550/arxiv.2502.18600","metadata_source":"pith","pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.18600 , year=","venue":"cs.CL","work_id":"9bb5ce25-93d1-4df0-bba6-491d6ba79d28","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:dd85a1545f7f706416898d7ae6d38c642c419814355c7aea58a830274ae936c5","observation_id":"87f66fed-3d7f-449b-8072-97ab65fa8de9","resolution":{"observed_at":"2026-05-11T04:35:59.900134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:0c2fb68b36ead194de0520521684f2d4fc1a5e0ec1917151af5a128756eccac9","observation_id":"a2038e33-a1d3-4ef7-803f-99fd6fbbb808","resolution":{"observed_at":"2026-05-11T04:35:59.802958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Easyr1: An efficient, scalable, multi-modality rl training framework","venue":null,"work_id":"702ac6dd-7d5a-42bd-92b8-751dc0c62aa2","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:30e60c4a4cc267e7662930cf2291191102f453d84d7667000c900087433ac132","observation_id":"0e1542cd-3c0e-492b-aef6-270839fab4df","resolution":{"observed_at":"2026-05-14T17:27:31.486327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T17:35:10.023423Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":"37ada09c-055c-4ab6-99e5-393107343cd6","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:f8b6d453cada2761b2484729567bb25ee23feb33d98d4b51e30f27ea1142cf83","observation_id":"0307b7ff-7dd8-42d0-9f09-d58c28a74063","resolution":{"observed_at":"2026-05-14T17:27:31.510937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23281","last_updated":"2026-01-14T21:39:58Z","snapshot_observed_at":"2026-08-02T10:05:44.330694Z","submitted_at":"2025-05-29T09:28:06Z","title":"MathArena: Evaluating LLMs on Uncontaminated Math Competitions","version":3},"cited_work":{"arxiv_id":"2505.23281","doi":"10.48550/arxiv.2505.23281","metadata_source":"pith","pith_arxiv_id":"2505.23281","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MathArena: Evaluating LLMs on Uncontaminated Math Competitions","venue":"cs.AI","work_id":"61e8d872-ccc7-46b8-8ec1-94008704c941","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2505.23281","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:cfd0e11c051f80f0ac1eec189b36d3a02b33e8a2746b3deff214868bf6c3743f","observation_id":"e0fa0a3f-c747-47a6-bb6a-3321c8fce8a3","resolution":{"observed_at":"2026-05-15T00:10:14.938194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:19.286508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:19.286508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":"2305.20050","doi":"10.1007/bf00262952","metadata_source":"pith","pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Let's Verify Step by Step","venue":"cs.LG","work_id":"6d05b790-04c5-4fd2-91b2-ba1dfdd5770f","year":2023},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:b124915d8278c017a89621738b6e9daccaa35cbf6cda1ec0185dd31394539458","observation_id":"6220c4ba-6214-40c5-b81d-b303e91ae715","resolution":{"observed_at":"2026-05-11T04:36:00.019738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:8ad2e30a645a833f6f51b058870ab3f81345b8b577a6d5f6b9c9857400e9c606","observation_id":"1b513867-1f1a-488a-b858-ed9731639766","resolution":{"observed_at":"2026-05-11T04:36:00.009953Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:c1e27624fc6f15e8920c98b4bc98c96e9597c07a484a3f763b155ca14f5973f0","observation_id":"d8cef271-bb77-44f9-9d9a-b0937f66f8ac","resolution":{"observed_at":"2026-05-11T04:35:59.795200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:25.345368Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark.Advances in Neural Information Processing Systems, 37:95266–95290","venue":null,"work_id":"8ce2e771-bc8c-4b3b-a834-6303b981b746","year":2024},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:a91ec7ca253ac76d737af80d86919e42a1ddbebf3d518d40916e2ac0f5d8e914","observation_id":"fcb8b05d-5457-4aba-a0e5-5f60bc40d167","resolution":{"observed_at":"2026-05-14T17:27:31.499355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":"2502.14739","doi":"10.48550/arxiv.2502.14739","metadata_source":"pith","pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","venue":"cs.CL","work_id":"58a97b2d-494b-4c1a-bd65-13fa6bb7f8f6","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:354a6da5e71696c90bf122b16ca9cba9b61b672800057e8528818beaf0105335","observation_id":"af6d637b-0215-42d2-a44e-eda3bd6f84d2","resolution":{"observed_at":"2026-05-16T00:47:04.366365Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:52:42.853111+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:52:42.853111+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guidelines: • The answer [N/A] means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"b1f7c64b-d34c-4e9d-9e56-c469c4168f33","year":null},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:a8fb123062f9dd6a9762092c1a20c31dacf7cb8a67b7443af88ac5c19d86bca0","observation_id":"25800b19-0182-4413-b403-5c108fc0ac15","resolution":{"observed_at":"2026-05-14T17:27:31.519362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":28,"verified_fuzzy":6},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2605.07316."}