{"as_of":"2026-08-19T06:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5447dafd1fb660f48db290a679153b3c77b4367564b197cd85ecfae6a6e126b4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:51:06.663262Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-09T22:20:13.669361Z","title":", Feng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18858","last_updated":"2025-06-06T18:49:45Z","snapshot_observed_at":"2026-08-16T14:46:55.635889Z","submitted_at":"2025-01-31T02:39:07Z","title":"BRiTE: Bootstrapping Reinforced Thinking Process to Enhance Language Model Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T22:20:13.669361Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2501.18858"},"observation_digest":"sha256:c36d75708df22b806b6cf51cf66e4696916e5fba632e7010f2e70c6f7a4bb7d2","observation_id":"28fc5344-66f0-4006-81e0-516a0875b960","resolution":{"observed_at":"2026-08-09T22:20:13.669361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-08T11:15:44.960566Z","title":"Haolin Chen, Yihao Feng, Zuxin Liu, Weiran Yao, Akshara Prabhakar, Shelby Heinecke, Ricky Ho, Phil Mui, Silvio Savarese, Caiming Xiong, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-18T13:27:55.091611Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.960566Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:5ed28ebd0f9164d143c304219946a8ef1ab0cd644cf9a8a1f1774ff9c86015d5","observation_id":"35a6b2f9-8d39-4f06-adff-8953b346837d","resolution":{"observed_at":"2026-08-08T11:15:44.960566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:178cbc2311af2a160c21ad51531cdc818d4f636f807d66db95b1015168c5a374","observation_id":"6204eb4b-af09-4a0a-95fb-96107ab3a866","resolution":{"observed_at":"2026-05-12T08:40:41.796532Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-15T20:51:06.663262Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11866","last_updated":"2025-05-17T06:17:57Z","snapshot_observed_at":"2026-08-17T17:10:25.671676Z","submitted_at":"2025-05-17T06:17:57Z","title":"Position Paper: Bounded Alignment: What (Not) To Expect From AGI Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:51:06.663262Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2505.11866"},"observation_digest":"sha256:0f727da3efedd6cd6b7e96c1c4c558834b6671c466b1b1ac78108ad1e4c318cb","observation_id":"2d8fbe99-9288-484c-8f15-03077a6ed928","resolution":{"observed_at":"2026-08-15T20:51:06.663262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-07T14:59:15.456174Z","title":"doi:10.48550/ ARXIV.2411.04282 arXiv:2411.04282","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16865","last_updated":"2025-06-04T11:31:59Z","snapshot_observed_at":"2026-08-15T23:54:16.492259Z","submitted_at":"2025-05-22T16:22:54Z","title":"LARES: Latent Reasoning for Sequential Recommendation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.456174Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2505.16865"},"observation_digest":"sha256:942bcd7111b564d14de91e7f4a6e8e195908ae2b388ba8b503b80413ec2d6ac5","observation_id":"60267126-4892-44c3-83d9-e841b54957bd","resolution":{"observed_at":"2026-08-07T14:59:15.456174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-07T14:05:20.874472Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-15T18:16:52.477206Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.874472Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:2c78161d70e82f33c7f3b34e71342f29118c8fabaedd89346213c87773b7c5c0","observation_id":"4f4b8e15-5e15-4a2f-ad02-412bf176573e","resolution":{"observed_at":"2026-08-07T14:05:20.874472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-07T13:35:50.020849Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding.arXiv preprint arXiv:2411.04282, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21493","last_updated":"2025-05-27T17:56:27Z","snapshot_observed_at":"2026-08-13T18:42:34.464744Z","submitted_at":"2025-05-27T17:56:27Z","title":"Reinforcing General Reasoning without Verifiers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.020849Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2505.21493"},"observation_digest":"sha256:0bc59c66f375bfa9b3d0f014059767a7a9a7ce22b9232634a589caf0c0947b86","observation_id":"52ebb6e6-cb33-47bf-9fd6-91affe7684c7","resolution":{"observed_at":"2026-08-07T13:35:50.020849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-07T04:38:09.456278Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10446","last_updated":"2025-06-12T07:49:24Z","snapshot_observed_at":"2026-08-13T09:20:49.647528Z","submitted_at":"2025-06-12T07:49:24Z","title":"Fast on the Easy, Deep on the Hard: Efficient Reasoning via Powered Length Penalty","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:09.456278Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2506.10446"},"observation_digest":"sha256:f67b0d56983c62d1bf4415f4f0ff5ec168a7feebad7ce87b0235ac8eaf684131","observation_id":"4c99523a-ece3-43b6-88ec-2b64a9fcaa15","resolution":{"observed_at":"2026-08-07T04:38:09.456278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2506.13351","last_updated":"2026-05-07T20:19:13Z","snapshot_observed_at":"2026-08-17T13:08:52.450705Z","submitted_at":"2025-06-16T10:43:38Z","title":"Direct Reasoning Optimization: Token-Level Reasoning Reflectivity Meets Rubric Gates for Unverifiable Tasks","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T09:48:56.990745Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2506.13351"},"observation_digest":"sha256:eb057b181857c8b09896887d82eeda8c5d5cbcb321a8435576058563e72f0736","observation_id":"179665dc-1fcf-454b-9c3c-6bf43aa56ab8","resolution":{"observed_at":"2026-05-19T09:52:14.073815Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-06T15:02:26.853811Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17147","last_updated":"2025-07-23T02:26:33Z","snapshot_observed_at":"2026-08-14T08:12:16.849492Z","submitted_at":"2025-07-23T02:26:33Z","title":"CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:02:26.853811Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2507.17147"},"observation_digest":"sha256:13ba1bfae4168903eb25adb20fa5d43c733ec46384b3a72a9a125a6259b74085","observation_id":"6baeb213-9b97-482c-b2d0-cea8eb952187","resolution":{"observed_at":"2026-08-06T15:02:26.853811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T11:39:36.459749Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding.arXiv preprint arXiv:2411.04282, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02350","last_updated":"2025-09-02T14:16:02Z","snapshot_observed_at":"2026-08-16T00:20:00.216356Z","submitted_at":"2025-09-02T14:16:02Z","title":"Implicit Reasoning in Large Language Models: A Comprehensive Survey","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-05T11:39:36.459749Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2509.02350"},"observation_digest":"sha256:0097ab86acceee3781844f86ab43bb92153ce542d824dbea37e6d924ff1a32f6","observation_id":"5abe9b40-224b-4dc7-95d2-83f3a27f7637","resolution":{"observed_at":"2026-08-05T11:39:36.459749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-04T13:51:50.125223Z","title":"Language models are hidden reasoners: Unlock- ing latent reasoning capabilities via self-rewarding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-19T05:36:29.932304Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.125223Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:5abd6448006841a8271b3d5bfc423d42c45d8bc767dfdf468999a70d0b20fef5","observation_id":"d5bd85dc-7ea3-422f-b2ec-095d848a1e5d","resolution":{"observed_at":"2026-08-04T13:51:50.125223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-03T16:43:54.497117Z","title":"Chen, W., Yin, M., Ku, M., Lu, P., Wan, Y ., Ma, X., Xu, J., Wang, X., and Xia, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.12576","last_updated":"2026-05-23T02:48:11Z","snapshot_observed_at":"2026-08-16T22:50:01.648350Z","submitted_at":"2025-12-14T07:03:51Z","title":"Coupled Variational Reinforcement Learning for Language Model General Reasoning","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T16:43:54.497117Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2512.12576"},"observation_digest":"sha256:3a4f7bd1e1163352749882f21501f9612bf9b3dd44c6cad84f3c73afc490b7ae","observation_id":"e026c71f-ed98-4660-954a-bb8ca40016ef","resolution":{"observed_at":"2026-08-03T16:43:54.497117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-03T04:03:51.020124Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.07075","last_updated":"2026-07-23T07:39:02Z","snapshot_observed_at":"2026-08-14T03:28:45.123294Z","submitted_at":"2026-02-06T01:28:27Z","title":"LatentChem: From Textual CoT to Latent Thinking in Chemical Reasoning","version":6},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:51.020124Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2602.07075"},"observation_digest":"sha256:301678b274fda1b57f8fc662cc0547734fb898c8c7d98875343c117eb4265318","observation_id":"fc69de2b-418d-467d-b49d-aa322210ffed","resolution":{"observed_at":"2026-08-03T04:03:51.020124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2602.08167","last_updated":"2026-05-16T05:42:57Z","snapshot_observed_at":"2026-08-16T17:50:48.003461Z","submitted_at":"2026-02-09T00:10:17Z","title":"Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-21T14:03:48.795572Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2602.08167"},"observation_digest":"sha256:71166b5a349f2c14519766a689ef25088f90f04f7c92b950aa90a576d47d8a8d","observation_id":"edbde4cb-91e8-49c1-8443-c29144631805","resolution":{"observed_at":"2026-05-21T14:04:11.993239Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2602.12579","last_updated":"2026-05-22T13:13:23Z","snapshot_observed_at":"2026-08-19T04:31:15.254996Z","submitted_at":"2026-02-13T03:40:52Z","title":"VI-CuRL: Stabilizing Verifier-Independent RL Reasoning via Confidence-Guided Variance Reduction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T07:26:35.767179Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2602.12579"},"observation_digest":"sha256:b8471db3509c231f6917ed892fa048e0431ed13266aaccf3eefcb0ff2acba1a7","observation_id":"307f65aa-17c1-42ea-b2ea-26740158adaf","resolution":{"observed_at":"2026-05-25T07:26:41.674341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-07-13T14:03:01.974171Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding.CoRR, abs/2411.04282, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.02029","last_updated":"2026-06-05T06:21:20Z","snapshot_observed_at":"2026-07-30T23:04:23.206455Z","submitted_at":"2026-04-02T13:36:37Z","title":"The Latent Space: Foundation, Evolution, Mechanism, Ability, and Outlook","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T14:03:01.974171Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2604.02029"},"observation_digest":"sha256:89db50da7a2c9f040d68753ea843a4b452ac6bf901338eb9e36653591b363973","observation_id":"14b95965-dd5e-484d-b895-68bc47d1329c","resolution":{"observed_at":"2026-07-13T14:03:01.974171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2605.10207","last_updated":"2026-05-11T08:52:53Z","snapshot_observed_at":"2026-08-15T01:10:21.441499Z","submitted_at":"2026-05-11T08:52:53Z","title":"LASAR: Latent Adaptive Semantic Aligned Reasoning for Generative Recommendation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T04:58:07.060409Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2605.10207"},"observation_digest":"sha256:63e7ec591f7c9b02e0732695a556d330a4fa8afa3bc09629c61f8e6e6be2a1f8","observation_id":"a628f43c-6c0d-408f-a078-4e7751847f9d","resolution":{"observed_at":"2026-05-12T05:46:28.958348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2606.13061","last_updated":"2026-07-15T17:18:21Z","snapshot_observed_at":"2026-08-14T19:19:00.094748Z","submitted_at":"2026-06-11T08:47:25Z","title":"LaME: Learning to Think in Latent Space for Multimodal Embedding via Information Bottleneck","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T07:31:39.234875Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2606.13061"},"observation_digest":"sha256:5b9ba13e7157fa19adea755596ed29ebaee41d65f1e6af17123225d53b233c6f","observation_id":"7e883577-6c8a-4afc-b647-d44119e552e6","resolution":{"observed_at":"2026-07-03T13:48:21.001531Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2606.19594","last_updated":"2026-06-17T20:56:44Z","snapshot_observed_at":"2026-08-02T12:17:21.328593Z","submitted_at":"2026-06-17T20:56:44Z","title":"Unsupervised Causal Abstractions Discovery","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T20:45:15.226889Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2606.19594"},"observation_digest":"sha256:62ef96a2b363658b73cad79783d80582aacd7ebabc2c6665c753efae4dad2170","observation_id":"332b0302-aef3-4d0c-9719-984935300d68","resolution":{"observed_at":"2026-06-26T20:49:57.368019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2606.27359","last_updated":"2026-06-25T17:58:02Z","snapshot_observed_at":"2026-08-08T13:26:53.952253Z","submitted_at":"2026-06-25T17:58:02Z","title":"When are likely answers right? On Sequence Probability and Correctness in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T01:55:09.626278Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2606.27359"},"observation_digest":"sha256:d9c275d46c6b4369850659bbcf86302d3e68240532d8bfdaa224373a3e64a57f","observation_id":"f9dc57ef-f1d8-41dd-a289-b8f0f9abc9b9","resolution":{"observed_at":"2026-07-04T15:09:54.101012Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":"2411.04282","doi":"10.48550/arxiv.2411.04282","metadata_source":"pith","pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T., Savarese, S., Xiong, C., and Wang, H","venue":"cs.AI","work_id":"37baabdf-ea8c-4e71-a26b-e3aadca42a40","year":2024},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-08-12T14:05:29.940431Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:ad5447af48b36e17cafdff88fb0e31b3f6d9b032f25402e3ebc1afe8a569bccd","observation_id":"ba45b263-4c6f-4fe2-9d36-c4d3b742c98f","resolution":{"observed_at":"2026-07-09T03:45:55.533680Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.04282/citation-record","integrity":"/paper/2411.04282/integrity","json":"/paper/2411.04282/citation-record.json","paper":"/paper/2411.04282"},"outbound":[],"paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T02:24:43.845263Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2411.04282."}