{"as_of":"2026-08-08T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1990fb4cb1239e8d525171c430fee1b65ef92d027188d50718471c3717cfd09","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:34:10.160986Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:35:52.681204Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:58:32.537541Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-07T13:35:52.681204Z","title":"General- reasoner: Advancing llm reasoning across all domains.arXiv preprint arXiv:2505.14652, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21493","last_updated":"2025-05-27T17:56:27Z","snapshot_observed_at":"2026-08-07T21:57:36.964068Z","submitted_at":"2025-05-27T17:56:27Z","title":"Reinforcing General Reasoning without Verifiers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.681204Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2505.21493"},"observation_digest":"sha256:02c8484c4abd0a1d5cca925a244f9dd3d309836f1931f44e690eaa57a68ab608","observation_id":"e8604899-443b-4c3e-8189-b8cef03b172b","resolution":{"observed_at":"2026-08-07T13:35:52.681204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-07T11:13:53.817051Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.817051Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:eed812fffcbb7545c8cf4c80579fa1d248d7cfacd1f00358a6f44d16f4cf8df7","observation_id":"c458e86f-bf83-4911-8d45-be01a33a7d17","resolution":{"observed_at":"2026-08-07T11:13:53.817051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-07T05:26:22.131730Z","title":"General-reasoner: Advancing llm reasoning across all domains.arXiv preprint arXiv:2505.14652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08007","last_updated":"2025-06-09T17:59:53Z","snapshot_observed_at":"2026-08-07T21:57:29.256197Z","submitted_at":"2025-06-09T17:59:53Z","title":"Reinforcement Pre-Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:26:22.131730Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2506.08007"},"observation_digest":"sha256:f6b3ccecd11ed6b141cd02291c3fd04d169f68b8607c67b30dfd03e572edbd9a","observation_id":"b84d26e8-1849-4665-96d1-d46135f5a881","resolution":{"observed_at":"2026-08-07T05:26:22.131730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-06T18:15:37.994518Z","title":"General-reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08794","last_updated":"2026-06-11T04:21:36Z","snapshot_observed_at":"2026-08-06T18:06:40.369641Z","submitted_at":"2025-07-11T17:55:22Z","title":"One Token to Fool LLM-as-a-Judge","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:15:37.994518Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2507.08794"},"observation_digest":"sha256:fa2fd986928717d612b232e88339da7fdef8eb242e63495ba2b486e1369ad973","observation_id":"f78fb8e2-03c2-47d9-a4ab-11b796b2e74a","resolution":{"observed_at":"2026-08-06T18:15:37.994518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-06T17:49:48.886824Z","title":"https://pretty-radio-b75.notion.site/DeepScaleR- Surpassing-O1-Preview-with-a-1-5B-Model-by-Scaling- RL-19681902c1468005bed8ca303013a4e2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09884","last_updated":"2025-07-26T11:17:08Z","snapshot_observed_at":"2026-08-08T07:13:35.945934Z","submitted_at":"2025-07-14T03:45:24Z","title":"VerifyBench: A Systematic Benchmark for Evaluating Reasoning Verifiers Across Domains","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:49:48.886824Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2507.09884"},"observation_digest":"sha256:20c9f28eb7b8c3c739ee7a4c29b1a7378b421e5d810dcd3616700b612c39baf1","observation_id":"1a004ef3-4a04-48a4-845c-295a6671fe8a","resolution":{"observed_at":"2026-08-06T17:49:48.886824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2507.14958","last_updated":"2026-05-24T11:58:35Z","snapshot_observed_at":"2026-08-06T15:41:37.418672Z","submitted_at":"2025-07-20T13:36:19Z","title":"MUR: Momentum Uncertainty guided Reasoning for Large Language Models","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T03:34:06.058415Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2507.14958"},"observation_digest":"sha256:0fb9a0c0c47febf259ab3b5e495ac77b847926147712a34465d697565bbeb8dd","observation_id":"1c1d8365-832a-456a-b54f-62345e323905","resolution":{"observed_at":"2026-05-19T03:37:01.273840Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T06:07:56.678339Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2507.17746"},"observation_digest":"sha256:34f36310530d451305b5bc827bd49b68f14c3239195ac9adcbec6767a86bed8f","observation_id":"8f17ff87-35b6-4bee-b944-dab26b743bfa","resolution":{"observed_at":"2026-05-13T06:07:56.804620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-05T16:32:54.568612Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18255","last_updated":"2025-09-02T17:12:12Z","snapshot_observed_at":"2026-08-08T07:21:34.906013Z","submitted_at":"2025-08-25T17:45:06Z","title":"Hermes 4 Technical Report","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T16:32:54.568612Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2508.18255"},"observation_digest":"sha256:76e6f54cd068464c1a881543c2e6d9f5d633087c98652eac45de7ee2f273c16c","observation_id":"0242803c-7fac-4bad-bf40-2fb9cad42d41","resolution":{"observed_at":"2026-08-05T16:32:54.568612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-03T16:43:56.063243Z","title":"Mathematical Association of America","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.12576","last_updated":"2026-05-23T02:48:11Z","snapshot_observed_at":"2026-08-07T00:51:43.825252Z","submitted_at":"2025-12-14T07:03:51Z","title":"Coupled Variational Reinforcement Learning for Language Model General Reasoning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T16:43:56.063243Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2512.12576"},"observation_digest":"sha256:a41137fbaaf03ef976394f04f11874308a6dd58f851affeccf0ee648c6436dce","observation_id":"f3cbd91c-f7c8-41f4-983f-73cbf847eeea","resolution":{"observed_at":"2026-08-03T16:43:56.063243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-03T11:10:26.169628Z","title":"why should i trust you?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07408","last_updated":"2026-06-03T08:11:38Z","snapshot_observed_at":"2026-08-06T05:45:37.414106Z","submitted_at":"2026-01-12T10:48:02Z","title":"Outcome-Grounded Advantage Reshaping for Fine-Grained Credit Assignment in Mathematical Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T11:10:26.169628Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2601.07408"},"observation_digest":"sha256:77fda3f7babc46f9aeedb6ad280ffa1aafb039263d63e343ed77103a4a853cf9","observation_id":"c5967dec-a513-4d0c-a844-d051323217f3","resolution":{"observed_at":"2026-08-03T11:10:26.169628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2601.21257","last_updated":"2026-04-19T21:04:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T04:36:52Z","title":"MoCo: A One-Stop Shop for Model Collaboration Research","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:37.129753Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2601.21257"},"observation_digest":"sha256:5b7fedbe396749cd6d22c0ead8491f57b03f05974424c65d4b287a788722541d","observation_id":"62f02fdb-4ad0-4d2f-a77c-6f7a85099092","resolution":{"observed_at":"2026-05-16T10:17:43.759451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-03T06:47:17.081766Z","title":"findings-acl.589/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.21864","last_updated":"2026-06-27T16:01:57Z","snapshot_observed_at":"2026-08-07T21:55:52.685811Z","submitted_at":"2026-01-29T15:32:38Z","title":"Knowing Bias, Doing Better: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement","version":2},"reference_index":589,"source":"pdf_text","source_observed_at":"2026-08-03T06:47:17.081766Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2601.21864"},"observation_digest":"sha256:e79c944322b52473061ba14861596e466a780b1795625f146923f0eb5d781b79","observation_id":"64427d66-ef48-4ef3-bb07-287120e20721","resolution":{"observed_at":"2026-08-03T06:47:17.081766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-02T21:05:25.922061Z","title":"Mathematical Association of America","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.21492","last_updated":"2026-07-18T04:56:29Z","snapshot_observed_at":"2026-08-04T06:06:14.689327Z","submitted_at":"2026-02-25T01:54:50Z","title":"GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T21:05:25.922061Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2602.21492"},"observation_digest":"sha256:8cd5042a1cc95a7e51b83e26ab7053413b3d15224d401bb0aa8b4aa6234748b9","observation_id":"ed0e52c4-2ff1-4323-b54f-08c5820904c1","resolution":{"observed_at":"2026-08-02T21:05:25.922061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2604.03472","last_updated":"2026-07-22T14:38:55Z","snapshot_observed_at":"2026-08-02T22:11:20.734730Z","submitted_at":"2026-04-03T21:40:03Z","title":"Vocabulary Dropout for Curriculum Diversity in LLM Co-Evolution","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T19:23:10.901441Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2604.03472"},"observation_digest":"sha256:f773243f0cc74ba2c9969f5c99ee192ff85c7205fe01dad0c78346f6004391b5","observation_id":"797f6862-7acc-4dc6-bcd3-b4badfd13adf","resolution":{"observed_at":"2026-05-13T19:28:10.107358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-02T16:52:28.340493Z","title":"General- reasoner: Advancing llm reasoning across all domains.arXiv preprint arXiv:2505.14652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.03472","last_updated":"2026-07-22T14:38:55Z","snapshot_observed_at":"2026-08-02T22:11:20.734730Z","submitted_at":"2026-04-03T21:40:03Z","title":"Vocabulary Dropout for Curriculum Diversity in LLM Co-Evolution","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T16:52:28.340493Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2604.03472"},"observation_digest":"sha256:f62f491dcb72b1316464e8e42ddcecbed92eaba0e38533d078768ce8348534ef","observation_id":"7794019f-94f7-48c4-803c-b6858482df27","resolution":{"observed_at":"2026-08-02T16:52:28.340493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2604.04942","last_updated":"2026-03-13T13:01:01Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-03-13T13:01:01Z","title":"TDA-RC: Task-Driven Alignment for Knowledge-Based Reasoning Chains in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T12:21:39.237267Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2604.04942"},"observation_digest":"sha256:bc5517eca7bcd585e94e2b901958fdc6eeaf4bb060b0da51daa164b818471b92","observation_id":"2f87208b-cc9f-464b-a250-c0f76a6b5909","resolution":{"observed_at":"2026-05-15T12:25:36.017296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2604.17928","last_updated":"2026-04-20T08:09:01Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:09:01Z","title":"HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T05:23:08.478393Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2604.17928"},"observation_digest":"sha256:09bfd76bfb4f1aad90b1e2edbeebb3c301b6978ca6353215453bf2988b2dedb8","observation_id":"96ad7fa4-1ced-4789-8816-d6e831d70999","resolution":{"observed_at":"2026-05-10T09:23:37.532442Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.06241","last_updated":"2026-05-08T19:48:19Z","snapshot_observed_at":"2026-08-02T18:28:02.457502Z","submitted_at":"2026-05-07T13:25:05Z","title":"Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T10:33:02.741857Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.06241"},"observation_digest":"sha256:e44cffe6a9bb8f98bbb3cd8748a50ef60ada31b24565dbcc61bde1069aa51f8a","observation_id":"8764e888-71d2-4741-8a44-3cee1f0a77c0","resolution":{"observed_at":"2026-05-11T20:01:09.633344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.06241","last_updated":"2026-05-08T19:48:19Z","snapshot_observed_at":"2026-08-02T18:28:02.457502Z","submitted_at":"2026-05-07T13:25:05Z","title":"Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T01:10:54.313745Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.06241"},"observation_digest":"sha256:01e89e414f458c953305b865e28a9fe27fd2a4ab9fcd5dedfaf70fe082dcd41c","observation_id":"02260b02-af6e-4c34-b6e9-be7e7667b468","resolution":{"observed_at":"2026-05-12T08:26:24.090924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.06882","last_updated":"2026-05-07T19:31:43Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T19:31:43Z","title":"How Well Do LLMs Perform on the Simplest Long-Chain Reasoning Tasks: An Empirical Study on the Equivalence Class Problem","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-11T01:29:33.453354Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.06882"},"observation_digest":"sha256:ccc71ed8f65170bbe72854b532167783378582838c9371bf71924b235bcf85cd","observation_id":"b561991d-0d04-4f2b-9389-a584b724ae35","resolution":{"observed_at":"2026-05-11T01:45:51.968561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.09584","last_updated":"2026-05-10T14:51:31Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T14:51:31Z","title":"CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics","version":1},"reference_index":153,"source":"arxiv_source","source_observed_at":"2026-05-12T04:32:16.930291Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.09584"},"observation_digest":"sha256:2e9717f31761ad5aeac1e5c576579db2a52ea7ffb198629129138ce9849fd2d3","observation_id":"8c27bc82-1920-4710-8c03-1da9f3780b3d","resolution":{"observed_at":"2026-05-12T06:11:23.746522Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.09879","last_updated":"2026-05-11T02:05:30Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:05:30Z","title":"M2A: Synergizing Mathematical and Agentic Reasoning in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T04:43:50.384980Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.09879"},"observation_digest":"sha256:be49585fef8092c8df600ed068728728defb90c2d8b6db251372336bd4e37e02","observation_id":"8c98ad48-f85f-40c2-8df1-1f32771137ad","resolution":{"observed_at":"2026-05-12T06:01:22.716327Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.14358","last_updated":"2026-05-14T04:35:45Z","snapshot_observed_at":"2026-08-02T19:01:30.832235Z","submitted_at":"2026-05-14T04:35:45Z","title":"Uncovering the Representation Geometry of Minimal Cores in Overcomplete Reasoning Traces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T21:04:02.263300Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.14358"},"observation_digest":"sha256:923dff613ffc2bfc5b111b848d8abf4e7bbaf28eaaa3d882d0ab687420252d3a","observation_id":"1da4d8c6-7b3a-4288-9ab6-9c323b7e5c41","resolution":{"observed_at":"2026-06-30T21:05:03.840065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2605.17734","last_updated":"2026-05-18T01:35:11Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-18T01:35:11Z","title":"Harnessing LLM Agents with Skill Programs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T11:26:19.382463Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2605.17734"},"observation_digest":"sha256:17e734a832fb4aa2d5a86956a76086ecb09e228e07abcdb05caf880ba629eeeb","observation_id":"4c8bd9bd-d072-436a-9cd3-e510aee9a90f","resolution":{"observed_at":"2026-05-20T11:28:14.365903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2606.00609","last_updated":"2026-05-30T08:18:40Z","snapshot_observed_at":"2026-08-05T16:11:23.807977Z","submitted_at":"2026-05-30T08:18:40Z","title":"CARE-RL: Capability-Aware Reinforcement Learning for Mitigating Cross-Domain Conflicts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T19:01:14.340754Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2606.00609"},"observation_digest":"sha256:e5f9a278e59b1b1a4916e73248b4f0912158b3b9ca611fd57466fb10812e86b1","observation_id":"817f0464-c865-4d97-bf12-1a6adf7a3269","resolution":{"observed_at":"2026-06-28T19:02:34.037389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":180,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:f0177fc0cbe126ab94ee6209d63303f491e48b501ae023919e059975b905ad89","observation_id":"d6bd743e-635f-48b5-a0e2-b434492a0924","resolution":{"observed_at":"2026-07-01T20:46:14.301614Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2606.02252","last_updated":"2026-06-01T13:42:45Z","snapshot_observed_at":"2026-08-02T10:54:12.406998Z","submitted_at":"2026-06-01T13:42:45Z","title":"ResMerge: Residual-based Spectral Merging of Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T15:03:27.081409Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2606.02252"},"observation_digest":"sha256:da07636d3bf173154e98cbe34484f59e99495f92e40faff9e6c488944691592e","observation_id":"ad228ab9-3f72-466f-adb9-f8cd1dd759d0","resolution":{"observed_at":"2026-07-01T22:46:19.489013Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2606.05025","last_updated":"2026-06-03T15:48:52Z","snapshot_observed_at":"2026-08-06T23:48:49.542117Z","submitted_at":"2026-06-03T15:48:52Z","title":"Invariant Gradient Alignment for Robust Reasoning Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T06:56:05.310135Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2606.05025"},"observation_digest":"sha256:a7495f3cc2abc8711449d976a86bdefeb60a8c4233f9349479e9d01b15f3ff8a","observation_id":"0ea3f5d0-a361-44e1-bfef-4275aac5c3cf","resolution":{"observed_at":"2026-07-02T07:26:46.043395Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":"2505.14652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-03T14:58:32.537541Z","title":"General- reasoner: Advancing llm reasoning across all domains","venue":null,"work_id":"aa8380c7-f21d-4f26-a9d8-79b5564804d2","year":2025},"citing_paper":{"arxiv_id":"2607.01612","last_updated":"2026-07-02T02:29:33Z","snapshot_observed_at":"2026-08-07T21:17:52.584061Z","submitted_at":"2026-07-02T02:29:33Z","title":"Scaling with Confidence: Calibrating Confidence of LLMs for Adaptive Test Time Scaling","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-03T14:49:33.364596Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2607.01612"},"observation_digest":"sha256:91ea82980abcb41adde38095585e7361234562366a697c7e65886458d67f4bd9","observation_id":"ab7a2902-ecef-4c65-ad83-8059c68c19e7","resolution":{"observed_at":"2026-07-03T14:58:32.539111Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-07-12T01:16:50.927415Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03601","last_updated":"2026-07-03T20:58:29Z","snapshot_observed_at":"2026-08-03T18:38:21.736479Z","submitted_at":"2026-07-03T20:58:29Z","title":"ArchEval: Measuring AI Agents as Computer Architects","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T01:16:50.927415Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2607.03601"},"observation_digest":"sha256:003ddd8a8c5ca89787c36d8bc0c03ea8ee2e44383fa67c055b7bb8041829e7f9","observation_id":"5e19bfea-0437-473c-8d2b-e9a4c1e01820","resolution":{"observed_at":"2026-07-12T01:16:50.927415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14652/citation-record","integrity":"/paper/2505.14652/integrity","json":"/paper/2505.14652/citation-record.json","paper":"/paper/2505.14652"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:34:05.940907Z","title":"DeepSeek-R1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:05.940907Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:50c3ce5652cd33fe5b92e39e4e65cb19756fa6b638329c12a03313c2416434ca","observation_id":"8660dee9-4aa0-4f2b-8b3f-ccbb38e9523f","resolution":{"observed_at":"2026-08-07T15:34:05.940907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-07T15:34:06.045215Z","title":"Simplerl-zoo: Investigating and taming zero reinforcement learning for open base models in the wild, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.045215Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:54546802b1e55e21debb96aaa5c66debde94d7e3548a035849e418a73e97fed9","observation_id":"5f4d5688-991c-4ec3-b892-f229d8b214b6","resolution":{"observed_at":"2026-08-07T15:34:06.045215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T15:34:06.180306Z","title":"DAPO: An open-source llm reinforcement learning system at scale, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.180306Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:aca29f535c35a7ceecb56df055a0bafec25357c632aee992619dce922d736f7f","observation_id":"fa17cf45-45ea-48df-8151-bfd00c7d1077","resolution":{"observed_at":"2026-08-07T15:34:06.180306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:06.321248Z","title":"Tang, Manan Roongta, Colin Cai, Jeffrey Luo, Li Erran Li, Raluca Ada Popa, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.321248Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:5eb38a23d8a980217a61d7586009e9802b2e650d4186dbc90ee43f990d873bde","observation_id":"e4f54a7f-a643-4f7e-8794-c1dc59c3c474","resolution":{"observed_at":"2026-08-07T15:34:06.321248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:06.486096Z","title":"Deepcoder: A fully open-source 14b coder at o3-mini level, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.486096Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:58c11ac23ffabf1f8c4cddd1cbff2bca1fa7b085ee91c6a612f78e8de7c4db39","observation_id":"36bcc3cf-19b4-4d15-9b86-948cdbcd9e05","resolution":{"observed_at":"2026-08-07T15:34:06.486096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T15:34:06.606581Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.606581Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:0dd0d28720a87d1806e35674cec7ac983b7c6940c350ac9945186e6e01547d80","observation_id":"c7765d8d-b838-4ad8-aefc-8b5984f9f77a","resolution":{"observed_at":"2026-08-07T15:34:06.606581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T15:34:06.758536Z","title":"s1: Simple test-time scaling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.758536Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:832cfbf2a1202681567f94976c9fd7df4e77f60d9c26e6ce97e230589dc273eb","observation_id":"0b41e973-c2c2-4820-94a8-6df9c61bc57d","resolution":{"observed_at":"2026-08-07T15:34:06.758536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:11.687629Z","title":"MMLU-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":"9e9b157a-4aee-4dfb-81ea-5a66a1f57b5b","year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.891461Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:e7c39189ef205590e22f2efaefbe26f3739b496beafcd440e933e83c97e2eb58","observation_id":"5396bf05-66ad-46fe-889f-81fc88969b09","resolution":{"observed_at":"2026-08-07T15:34:11.796009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:11.494273Z","title":"MAmmoTH2: Scaling instructions from the web","venue":null,"work_id":"cf42e1a9-a4cc-408e-9ed2-2d82cbdef6d6","year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:06.975131Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:0ee5c2b532dfd90e3d49181fe8b7abc0bac717239ac42b64e3ed81db300bffb9","observation_id":"f7ec4993-0070-4ba3-a03a-6d02924c8ddd","resolution":{"observed_at":"2026-08-07T15:34:11.552054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T15:34:07.116592Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.116592Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:19a21ff3004c540defa7ab5dae9fdb8827c3203b8e2da1ff6e8e87000b54ec83","observation_id":"75a69ac9-c4f3-4bb9-90b5-f4bdcdbbc664","resolution":{"observed_at":"2026-08-07T15:34:07.116592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-07T15:34:07.251201Z","title":"SuperGPQA: Scaling LLM evaluation across 285 graduate disciplines, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.251201Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:0973c558baeb3dcc2ab2f3c37cb44e200e0d4335373765f5e630b799f2187e21","observation_id":"64a4f703-91d3-4723-845e-7053bd05a2bd","resolution":{"observed_at":"2026-08-07T15:34:07.251201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:07.416960Z","title":"TheoremQA: A theorem-driven question answering dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.416960Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:9bc16050dfd3b9ea1d0f5657a9d33fec7c62d53ac61d6697bcf05967f11cfa32","observation_id":"752dd351-798e-4dca-884f-00620bd47ab3","resolution":{"observed_at":"2026-08-07T15:34:07.416960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T15:34:07.541003Z","title":"Jain, Virginia Aglietti, Disha Jindal, Peter Chen, Nishanth Dikkala, Gladys Tyen, Xin Liu, Uri Shalit, Silvia Chiappa, Kate Olszewska, Yi Tay, Vinh Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.541003Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:bb7eb55017d706800beb01db94dbf07fe9fc6d41f4856e0c44d4df8e476ecc87","observation_id":"7abd6682-5d79-4dbe-8f1b-764533b579b5","resolution":{"observed_at":"2026-08-07T15:34:07.541003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:07.679696Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.679696Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:a6e0434644ffadb9a7e63f14f941138cdaaed42379e88f3990c3cd67873df7f6","observation_id":"b58e34ca-405b-4694-a0b3-f38922369352","resolution":{"observed_at":"2026-08-07T15:34:07.679696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T15:34:07.774827Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.774827Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:eaebb7735ec104736502f2403cf6fae6fa07a3327d9fbefcb0ea514612f8de09","observation_id":"feedb8fe-64ce-4896-8fca-d57edbbb2586","resolution":{"observed_at":"2026-08-07T15:34:07.774827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-07T15:34:07.896656Z","title":"OlympiadBench: A challenging benchmark for promoting AGI with olympiad-level bilingual multimodal scientific problems, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.896656Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:1c2dee045772b02f030acd6a47e065691995327e8eed65e9b21f2c190f6ad75c","observation_id":"88ea4c29-168b-4bbf-989f-6909cb26e6cf","resolution":{"observed_at":"2026-08-07T15:34:07.896656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T15:34:08.034860Z","title":"Chain-of-thought prompting elicits reasoning in large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.034860Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:b8268cdea9b87d07c8f12ce58f38869e09f4d7033a48186c3a40bb3c6026ce95","observation_id":"61b49554-a17f-4557-a281-7c0e1044a9b2","resolution":{"observed_at":"2026-08-07T15:34:08.034860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24235","last_updated":"2025-05-04T15:48:08Z","snapshot_observed_at":"2026-08-07T23:06:45.603790Z","submitted_at":"2025-03-31T15:46:15Z","title":"A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24235","snapshot_observed_at":"2026-08-07T15:34:08.168952Z","title":"A survey on test-time scaling in large language models: What, how, where, and how well?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.168952Z"},"links":{"cited_paper":"/paper/2503.24235","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:08bb76dfeb88faeae7d8ed0132be147060dbd5433e2aed32707948f8b0c7857b","observation_id":"f65fb8a5-15cb-4e2b-99fa-5e41bafe52cb","resolution":{"observed_at":"2026-08-07T15:34:08.168952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-07T17:51:38.471379Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-07T15:34:08.320486Z","title":"Efficient test-time scaling via self-calibration, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.320486Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:c9c9b55338ea0e0ba410371be9383cf10dc68dab25bc3995280d963389106ab9","observation_id":"20d67b80-af51-4d82-8d60-d8e885ce2f81","resolution":{"observed_at":"2026-08-07T15:34:08.320486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T15:34:08.428347Z","title":"Openai o1 system card, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.428347Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:325d860f8a88b66fa6b2f7873adebf86352cf4ea83bf99efad2f5d9dade4b3e6","observation_id":"3ae24153-daf7-4435-ad31-8f4ebbc6e3d8","resolution":{"observed_at":"2026-08-07T15:34:08.428347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:34:08.546263Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.546263Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:a47042a1edf5a14cda7e94de3119e5cbd3bc5d273302babad8b2e00e47062ab2","observation_id":"70039290-fb81-4070-9396-c52d1f418df3","resolution":{"observed_at":"2026-08-07T15:34:08.546263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:08.659011Z","title":"QwQ-32B: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.659011Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:e1a94caa48f5fe46e01cf14f3bddf977fc99c42a3adea38754274af311d5c025","observation_id":"62152091-6a38-487d-b1c9-8c1bf0e489ed","resolution":{"observed_at":"2026-08-07T15:34:08.659011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07608","last_updated":"2025-06-05T11:49:09Z","snapshot_observed_at":"2026-08-07T15:47:50.795694Z","submitted_at":"2025-05-12T14:30:11Z","title":"MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07608","snapshot_observed_at":"2026-08-07T15:34:08.771561Z","title":"Mimo: Unlocking the reasoning potential of language model – from pretraining to posttraining.arXiv:2505.07608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.771561Z"},"links":{"cited_paper":"/paper/2505.07608","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:942d6b225698d0cd853faeea152a92fac311dc42e28ebfaee418ddd69a31b3fb","observation_id":"39b7bfed-5928-4752-af39-907b057f3687","resolution":{"observed_at":"2026-08-07T15:34:08.771561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T15:34:08.878975Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:08.878975Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:dea2139911bb9ad2395d65bd4bd4fdb273043f77528ff5c17a2daf23d49bff63","observation_id":"301f934e-4a3f-4208-96e2-f87d2b259427","resolution":{"observed_at":"2026-08-07T15:34:08.878975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T15:34:09.034625Z","title":"Qwen2.5-math technical report: Toward mathematical expert model via self-improvement, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.034625Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:f00e4ca56e09057a9b6d364ac92451ea6e22994ded3e1f9cd9fde1f8eb6aa35f","observation_id":"c18bf4b9-14a5-4292-a002-0cab5289ebac","resolution":{"observed_at":"2026-08-07T15:34:09.034625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:09.154833Z","title":"Nemotron-CrossThink: Scaling self-learning beyond math reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.154833Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:1623ba110949c86fe2649886e92af20813a2f75e36227b7e4a20f5c26d0d1810","observation_id":"7475d5f0-a5f1-4a9c-8f75-cff476ba9780","resolution":{"observed_at":"2026-08-07T15:34:09.154833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23829","last_updated":"2025-04-01T14:48:02Z","snapshot_observed_at":"2026-08-07T21:53:39.516862Z","submitted_at":"2025-03-31T08:22:49Z","title":"Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23829","snapshot_observed_at":"2026-08-07T15:34:09.276522Z","title":"Crossing the reward bridge: Expanding rl with verifiable rewards across diverse domains, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.276522Z"},"links":{"cited_paper":"/paper/2503.23829","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:412680e794337d86390430338294cdde878989ec76e2a7bc52656c3738264a4b","observation_id":"5e84209f-bbff-45ee-a5d2-77e813fae459","resolution":{"observed_at":"2026-08-07T15:34:09.276522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T15:34:09.410088Z","title":"Gemini: A family of highly capable multimodal models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.410088Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:f9c77ac3df55960fc5fc6b349c5c6d0276fff3e3cd73d95b6bf3786243d1493a","observation_id":"ec55bc7c-da4d-417c-8666-434d516fb66d","resolution":{"observed_at":"2026-08-07T15:34:09.410088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T15:34:09.547506Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.547506Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:2eca39dbe0bfef8edd1579b771b123fd91d693a844392284a11e812749c47314","observation_id":"de6e2a22-695a-4287-8156-4b2377720a6e","resolution":{"observed_at":"2026-08-07T15:34:09.547506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:11.234965Z","title":"Solving quantitative reasoning problems with language models","venue":null,"work_id":"d8dad5b5-32e5-42be-8511-bfe332b67c19","year":2022},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.650113Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:e1e695d9afd4193b8a01f0f1fe4d32279b4db5ed1b189203347cde4f4eb2d3ee","observation_id":"a4488639-9137-4a1c-919d-2d22188fc6c2","resolution":{"observed_at":"2026-08-07T15:34:11.354508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T15:34:09.789116Z","title":"GPT-4o system card, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.789116Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:acbd0ac92c54b696e08b3918220d94a0e4029650c6444f022db2dfca547f05b0","observation_id":"e7393aa3-7260-4634-8426-7e27861835c0","resolution":{"observed_at":"2026-08-07T15:34:09.789116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-08-07T15:34:09.929322Z","title":"Final Decision: Yes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:09.929322Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:2cece68ffeba4b5d58a26c0da3ee6ebc6f09e5d588c9311b56917c41bec1d596","observation_id":"6cab01a3-205b-415b-86cd-173a2afd898f","resolution":{"observed_at":"2026-08-07T15:34:09.929322Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:11.064524Z","title":null,"venue":null,"work_id":"d1e00a6c-a2e2-499e-a0ad-6ad50d8836b1","year":null},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:10.006075Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:5c48d78bda652c8b764e6204b483681b49d5ebbd0905147c6f5a3a4e261dfcf4","observation_id":"45cb9444-f20f-40f2-879a-2cba68c92911","resolution":{"observed_at":"2026-08-07T15:34:11.129480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:34:10.822115Z","title":"Final Decision: Yes A.5 Detailed Hyper-Parameters We provide the detailed hyperparameters for training our General-Reasoner variants in Table 9","venue":null,"work_id":"d2b53abf-5e61-4ca4-8b52-478a8c27433e","year":null},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:10.160986Z"},"links":{"citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:882e09fce031a0f0661433e26bd9da822306840c8b17f028f7b1dac7485acbcc","observation_id":"0476a43f-538a-4ae5-9ce0-ab9aa34d982e","resolution":{"observed_at":"2026-08-07T15:34:10.933677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 30 inbound Pith citation observations for arXiv:2505.14652."}