{"as_of":"2026-08-07T10:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37c87470ac42222bd98d8275e290d6285ceeb82b7c4cb4dcb3afd5b8ee427841","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:24:00.072659Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02851/citation-record","integrity":"/paper/2507.02851/integrity","json":"/paper/2507.02851/citation-record.json","paper":"/paper/2507.02851"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T20:23:58.425741Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.425741Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:ddfca1000a141169210f3877bc22b7ab6424377050bc12510e97adb4cdf8e1a1","observation_id":"d1ab79bf-bfa9-4f86-8244-f623cc80202b","resolution":{"observed_at":"2026-08-06T20:23:58.425741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T20:23:58.618190Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.618190Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:3f7576b2fcda7f27dfa8f6e43ca560b3d842e62de38f731ebe8a635dbdd36ef3","observation_id":"4bbb6bad-8780-49ae-8cff-76d35cbd5203","resolution":{"observed_at":"2026-08-06T20:23:58.618190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T20:23:58.701438Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.701438Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:d90a127a4adbcad447337bf9cc323beb9d53ffb7c912ee6495172d117fd7da53","observation_id":"10d88f10-faae-461e-92be-b5b33ae3038e","resolution":{"observed_at":"2026-08-06T20:23:58.701438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-06T20:23:59.003617Z","title":"Lost in the middle: How language models use long contexts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.003617Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:fd1f66b7a983335f3e7106200876f97f4d2d6a74050fbdbc26a8a968ee4e1732","observation_id":"eeac5b9b-b6d6-4df1-8850-e86650132768","resolution":{"observed_at":"2026-08-06T20:23:59.003617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21200","last_updated":"2024-12-30T18:59:06Z","snapshot_observed_at":"2026-08-05T14:24:07.354357Z","submitted_at":"2024-12-30T18:59:06Z","title":"Distributed Mixture-of-Agents for Edge Inference with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21200","snapshot_observed_at":"2026-08-06T20:23:59.097832Z","title":"Distributed mixture-of-agents for edge inference with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.097832Z"},"links":{"cited_paper":"/paper/2412.21200","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:283f85c0ead85559ee46884d400f2996c1ad3b32a9fd9c2174ff97e928ba46e4","observation_id":"25bb37db-d3ba-485c-b145-102e33531c4c","resolution":{"observed_at":"2026-08-06T20:23:59.097832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T20:23:59.192668Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.192668Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:20054241b0e6298e70a544c7f55368003adb3a454acf9788469ed49a680d8a29","observation_id":"13df14a6-0ba3-4bfd-9742-b2bafe2e196f","resolution":{"observed_at":"2026-08-06T20:23:59.192668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07143","last_updated":"2024-08-09T22:37:25Z","snapshot_observed_at":"2026-08-02T14:27:24.212588Z","submitted_at":"2024-04-10T16:18:42Z","title":"Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07143","snapshot_observed_at":"2026-08-06T20:23:59.260212Z","title":"Leave no context behind: Efficient infinite context transformers with infini-attention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.260212Z"},"links":{"cited_paper":"/paper/2404.07143","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:e2d56fd406f834152c31a3861fe20982722a8cb239555873ce4b6a7aa6956633","observation_id":"5e128e2a-9d15-41db-8ed4-447e90630a8e","resolution":{"observed_at":"2026-08-06T20:23:59.260212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11827","last_updated":"2025-05-25T04:09:29Z","snapshot_observed_at":"2026-08-05T09:49:18.872955Z","submitted_at":"2025-05-17T04:26:39Z","title":"Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11827","snapshot_observed_at":"2026-08-06T20:23:59.391394Z","title":"Not all thoughts are generated equal: Efficient llm reasoning via multi-turn reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.391394Z"},"links":{"cited_paper":"/paper/2505.11827","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:a4df20c952eabeba43ab8eece7be93d13d10a23b59c48d5687c18f9f1d7023c1","observation_id":"54dd50c3-df24-42f5-b8f8-ec4744002cf9","resolution":{"observed_at":"2026-08-06T20:23:59.391394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12618","last_updated":"2024-10-01T17:50:25Z","snapshot_observed_at":"2026-08-04T13:31:30.342476Z","submitted_at":"2024-09-19T09:44:17Z","title":"Iteration of Thought: Leveraging Inner Dialogue for Autonomous Large Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12618","snapshot_observed_at":"2026-08-06T20:23:59.459779Z","title":"Iteration of thought: Leveraging inner dialogue for autonomous large language model reasoning.arXiv preprint arXiv:2409.12618,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.459779Z"},"links":{"cited_paper":"/paper/2409.12618","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:7c2149d7f36d426b9e6a165d1c509974af026c9192b36aa7277e4d9949a32fb2","observation_id":"6f21235f-aaf2-4b8b-93d7-aa0cc0404c4c","resolution":{"observed_at":"2026-08-06T20:23:59.459779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T20:23:59.546311Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.546311Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:856097c929d58dbac05e225f2e0ce72b0f5773d625849ba672e03d3f511cd348","observation_id":"5624c9c5-cef8-4112-969c-fec3d4d8411b","resolution":{"observed_at":"2026-08-06T20:23:59.546311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T20:23:59.612071Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.612071Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:fbb7c14c7ab120c10d3becd7f4583b087a404cea4e75f5c87a6bed3b7326ad53","observation_id":"4acbca54-faff-4b52-9264-555fd99b6fe8","resolution":{"observed_at":"2026-08-06T20:23:59.612071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T20:23:59.704363Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.704363Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:2f0b7078b71eb14ff00e2ec1c7af0b8752d7aa97e823119f7c36cf0c4e99a2c3","observation_id":"ec8f81c2-c71e-48f4-8be7-a5f134b74053","resolution":{"observed_at":"2026-08-06T20:23:59.704363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19855","last_updated":"2025-03-25T17:19:38Z","snapshot_observed_at":"2026-07-06T20:58:32.505733Z","submitted_at":"2025-03-25T17:19:38Z","title":"Think Twice: Enhancing LLM Reasoning by Scaling Multi-round Test-time Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19855","snapshot_observed_at":"2026-08-06T20:23:59.774601Z","title":"Think twice: Enhancing llm reasoning by scaling multi-round test-time thinking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.774601Z"},"links":{"cited_paper":"/paper/2503.19855","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:de83bb980e7b20b47e9cbcbfd8c342ba959f0dcc90b4cd1270d134f03fb7c27b","observation_id":"4c107b09-0a26-4ad1-b454-e6d62fdca359","resolution":{"observed_at":"2026-08-06T20:23:59.774601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-06T20:23:59.868672Z","title":"Mixture-of-agents enhances large language model capabilities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.868672Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:05f7cc0c4ff5eb67dc282905457f447efac9f139fed4de5c69c75cf7987f47b4","observation_id":"b5b6da0e-5c72-4e63-9fd5-00f508c0bc21","resolution":{"observed_at":"2026-08-06T20:23:59.868672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:23:59.964450Z","title":"Inftythink: Breaking the length limits of long-context reasoning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:59.964450Z"},"links":{"citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:7c53f9a2bc3275b8faa9bcbfbefead7f97c1e24fff3a7a369d7a89c0bb296869","observation_id":"3e115bb4-420d-4c02-b88a-a10199752927","resolution":{"observed_at":"2026-08-06T20:23:59.964450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12962","last_updated":"2025-02-18T15:45:36Z","snapshot_observed_at":"2026-07-06T20:38:38.495334Z","submitted_at":"2025-02-18T15:45:36Z","title":"Infinite Retrieval: Attention Enhanced LLMs in Long-Context Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12962","snapshot_observed_at":"2026-08-06T20:24:00.072659Z","title":"Infinite retrieval: Attention enhanced llms in long-context processing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:24:00.072659Z"},"links":{"cited_paper":"/paper/2502.12962","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:c11b19d3a775e3802e62d727911e20c70522ae15a5899910c470beaa80a143bc","observation_id":"19b1f7ff-1647-42a6-8aef-00e65e33485f","resolution":{"observed_at":"2026-08-06T20:24:00.072659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-06T20:23:58.328473Z","title":"Towards reasoning era: A survey of long chain-of- thought for reasoning large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.328473Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:b6fe938c57887d5ebf252e7b50c6aaa421922f614b8980a0f1d28771503ca6a7","observation_id":"d697b007-2cf2-4794-be4f-2283440f5ce2","resolution":{"observed_at":"2026-08-06T20:23:58.328473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T20:23:58.821730Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.821730Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:43443b6b2a7d979cb364b713e31d04cf04656feb0b09626960474159acf7869f","observation_id":"1673fa13-dfda-421b-8440-b4887d3289ba","resolution":{"observed_at":"2026-08-06T20:23:58.821730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04736","last_updated":"2025-04-28T01:20:59Z","snapshot_observed_at":"2026-08-02T04:59:06.901290Z","submitted_at":"2025-04-07T05:20:58Z","title":"Synthetic Data Generation & Multi-Step RL for Reasoning & Tool Use","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04736","snapshot_observed_at":"2026-08-06T20:23:58.523176Z","title":"Anna Goldie, Azalia Mirhoseini, Hao Zhou, Irene Cai, and Christopher D Manning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.523176Z"},"links":{"cited_paper":"/paper/2504.04736","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:92623125b84ee53b9d92ac89c2c0382fedbddd4dc11260aa305276bbccac2cbf","observation_id":"bd220da0-e9ad-43e9-b6fd-e1996fb0e4de","resolution":{"observed_at":"2026-08-06T20:23:58.523176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03284","last_updated":"2024-11-05T17:33:39Z","snapshot_observed_at":"2026-08-04T23:07:40.014032Z","submitted_at":"2024-11-05T17:33:39Z","title":"SMoA: Improving Multi-agent Large Language Models with Sparse Mixture-of-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03284","snapshot_observed_at":"2026-08-06T20:23:58.917129Z","title":"Smoa: Improving multi-agent large language models with sparse mixture-of-agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.917129Z"},"links":{"cited_paper":"/paper/2411.03284","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:1d4c752914ba6f37e04f728a5e0f0c1b3f2d1b55fb2dbd519f5ee086c3a82774","observation_id":"f67615ef-5366-4947-a05b-f5a7327e10e0","resolution":{"observed_at":"2026-08-06T20:23:58.917129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T20:23:58.197865Z","title":"Mark Chen, Jerry Tworek, Heewoo Jun, Qiming Yuan, Henrique Ponde De Oliveira Pinto, Jared Kaplan, Harri Edwards, Yuri Burda, Nicholas Joseph, Greg Brockman, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:58.197865Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.02851"},"observation_digest":"sha256:7130d04b87f946be08d1c9d84337923af5d13d4430e23a77a376d9e55fce4058","observation_id":"127a6973-4793-4e5f-bb46-1190510a15f9","resolution":{"observed_at":"2026-08-06T20:23:58.197865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02851","last_updated":"2025-07-03T17:55:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T20:17:25.500348Z","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2507.02851."}