{"as_of":"2026-08-07T16:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b8c00d4f9fb3f18b8b16fc5f698e8531a4771e085115c4a940cd20abcb6571d","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:24:42.497344Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13394/citation-record","integrity":"/paper/2607.13394/integrity","json":"/paper/2607.13394/citation-record.json","paper":"/paper/2607.13394"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T05:24:39.444119Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:39.444119Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:12a9f74ba8500cf46702a766cbd3443f294784f896155d8f1bb775624e21409e","observation_id":"8d6f3680-3e5c-470d-9af0-bf593d25f70b","resolution":{"observed_at":"2026-08-02T05:24:39.444119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-02T05:24:39.741994Z","title":"Jian Hu, Jason Klein Liu, Haotian Xu, and Wei Shen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:39.741994Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:dc7334e560ad3ced72f7550e254fc7f3453b875f2d7aeaa36c1f0877b8f5854a","observation_id":"09bda145-8364-400c-8dae-c05824f623d3","resolution":{"observed_at":"2026-08-02T05:24:39.741994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:39.855367Z","title":"Math-500","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:39.855367Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:5b68767fb3b246f9266671ff0146da02e0b80b390ad1fafdae523482013ac7ee","observation_id":"d6234c84-b311-44ce-a1d3-25fce00b8d4a","resolution":{"observed_at":"2026-08-02T05:24:39.855367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:39.977261Z","title":"Koray Kavukcuoglu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:39.977261Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:38d85fed4a3c2c4e36fe095beab2ae71ad6cb82e419cffda572e48c7257ebf3e","observation_id":"f11b6bbf-9c2b-4c0d-895f-509e6c4e1a62","resolution":{"observed_at":"2026-08-02T05:24:39.977261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:40.089320Z","title":"Google Blog (The Keyword), Published Mar","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.089320Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:320f5f412e59f3116e64fc7747011e59015b1f3f4292b564117eaba7500cf3d7","observation_id":"84d4624a-1366-488b-ac85-4bed59af5db2","resolution":{"observed_at":"2026-08-02T05:24:40.089320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-02T05:24:40.196677Z","title":"Kimi k1.5: Scaling reinforcement learning with llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.196677Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:d79751cd20bd30ae75ad5d55a4459bc4eafe2f3626355d4f5da22663e78923dd","observation_id":"20eaae04-8e0e-4f32-9f81-f29f79dd12df","resolution":{"observed_at":"2026-08-02T05:24:40.196677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:40.530060Z","title":"Automated red teaming with GOAT: the generative offensive agent tester","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.530060Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:0856048bede27b6cd74699d6c55022bd63ffe11f35a1aa9ee8270eef6493dcc3","observation_id":"747c0175-b1e4-4a50-84d9-bab58b73a0f7","resolution":{"observed_at":"2026-08-02T05:24:40.530060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:40.649964Z","title":"URLhttps://aclanthology.org/2025.acl-long.1207/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.649964Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:e6ded847bcd1213d0725d0d090253688df464c8b51e48b59439aadb3f6de7f79","observation_id":"7be93ed7-4b0f-418a-8cc1-7b1870716990","resolution":{"observed_at":"2026-08-02T05:24:40.649964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:42.338679Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:42.338679Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:7f65bf9e1c496e5bab2dd06bd70320361fda358aefd11e7575339903ee757076","observation_id":"a98ca699-588d-44d1-ad79-633d354424bc","resolution":{"observed_at":"2026-08-02T05:24:42.338679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-02T05:24:40.840639Z","title":"John Schulman, Filip Wolski, Prafulla Dhariwal, Alec Radford, and Oleg Klimov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.840639Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:ad19d7ed5aae7b6a4bbd582810dd2f920648b56863ac4081a9208c0056345c0f","observation_id":"4835cb8e-85be-4697-8690-edcbd1804f92","resolution":{"observed_at":"2026-08-02T05:24:40.840639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.051021Z","title":"Thinking Machines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.051021Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:42ec5d6a4c08ba4540f3389ad114b03012926ddf36963b50a245ed605409d842","observation_id":"29a35d9c-fe98-4f92-badb-ae9877e14a02","resolution":{"observed_at":"2026-08-02T05:24:41.051021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.178786Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.178786Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:e44b86d3dc94f2817017c60924fc98bc26dd1f7a85bf70779d6f3dbd09837dd4","observation_id":"29aa715b-412f-49ff-9a10-d443af03ba91","resolution":{"observed_at":"2026-08-02T05:24:41.178786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.394139Z","title":"Ronald J Williams","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.394139Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:a8a13c28bf99c8d55674f85ffc606721b47074e0e56d2dbe3c4a872a4b59b283","observation_id":"7c8da983-a4d5-45f8-8fee-5359128b59b8","resolution":{"observed_at":"2026-08-02T05:24:41.394139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.495196Z","title":"13 Hao Yang, Lizhen Qu, Ehsan Shareghi, and Gholamreza Haffari","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.495196Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:2e2dbb57953cda1501f623895c5934675589dc0833366b700aa755f35f941f6f","observation_id":"b3477253-a8f4-4e34-97aa-2497a0165567","resolution":{"observed_at":"2026-08-02T05:24:41.495196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.710173Z","title":"Fangxu Yu, Lai Jiang, Haoqiang Kang, Shibo Hao, and Lianhui Qin","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.710173Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:903092a7427eff3b95acddf71e0fbd26b43228a6fecac3ed16d1b16b218d030f","observation_id":"90972f8d-0c6d-478a-98bf-3ccd5b00cd8b","resolution":{"observed_at":"2026-08-02T05:24:41.710173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.782838Z","title":"mlr.press/v162/zhang22v.html","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.782838Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:9d2d73df56d6296693d3a0c31ce175b804226fa64cda74679a14e7f1185311be","observation_id":"40822b29-3d72-466a-a80e-1eb00c399aaf","resolution":{"observed_at":"2026-08-02T05:24:41.782838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:42.013952Z","title":"American invitational mathematics examination (aime) 2025,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:42.013952Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:63fa1c59c0b0142478f44122ad8a55e88bc1fdc98315759c3541c442aa206be2","observation_id":"5c590e9b-8a19-4ef0-8c9c-cd627ec1dd74","resolution":{"observed_at":"2026-08-02T05:24:42.013952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:42.069181Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:42.069181Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:4409ea9ec18fb470f084a7fcda12c7756e485f9f1dff891cdd13c3e503eca2d2","observation_id":"870220ea-02ab-4dae-90da-52444fe08526","resolution":{"observed_at":"2026-08-02T05:24:42.069181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:42.176929Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:42.176929Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:c33be974f502453cd0b4d22a287fb5be02cbcbc64b0d9fe1040efdc9de511bb4","observation_id":"907cb6d2-9d4f-4cfb-8463-c2339bebe50a","resolution":{"observed_at":"2026-08-02T05:24:42.176929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:42.423441Z","title":"Instruct","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:42.423441Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:f3e63b8682e6fe8e203cc8197ab0592d3ccfe97ba25b1493dc2ce02f5b9f5f2a","observation_id":"5d55d50d-25a9-488a-a2b9-4dde638fcd05","resolution":{"observed_at":"2026-08-02T05:24:42.423441Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:42.497344Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:42.497344Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:026735e72f508469a034bad5ff63f9fc6ad21f97c9e9fedba799fc71d7e55348","observation_id":"441f5286-057d-4081-9d83-3afa3836ebdc","resolution":{"observed_at":"2026-08-02T05:24:42.497344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05610","last_updated":"2024-05-09T08:15:21Z","snapshot_observed_at":"2026-07-06T18:11:57.100591Z","submitted_at":"2024-05-09T08:15:21Z","title":"Chain of Attack: a Semantic-Driven Contextual Multi-Turn attacker for LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05610","snapshot_observed_at":"2026-08-02T05:24:41.591181Z","title":"Chain of attack: a semantic-driven contextual multi-turn attacker for llm, 2024b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":1459,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.591181Z"},"links":{"cited_paper":"/paper/2405.05610","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:b3909e760a5d5d1bdf9e2f2ef7414b63fc3c5695c302f438b52d07aa49b9e3a4","observation_id":"77d14e7c-18df-4b12-a7eb-6e6daf1965b4","resolution":{"observed_at":"2026-08-02T05:24:41.591181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.284645Z","title":"Foot-in-the-door: A multi-turn jailbreak for LLMs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.284645Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:9195f451167ed9fb8881e6d337888c940aae32781d76305728bcba3a7e5c1994","observation_id":"4f918e3a-0fb8-4385-9b43-d005e3b44993","resolution":{"observed_at":"2026-08-02T05:24:41.284645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T05:24:40.963779Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.963779Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:4d3472cfe9771168af5d79b60b7abda5e7f460917c31276d67d0178e3fbc7513","observation_id":"51c6601a-5be0-41ee-a50f-4efe2888e2e2","resolution":{"observed_at":"2026-08-02T05:24:40.963779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:40.728289Z","title":"12 Mark Russinovich, Ahmed Salem, and Ronen Eldan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.728289Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:019570efbf8c4b94ec14fb6c29c395c4d2cfa94e4003179d7e8c61171c78c6f1","observation_id":"8b6e0291-b505-4811-a84f-2dbbc3c68745","resolution":{"observed_at":"2026-08-02T05:24:40.728289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:40.414152Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.414152Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:ba412eaff804d01af208fa2a07842f75683e24a5db2cedcc6529400b839d1ef7","observation_id":"deac1d91-c67e-4b33-82c7-3cec29cf7c81","resolution":{"observed_at":"2026-08-02T05:24:40.414152Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:40.261844Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:40.261844Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:682611ace426e182f727da9482d2256e470b2c653dd195a8f525239fa30025dc","observation_id":"b53b23b7-ed94-4f17-8ddd-e3a51e7421f1","resolution":{"observed_at":"2026-08-02T05:24:40.261844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:24:41.894166Z","title":"Yifan Zhang and Team Math-AI","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:41.894166Z"},"links":{"citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:bcd97178f0e639c6e206f43ed14da422922cf203400622db0c739f6e2bce010f","observation_id":"3e91c337-8c47-4d2d-8925-066acb421d69","resolution":{"observed_at":"2026-08-02T05:24:41.894166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T05:24:39.605618Z","title":"Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shirong Ma, Peiyi Wang, Xiao Bi, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:39.605618Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:8d3beb527b7da0046d1d55f641ed98aa9995b98c2e1136b0058e1ee48f2b0a39","observation_id":"ccfe4430-cc55-48eb-80c4-44c253905842","resolution":{"observed_at":"2026-08-02T05:24:39.605618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-02T05:24:39.555233Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T05:24:39.555233Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.13394"},"observation_digest":"sha256:677ef5d23584126ed116eb00f1005908f7b73a26529806dcc15d940721365f94","observation_id":"8b9ddb74-1cfa-44aa-b2fe-a09f611fa056","resolution":{"observed_at":"2026-08-02T05:24:39.555233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13394","last_updated":"2026-07-15T02:43:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T05:24:38.202370Z","submitted_at":"2026-07-15T02:43:16Z","title":"GFlowRL: Scaling Distribution-Matching RL to Large Language Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2607.13394."}