{"as_of":"2026-08-08T00:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c738ec112c8dd5390e7b845cb98f5559c4c992e598b5c9ebf6c36ac31b6cfb02","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:02:48.093596Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T22:15:03.223540Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:10:07.075642Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"cited_work":{"arxiv_id":"2506.00845","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00845","snapshot_observed_at":"2026-07-04T20:10:07.075642Z","title":null,"venue":null,"work_id":"71210c43-8af2-4ede-a75a-485b90161cd3","year":2025},"citing_paper":{"arxiv_id":"2606.06865","last_updated":"2026-06-05T03:24:38Z","snapshot_observed_at":"2026-07-06T23:46:37.903443Z","submitted_at":"2026-06-05T03:24:38Z","title":"Are Large Language Models Suitable for Graph Computation? Progress and Prospects","version":1},"reference_index":265,"source":"arxiv_source","source_observed_at":"2026-06-27T22:15:03.223540Z"},"links":{"cited_paper":"/paper/2506.00845","citing_paper":"/paper/2606.06865"},"observation_digest":"sha256:42de6782dfe084aa50772890139fa051ae3f4dce256f088b8efbe22618936a51","observation_id":"c247d63b-0d7d-4eb5-a4a2-cf984f30c8e9","resolution":{"observed_at":"2026-07-02T16:57:10.406632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"cited_work":{"arxiv_id":"2506.00845","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00845","snapshot_observed_at":"2026-07-04T20:10:07.075642Z","title":null,"venue":null,"work_id":"71210c43-8af2-4ede-a75a-485b90161cd3","year":2025},"citing_paper":{"arxiv_id":"2606.25363","last_updated":"2026-06-24T03:47:05Z","snapshot_observed_at":"2026-08-03T02:13:50.813895Z","submitted_at":"2026-06-24T03:47:05Z","title":"TheoremGraph: Bridging Formal and Informal Mathematics","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-25T20:45:54.867101Z"},"links":{"cited_paper":"/paper/2506.00845","citing_paper":"/paper/2606.25363"},"observation_digest":"sha256:def4cc89560b9472abf7436da65b51b562231fb55563a2dcd9655e80e43c4e9c","observation_id":"ada5d916-6c31-48aa-ab73-511e84fb8383","resolution":{"observed_at":"2026-07-04T20:10:07.077545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00845/citation-record","integrity":"/paper/2506.00845/integrity","json":"/paper/2506.00845/citation-record.json","paper":"/paper/2506.00845"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.448034Z","title":"https://www.anthropic.com/news/claude-3-7-sonnet","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.448034Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:d5a8e97c783d6a4fc1294828cbe5c7168604f09aee1e0414ff1bfcbd0f05c0dd","observation_id":"f7b61685-3019-4e17-a8b5-bdafc0417a31","resolution":{"observed_at":"2026-08-07T12:02:40.448034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.482849Z","title":"https://deepmind.google/technologies/gemini/pro/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.482849Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:3f770c381df951567dfa343cfaeb0487657bc83f1db4b1cd608e04af1236246e","observation_id":"807b77a4-0a4d-4e12-9fdc-721d13d506f4","resolution":{"observed_at":"2026-08-07T12:02:40.482849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.514994Z","title":"https://openai.com/index/o3-o4-mini-system-card/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.514994Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:d8eb8db72e650166ce9015116508fdec84e4197d59c33d74ca9e7004590c791d","observation_id":"3ee950dc-cdb1-4dd4-bd1a-67295164d190","resolution":{"observed_at":"2026-08-07T12:02:40.514994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.553849Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.553849Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:c8ed51cda654534b81bbdf4f68b0267f4686a14938c64502bbcd7cca772ee364","observation_id":"c253d3d0-1ab9-45d9-b1cf-14be6dda893a","resolution":{"observed_at":"2026-08-07T12:02:40.553849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T12:02:40.611273Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.611273Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:9ec22987e0f3efd4ea5a2f7266a7db24d6b0010582e08b442dd891f1d39a2198","observation_id":"d32c6760-f690-4ba8-99ec-0cc98ce2d1db","resolution":{"observed_at":"2026-08-07T12:02:40.611273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.681939Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.681939Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:8a8329dbd63c48a9f2942b6fafb3c15f619f811aa615485c4d1737fd1696d857","observation_id":"3ba35479-948e-4fbb-9d29-dfe8b1ce0278","resolution":{"observed_at":"2026-08-07T12:02:40.681939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.749638Z","title":"Graphwiz: An instruction-following language model for graph computational problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.749638Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:528bb7835c24bc85fd8de08ce8cbe9593b722d7f4bd38bcca13a022f021ed6de","observation_id":"fa449d8c-e98f-46d7-9ac3-7569badf09bf","resolution":{"observed_at":"2026-08-07T12:02:40.749638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.792705Z","title":"LL a GA : Large language and graph assistant","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.792705Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:f4ae5202638516a5430e2cb4e0b724223ee38efe0ddf50927332823620f4e15f","observation_id":"1f2d69aa-fb91-40a2-85ae-3cdd13b36c86","resolution":{"observed_at":"2026-08-07T12:02:40.792705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-07T12:02:40.820858Z","title":"Reasoning models don't always say what they think","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.820858Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:bd2d63887aa13cdc77115f3569b7400863221f2b5b7286bb09e6a6c0d46158bc","observation_id":"8fea7934-502b-4000-97ef-23decd091a22","resolution":{"observed_at":"2026-08-07T12:02:40.820858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.871595Z","title":"Exploring the potential of large language models (llms) in learning on graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.871595Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:dcfbd4617204be47c4d6797558e50f3a4cef0f2489e5dd2a7ff9405f3abe43d8","observation_id":"93952eda-6be2-4acc-9d60-257dd6ec4bbb","resolution":{"observed_at":"2026-08-07T12:02:40.871595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:40.913085Z","title":"Lota-bench: Benchmarking language-oriented task planners for embodied agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.913085Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:b56a1998eb0ff61d4866171a5b4f97656f1f148872438f12252a1134a18681cf","observation_id":"5ba05bb9-aaed-4f14-b20c-4715dac649dd","resolution":{"observed_at":"2026-08-07T12:02:40.913085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-07T12:02:40.955944Z","title":"Sft memorizes, rl generalizes: A comparative study of foundation model post-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:40.955944Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:4c7eaf6573e8c6896620d853aba01713c73239c70514d97087f517b804981b46","observation_id":"20a1fdf7-53db-492b-86db-4c0aec96f78c","resolution":{"observed_at":"2026-08-07T12:02:40.955944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T12:02:41.007116Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.007116Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:736d2a2c7849b7455b6c9f8e7602cfc9aeb372172b1712bb33416c7f9a746c2f","observation_id":"cf9fcc25-8656-4335-a592-8ae1ef3cbec8","resolution":{"observed_at":"2026-08-07T12:02:41.007116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.049406Z","title":"Which modality should I use - text, motif, or image? : Understanding graphs with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.049406Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6f3db948848f8414ad513cd7db340d8b1d6940431e8669795c7c24a14a9a3ae8","observation_id":"1d3b3a4e-664c-4e34-b349-30dd7bd98384","resolution":{"observed_at":"2026-08-07T12:02:41.049406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.083391Z","title":"Benchmarks for automated commonsense reasoning: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.083391Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:c4a300c7ae796d7069a114bb6c33daade6cd4271e694ebb206d1890615e0fd9c","observation_id":"33dcfe75-57b4-41c7-b0e4-a276dd65ecba","resolution":{"observed_at":"2026-08-07T12:02:41.083391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.193746Z","title":"Graphvis: Boosting llms with visual knowledge graph integration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.193746Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:5e1117a8e3a5a69b101390d404077347ebf0b4a9cd0143be23fd49b0b12f443b","observation_id":"c4fc0bb2-a753-4438-b57b-0dc254889a07","resolution":{"observed_at":"2026-08-07T12:02:41.193746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.154","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.984578Z","title":"Knowledge crosswords: Geometric knowledge reasoning with large language models","venue":null,"work_id":"eb8af81b-f2ac-4b0b-adfd-9c3397615b02","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.286946Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:17091d2b9bd70e446933a676601b7b3d924d54324aa1e1b19eb78b81a01e15ff","observation_id":"cbd272a4-9e7c-4d04-9507-40f33b9eb3e0","resolution":{"observed_at":"2026-08-07T12:02:49.070523Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-07T12:02:41.332622Z","title":"Kto: Model alignment as prospect theoretic optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.332622Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:2aa4357bb2254405c1badd686b186809ee62a860812c1cece4ef1b056ad848d6","observation_id":"f7da5293-3bd3-4b8d-a902-14277921f4d0","resolution":{"observed_at":"2026-08-07T12:02:41.332622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.366424Z","title":"Talk like a graph: Encoding graphs for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.366424Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:916fc7a10696444f081970675877f205963e2eeed5cab6915270f4769297c3e0","observation_id":"94c370f3-94d2-4ef7-9048-1459813f992a","resolution":{"observed_at":"2026-08-07T12:02:41.366424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.420949Z","title":"Did aristotle use a laptop? a question answering benchmark with implicit reasoning strategies","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.420949Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:e386ca6d63b42a5a1310d9cf753eed38d3e5d6d8f5637009101218c876c1f356","observation_id":"24e13bf1-970a-4221-bc65-f4b4831166d3","resolution":{"observed_at":"2026-08-07T12:02:41.420949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.509277Z","title":"Bigbench: Towards an industry standard benchmark for big data analytics","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.509277Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:7f27a1a254665c60ce4809d8b6ee20e7ee7b3fff94f66201fc1533c43016df16","observation_id":"fbb57aff-e254-40ad-8db8-7ce6a27925ea","resolution":{"observed_at":"2026-08-07T12:02:41.509277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:02:41.613581Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.613581Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:8bb887ecee3c2b118a0448bd030a0850aa828aca2644c3452ff69cea6c925072","observation_id":"caedcb19-29e4-4c82-93a1-06983ba54bd3","resolution":{"observed_at":"2026-08-07T12:02:41.613581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:02:41.682281Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.682281Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:5807d5ee2f26d7e391b8bb1213b7680a8d35b285cec4ca039905b1580d9203be","observation_id":"c797ffaf-87e0-46f3-87c3-cf41b04460f1","resolution":{"observed_at":"2026-08-07T12:02:41.682281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-08-07T12:02:41.732462Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.732462Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:4762c435e7f946d070fc118a790f17f4f1309ca0fafb29b97aeae008d0c9558f","observation_id":"11484dac-1c3a-4667-965e-39c62904883d","resolution":{"observed_at":"2026-08-07T12:02:41.732462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15066","last_updated":"2023-07-11T15:08:00Z","snapshot_observed_at":"2026-08-05T16:16:01.066507Z","submitted_at":"2023-05-24T11:53:19Z","title":"GPT4Graph: Can Large Language Models Understand Graph Structured Data ? An Empirical Evaluation and Benchmarking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15066","snapshot_observed_at":"2026-08-07T12:02:41.854092Z","title":"Gpt4graph: Can large language models understand graph structured data? an empirical evaluation and benchmarking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.854092Z"},"links":{"cited_paper":"/paper/2305.15066","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:344f208ab70d6c22edc43644a0c385415e73dbcf1a272248c9a2861465f06d3a","observation_id":"a1f25686-1b7d-4287-b5c7-8b1b8b41fa98","resolution":{"observed_at":"2026-08-07T12:02:41.854092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04792","last_updated":"2024-02-29T20:59:17Z","snapshot_observed_at":"2026-08-07T05:40:44.041304Z","submitted_at":"2024-02-07T12:31:13Z","title":"Direct Language Model Alignment from Online AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04792","snapshot_observed_at":"2026-08-07T12:02:41.934550Z","title":"Direct language model alignment from online ai feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.934550Z"},"links":{"cited_paper":"/paper/2402.04792","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a6923a242ae7791b5a2e8955258f0420ccd0f188d7f8469ceda430b380c65b16","observation_id":"7f1ca33b-face-4559-ab79-aec833b99512","resolution":{"observed_at":"2026-08-07T12:02:41.934550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:41.985736Z","title":"Hagberg, Daniel A","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:41.985736Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:9817569f3331a4123a8dbe0208559e366754729b525f26d6b56161eddf129b1c","observation_id":"4a47f84e-0102-48dc-9795-b6f70f55b973","resolution":{"observed_at":"2026-08-07T12:02:41.985736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:42.054172Z","title":"P i V e: Prompting with iterative verification improving graph-based generative capability of LLM s","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.054172Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:dad5996d514a49ce967c12c3462dde34eb963fe065d367209e52d97c4660cee4","observation_id":"0e458bb7-d666-4fac-b00f-4790767dba6b","resolution":{"observed_at":"2026-08-07T12:02:42.054172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:42.222731Z","title":"Harnessing explanations: LLM -to- LM interpreter for enhanced text-attributed graph representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.222731Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:bb11b983051a2d832acaccc893442d10ac1d3320db5617d064ca8b77ac568856","observation_id":"ef3c4d26-b46a-400a-8299-7180e6f017c0","resolution":{"observed_at":"2026-08-07T12:02:42.222731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:42.297856Z","title":"G-retriever: Retrieval-augmented generation for textual graph understanding and question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.297856Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:44a94a9c821bedd53c8073127f0fdf22e4c6ea358508300035e14b4d7b8c57e6","observation_id":"83fd187e-d295-4231-8c86-eded48009c75","resolution":{"observed_at":"2026-08-07T12:02:42.297856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:42.309617Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.309617Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:8dbb6117cfcffb732e5b826ec38e395b957a4f8bde356017537c86e35903b0ce","observation_id":"19e14e4b-21a4-4299-be38-2a2d5743d6fb","resolution":{"observed_at":"2026-08-07T12:02:42.309617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:42.421455Z","title":"Constructing a multi-hop QA dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.421455Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:5a42a0ed64624bdcf98e749871303522ebc8b3e65e03e930f0fdc1bc0de915d2","observation_id":"dea94978-301d-45e5-841f-f2f8ee6ed036","resolution":{"observed_at":"2026-08-07T12:02:42.421455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-07T12:02:42.536541Z","title":"Reinforce++: A simple and efficient approach for aligning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.536541Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:c89ce8fcbc54d2abb35c4bede2a752f5df7665cf9b092cd5ea4bbee098c9706f","observation_id":"34d15855-4bdf-4ec6-a0e9-27a2db79206c","resolution":{"observed_at":"2026-08-07T12:02:42.536541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-07T17:51:38.471379Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-07T12:02:42.612503Z","title":"Efficient test-time scaling via self-calibration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.612503Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:d17cadf82dca248efb190ffb401640935816c78b3e52b7cc0e4662216e5d578d","observation_id":"a5f3239e-5b48-4445-a825-0b4914e56a75","resolution":{"observed_at":"2026-08-07T12:02:42.612503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T12:02:42.711662Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.711662Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a6c10008c612e77d2a5e95ac22c29cdf55101753103b8df3eef7a7d72e779b2d","observation_id":"6b46ed6a-3b50-4f28-b06e-cbf29a47e992","resolution":{"observed_at":"2026-08-07T12:02:42.711662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T12:02:42.847441Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.847441Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:d801d961766a8a005fb092f10f86972b78ddd3dbd748937242064ca5dc5a1ec1","observation_id":"b871d661-0f9d-4ac1-b643-1ba3eea93256","resolution":{"observed_at":"2026-08-07T12:02:42.847441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20380","last_updated":"2025-06-27T15:47:52Z","snapshot_observed_at":"2026-08-07T17:41:58.175541Z","submitted_at":"2025-02-27T18:55:05Z","title":"Multi-Turn Code Generation Through Single-Step Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20380","snapshot_observed_at":"2026-08-07T12:02:42.910462Z","title":"Multi-turn code generation through single-step rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:42.910462Z"},"links":{"cited_paper":"/paper/2502.20380","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:65b8ffbf7c20b489a09361d571f2d735ee937d9c9487ddfb81d283f814b42861","observation_id":"8d5a76bf-7f5f-43f4-9896-b5edec46eeb9","resolution":{"observed_at":"2026-08-07T12:02:42.910462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T12:02:43.027220Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.027220Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:c605ed28687e00af95f797a07a69302f43c4a0b012f6aa1ca26f74fb1afae489","observation_id":"dcd1102e-2d44-4cd7-b500-2df7556aabd6","resolution":{"observed_at":"2026-08-07T12:02:43.027220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-07T12:02:43.148704Z","title":"Swe-bench: Can language models resolve real-world github issues? arXiv preprint arXiv:2310.06770, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.148704Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6b040c2d687921dac42d578ed87e26411e79d412e0157bc13c8da2d5ec8342a4","observation_id":"b776d3eb-a211-41b1-aba7-6136a2d2048f","resolution":{"observed_at":"2026-08-07T12:02:43.148704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12917","snapshot_observed_at":"2026-08-07T12:02:43.222013Z","title":"Training language models to self-correct via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.222013Z"},"links":{"cited_paper":"/paper/2409.12917","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:629c068bd0643ae060cb82dfdeda2842f3108dd73609cb86bc4649350e498aee","observation_id":"b96ee072-207c-4fd8-ad66-50368b0a5b93","resolution":{"observed_at":"2026-08-07T12:02:43.222013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.312396Z","title":"Rlaif: Scaling reinforcement learning from human feedback with ai feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.312396Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:84468373020620eab10bbe2c3b62212426ac2f30d91bda8fba63741fc8df3be6","observation_id":"0b5f94b0-3ca7-48a5-a17f-691a60f214e8","resolution":{"observed_at":"2026-08-07T12:02:43.312396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04706","last_updated":"2024-03-07T18:00:40Z","snapshot_observed_at":"2026-08-07T09:14:55.529271Z","submitted_at":"2024-03-07T18:00:40Z","title":"Common 7B Language Models Already Possess Strong Math Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04706","snapshot_observed_at":"2026-08-07T12:02:43.409391Z","title":"Common 7b language models already possess strong math capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.409391Z"},"links":{"cited_paper":"/paper/2403.04706","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:3f43f174a312d9a72c978498c1d06120041494ffb29693e9505734fc47281bd1","observation_id":"96e0d4e3-bd74-46ea-a197-822349076c4f","resolution":{"observed_at":"2026-08-07T12:02:43.409391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T12:02:43.485411Z","title":"S*: Test time scaling for code generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.485411Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a2c54e7b9aee355ec8d168ae8b75370e9d6762232acfeb74e49589f7e14998c1","observation_id":"941ccb5e-2660-441f-974b-0760f30b506e","resolution":{"observed_at":"2026-08-07T12:02:43.485411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.537471Z","title":"Visiongraph: leveraging large multimodal models for graph theory problems in visual context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.537471Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:beb372be95a63f8d4b30f773009b81d528091056757bbbe10f6ff556aa54ea99","observation_id":"3619c780-a7c1-422f-9064-086eef607436","resolution":{"observed_at":"2026-08-07T12:02:43.537471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.632613Z","title":"Let's verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.632613Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:39278246d976395c155cf89b009c7662e4efe21d7bb36e13196f81fcc72e0c12","observation_id":"4bf57fc4-d9af-46f0-a7ff-303809af236f","resolution":{"observed_at":"2026-08-07T12:02:43.632613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.729431Z","title":"Cohn, and Janet B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.729431Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a4955d404d0863d6a5e679b235f477d13db2370f4554e6714134113fd689161b","observation_id":"0eed5082-a7b3-4341-99fc-caa8ae5e1282","resolution":{"observed_at":"2026-08-07T12:02:43.729431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T12:02:43.783395Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.783395Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:7449154dacaa795ecabc49a4777b64221c5a872be5d1e358953ce155a7232569","observation_id":"879a167e-449a-41a2-b29a-4024358e30d8","resolution":{"observed_at":"2026-08-07T12:02:43.783395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.872890Z","title":"Agentbench: Evaluating LLM s as agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.872890Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:fb6d73676df9dbd11d5b774a22ec992f92f40ca325aa34c518ae1ec66a45cbf8","observation_id":"2a18e68a-364a-4f56-9ced-06d3326948ae","resolution":{"observed_at":"2026-08-07T12:02:43.872890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.938030Z","title":"Wizardmath: Empowering mathematical reasoning for large language models via reinforced evol-instruct","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.938030Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:c6aa988d4e63b3997942001a622bedbc790ac6f96f6ca99d9ec2ea265eabd49b","observation_id":"1a45c322-36fe-4196-8220-a2226ce2b3d4","resolution":{"observed_at":"2026-08-07T12:02:43.938030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:44.026117Z","title":"Reasoning on graphs: Faithful and interpretable large language model reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.026117Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:737c47ee5c8daec72c923b6824e8ba5dd4de153ca6d8123185d44d635d0faf2a","observation_id":"da33b0e2-a34f-405f-af94-35941ec0aa5f","resolution":{"observed_at":"2026-08-07T12:02:44.026117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:44.073470Z","title":"Language models of code are few-shot commonsense learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.073470Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a526d6d0dd7d0137afc285e76c9f6d6b61b2d7d3e60be147f596c105a059b115","observation_id":"86f8acf0-3a8c-4b9e-a8cb-81838ef75c96","resolution":{"observed_at":"2026-08-07T12:02:44.073470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:52.426953Z","title":"Multi-hop question answering","venue":null,"work_id":"999ce956-cddc-46fe-8a48-55022b263b0d","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.155558Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6bb45c00564a50e2ead9a3a52b23e03fdecfdee7b1c5420a8ed8f9049bd60f52","observation_id":"9d4f1c40-78a5-4783-933a-f07abcfedb5f","resolution":{"observed_at":"2026-08-07T12:02:52.430098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:52.413182Z","title":"Sim PO : Simple preference optimization with a reference-free reward","venue":null,"work_id":"8ec702eb-77fe-47f5-9c83-19fd94f439b9","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.217919Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:ebcc559d5056f3323aa8260481ad0672f6225380473e3f64113010b42585261c","observation_id":"3948a30e-7b44-4e56-b85c-b4451968ba50","resolution":{"observed_at":"2026-08-07T12:02:52.419325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T12:02:44.313135Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.313135Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:fec981920f411dbb85fdd995c18d226ede81280136744df27077014e6d7b8340","observation_id":"c09cd8db-81f3-4899-a157-0a5a4213c5b5","resolution":{"observed_at":"2026-08-07T12:02:44.313135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:44.390606Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.390606Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:681e22b2f461501f3e09b20f12a7b59adf4736afee58351b2137121dce29e544","observation_id":"b88f8f08-3a7f-4082-b89b-3537babd03b5","resolution":{"observed_at":"2026-08-07T12:02:44.390606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:52.352848Z","title":"Teach: Task-driven embodied agents that chat","venue":null,"work_id":"a75595d7-fb69-47e0-b70b-6161857db418","year":2017},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.518079Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:4121fd9311ba0617132672ad994faa9743715c1a44cbc5343faa9733b13665a3","observation_id":"a9c9986e-18d8-4477-a621-70879abaab18","resolution":{"observed_at":"2026-08-07T12:02:52.397241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05862","last_updated":"2024-02-08T17:51:44Z","snapshot_observed_at":"2026-08-04T14:08:07.809870Z","submitted_at":"2024-02-08T17:51:44Z","title":"Let Your Graph Do the Talking: Encoding Structured Data for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05862","snapshot_observed_at":"2026-08-07T12:02:44.611941Z","title":"Let your graph do the talking: Encoding structured data for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.611941Z"},"links":{"cited_paper":"/paper/2402.05862","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:cb1caf3c9de7130811f5606c0239953526ef1cb29acfdaad865d214ac4dda3f6","observation_id":"eb477d62-1f18-487a-9d1a-5cfef0d628a5","resolution":{"observed_at":"2026-08-07T12:02:44.611941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:52.281234Z","title":"Introducing gemini 2.0: Our new ai model for the agentic era, Dec 2024","venue":null,"work_id":"5fd8123b-cf0b-4846-b3b9-157276af0ab5","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.632693Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:988fac2536dc12f22505466dcd3b8a2c292fd229e63b6f10cf8cabb2d6635561","observation_id":"12b3a8aa-0371-4be1-b863-5abd71650ece","resolution":{"observed_at":"2026-08-07T12:02:52.312428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16074","last_updated":"2025-05-18T14:13:34Z","snapshot_observed_at":"2026-08-07T16:00:09.967849Z","submitted_at":"2025-04-22T17:53:29Z","title":"PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16074","snapshot_observed_at":"2026-08-07T12:02:44.713393Z","title":"Phybench: Holistic evaluation of physical perception and reasoning in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.713393Z"},"links":{"cited_paper":"/paper/2504.16074","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:176de57e33528980c741df9be57828810747dad5c3bdac145203f9006267e2c5","observation_id":"cb23a208-8f20-4c44-afa0-73abc1de32fb","resolution":{"observed_at":"2026-08-07T12:02:44.713393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:44.811893Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.811893Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:637109e85e3a81f0aafb0e450039d2a5355f739f04af36d74811deadf95f1114","observation_id":"56eb9828-edeb-4f0e-af06-3298d770fd12","resolution":{"observed_at":"2026-08-07T12:02:44.811893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03715","last_updated":"2024-04-04T17:56:41Z","snapshot_observed_at":"2026-08-05T22:29:52.212015Z","submitted_at":"2024-04-04T17:56:41Z","title":"Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03715","snapshot_observed_at":"2026-08-07T12:02:44.872410Z","title":"Direct nash optimization: Teaching language models to self-improve with general preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.872410Z"},"links":{"cited_paper":"/paper/2404.03715","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:cd8e15031c50f434a0b1aa60dc21a9cb2ebf912a654a42e820eadebcd0b85986","observation_id":"1b6b2cad-3767-4e73-9981-da4ba7c71a92","resolution":{"observed_at":"2026-08-07T12:02:44.872410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:52.102330Z","title":"Explagraphs: An explanation graph generation task for structured commonsense reasoning","venue":null,"work_id":"215c28ad-0fc2-42fa-bff9-fcba9a56a48b","year":2021},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.921805Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:fd1382bf2e4e2074287445cdadf41d73e7fc1816a64e8ca4dd7d6f6bed952c3c","observation_id":"488112b6-4cd3-4091-85a3-c93c6afce296","resolution":{"observed_at":"2026-08-07T12:02:52.158934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.940042Z","title":"Proscript: Partially ordered scripts generation","venue":null,"work_id":"4ffc20d7-e57b-4e83-be7c-ffac5fe0ec6c","year":2021},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.018131Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6c5570c1ef790c7cbfd911ff5a8e32473f370c68d105ca9a258e3f491ce43c39","observation_id":"117158e8-d2a4-4b82-acad-a57f262f86c2","resolution":{"observed_at":"2026-08-07T12:02:52.003926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:45.089426Z","title":"Trust region policy optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.089426Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a0bcd7f899799ddc2a73bab675b0d58d682d34d9b0983b924263fa6ae3d9f29b","observation_id":"0f8f4947-48e1-4209-b02e-f81f09a3c432","resolution":{"observed_at":"2026-08-07T12:02:45.089426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:02:45.150608Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.150608Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:029189985339a61fe7d2a3faca9c64ff1490fed2f2ea7e7789bb7d813f741e09","observation_id":"19312d1e-b80b-448a-8ad4-4ac4ad4a3b33","resolution":{"observed_at":"2026-08-07T12:02:45.150608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12118","last_updated":"2025-02-18T18:54:12Z","snapshot_observed_at":"2026-08-07T18:11:25.040275Z","submitted_at":"2025-02-17T18:43:24Z","title":"Scaling Test-Time Compute Without Verification or RL is Suboptimal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12118","snapshot_observed_at":"2026-08-07T12:02:45.177987Z","title":"Scaling test-time compute without verification or rl is suboptimal","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.177987Z"},"links":{"cited_paper":"/paper/2502.12118","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:192b97f4bc9be75a2f5b93419a17dcf33ad3695764bd4934fb6b97dd05e7b8f4","observation_id":"55ac6afc-efc0-4230-bf21-ea854c17561c","resolution":{"observed_at":"2026-08-07T12:02:45.177987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:02:45.228703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.228703Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:4f8341fab8a789bc11354e3360b2a182e8835bb93e46f846077b3b94bc7c24b4","observation_id":"07e7de3c-ed3c-4fbb-952f-6138524d4d8a","resolution":{"observed_at":"2026-08-07T12:02:45.228703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:45.324656Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.324656Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:fb74c805cf561f9fcdc58c477592862f40d1a6e07cab8abf472fc0320dd8a274","observation_id":"18f0b978-ba67-4db2-a50c-a624422e4013","resolution":{"observed_at":"2026-08-07T12:02:45.324656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T12:02:45.419379Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.419379Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:1dadf289ab7f216fc914aca1749a3fd989edb8d79cf89fe144bd6dd7ad220907","observation_id":"7f4eb02f-7174-4345-b1ac-a2fc735ef968","resolution":{"observed_at":"2026-08-07T12:02:45.419379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T12:02:45.488258Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.488258Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6e4aaf43561ac4cd1b259f00b68a824c3d2d1390feb97f65ee70dac4c410af5b","observation_id":"9b41a456-27a2-4afa-ad57-8e480850457b","resolution":{"observed_at":"2026-08-07T12:02:45.488258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.nlrse-1.11","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.821968Z","title":"Deductive additivity for planning of natural language proofs","venue":null,"work_id":"8f3ad230-d70c-4dc1-aec8-0e3d729bacfe","year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.585089Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:46da01f3f959c51f49b8157e68ef411321804a0dc9c6bc20a9c77a72e23d0e8d","observation_id":"61a14c50-91e9-45de-9af1-cc587d7f4c41","resolution":{"observed_at":"2026-08-07T12:02:48.902660Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-07T12:02:45.698793Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.698793Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:23e6142634c49a111f4caa7fe23f1bd1c0fb261ff4864f1e0069d2ebe5fde670","observation_id":"51686ea3-489d-4669-a2b8-a78cae193a02","resolution":{"observed_at":"2026-08-07T12:02:45.698793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.735401Z","title":"Table meets llm: Can large language models understand structured table data? a benchmark and empirical study","venue":null,"work_id":"c2dcd7f7-4f86-4c96-9011-2ee055a9a935","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.776746Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:511e7099fea034a7d1950e655a949c21453540316a078155c7ff338dec4b7703","observation_id":"3033efb2-2d8f-4f37-92fb-70b588e97c84","resolution":{"observed_at":"2026-08-07T12:02:51.874437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.479039Z","title":"Commonsense QA 2.0: Exposing the limits of AI through gamification","venue":null,"work_id":"ae356f64-3547-44e2-9fa0-8fd57487fa12","year":2021},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.850259Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:fe056641bc9fda07bb268b4c6dc6555c605cbb0b48570fa1f909bd97180a32bc","observation_id":"52744ef0-18a2-4e66-b457-9a8b63e35fb6","resolution":{"observed_at":"2026-08-07T12:02:51.568323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.295166Z","title":"Graphgpt: Graph instruction tuning for large language models","venue":null,"work_id":"92b30a59-2fe5-49eb-8103-47a61293d2cf","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.960422Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:e4dc2adcd6a906ca415568130633be2d26df030af1549b7d434ec21bcbbd0745","observation_id":"f0d1d8e5-ef9a-4e91-9e2d-17e14deefa75","resolution":{"observed_at":"2026-08-07T12:02:51.395148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.146021Z","title":"Grapharena: Evaluating and exploring large language models on graph computation","venue":null,"work_id":"cea057de-ceb8-47ba-946e-2f476d11bb94","year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.051854Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:69ae31ed567a1165e812a9d2960b95aa657703f1a2d3b707828a565e1ce20c42","observation_id":"18b06361-930a-484c-bbea-b79375163e70","resolution":{"observed_at":"2026-08-07T12:02:51.185959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T12:02:46.078869Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.078869Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:26db04dcbcf46296e16225e942126a944df4c7e2688f842d9da843fbe793246f","observation_id":"e41c1665-69e7-46c6-821e-82833ad0a001","resolution":{"observed_at":"2026-08-07T12:02:46.078869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.140093Z","title":"Dart-math: Difficulty-aware rejection tuning for mathematical problem-solving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.140093Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:f31b92219ec4b26101073ecbd5de19b6ba47dc876368601156a865749defc15a","observation_id":"f653fc66-986b-4e1b-8464-4064198d7143","resolution":{"observed_at":"2026-08-07T12:02:46.140093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-07T12:02:46.242901Z","title":"Solving math word problems with process-and outcome-based feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.242901Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:7079416a823614bb617589c570cd531f218087267968492ab5ba9346ed972c8e","observation_id":"2353a9b1-9598-49d0-98c7-1bf6d4a85c5f","resolution":{"observed_at":"2026-08-07T12:02:46.242901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.942045Z","title":"Planbench: An extensible benchmark for evaluating large language models on planning and reasoning about change","venue":null,"work_id":"a4e83412-5527-4d6d-99f8-adf628c07a8b","year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.329086Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:25a0ef4f9618c9d4118e83c634d3af09cf62cea11b2b6480ed2228a6142eefb6","observation_id":"5cfa9ee6-9010-4d81-80dc-0e3b6a62e8d1","resolution":{"observed_at":"2026-08-07T12:02:51.054519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.408784Z","title":"Trl: Transformer reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.408784Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:24c0b659f7dcd25cc51ad6233040cf26916379040534d78569ae6a8dbf0eb9c8","observation_id":"cab17d44-cddc-49b2-b162-d227fb4b241a","resolution":{"observed_at":"2026-08-07T12:02:46.408784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09501","last_updated":"2025-05-27T03:22:35Z","snapshot_observed_at":"2026-08-07T17:09:42.953110Z","submitted_at":"2025-03-12T16:05:31Z","title":"ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09501","snapshot_observed_at":"2026-08-07T12:02:46.521384Z","title":"Rema: Learning to meta-think for llms with multi-agent reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.521384Z"},"links":{"cited_paper":"/paper/2503.09501","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a7802e45d3c79eafbedc77e9fe288c4fc584c817fcd35279eeae868b185b25bb","observation_id":"d278164a-83a7-47e6-bdd4-399b7cb356d2","resolution":{"observed_at":"2026-08-07T12:02:46.521384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.780964Z","title":"Llms as zero-shot graph learners: Alignment of gnn representations with llm token embeddings","venue":null,"work_id":"bd387806-2f97-40bd-9743-c228b44b2412","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.601630Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:e513f8a4f4fb056531b140fba2703e2d9009cde9f97b2a677571017c333eaf07","observation_id":"9f68190f-68da-475a-bcfa-b6810b8f8717","resolution":{"observed_at":"2026-08-07T12:02:50.846643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.650583Z","title":"Can language models solve graph problems in natural language? In Thirty-seventh Conference on Neural Information Processing Systems, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.650583Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:cc1bb69bc38d9400f481e318ca7c4145f5ddecd460b937fce0eea06eb2ce4ecb","observation_id":"30cef527-dcd8-4a09-9558-ab22be4a669a","resolution":{"observed_at":"2026-08-07T12:02:46.650583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.729932Z","title":"I nstruct G raph: Boosting large language models via graph-centric instruction tuning and preference alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.729932Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:2083277a8acc70d22e18293859a7e06685af3bb19b9515b836728cb0058ccb05","observation_id":"cbc50788-a23e-4b39-ba6e-2a62dde2af02","resolution":{"observed_at":"2026-08-07T12:02:46.729932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-08-07T12:02:46.810689Z","title":"Swe-rl: Advancing llm reasoning via reinforcement learning on open software evolution","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.810689Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:dcdb7296afe2bf6a12f5607e7915ede25a51778c6c392d44e8fbccbec7ed0874","observation_id":"feecfe1d-f5d2-4e96-a23f-937fdb0d76f6","resolution":{"observed_at":"2026-08-07T12:02:46.810689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.648936Z","title":"Codeplan: Unlocking reasoning potential in large language models by scaling code-form planning","venue":null,"work_id":"b0e33ece-fc3f-432e-b40b-4bbc637056ab","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.901937Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6a4a4214d4be3e2bb2cefce3535790a4924424f67544442f94b0baffa15a8635","observation_id":"d0fb58a5-aad7-4f38-a33d-180219151861","resolution":{"observed_at":"2026-08-07T12:02:50.725063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.534609Z","title":"Can graph learning improve planning in llm-based agents? In The Thirty-eighth Annual Conference on Neural Information Processing Systems, 2024","venue":null,"work_id":"c84d8979-8536-457c-a545-58d1de55dc97","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.941289Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:abcfacdd9d104267270e9c68dfb77658016a48eb970122500537eab7fef7fab5","observation_id":"acf3de7f-76a1-4643-9f38-585e08c9ec61","resolution":{"observed_at":"2026-08-07T12:02:50.578498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14333","last_updated":"2024-05-23T09:03:42Z","snapshot_observed_at":"2026-07-06T18:18:25.746022Z","submitted_at":"2024-05-23T09:03:42Z","title":"DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14333","snapshot_observed_at":"2026-08-07T12:02:47.047930Z","title":"Deepseek-prover: Advancing theorem proving in llms through large-scale synthetic data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.047930Z"},"links":{"cited_paper":"/paper/2405.14333","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:631fc7e6f2e51157198f987959573c5cd4c363ec655c74b70e69be1638911db1","observation_id":"7767963a-1620-4454-b979-593879e8d237","resolution":{"observed_at":"2026-08-07T12:02:47.047930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.711","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.319542Z","title":"TRIGO : Benchmarking formal mathematical proof reduction for generative language models","venue":null,"work_id":"c3024797-3048-4876-a8d6-43d9747d6746","year":2023},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.150399Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:40d29585b467ca2b182f94cebfeca689670d20d26403db3e6b145d63c1bbe2a2","observation_id":"16bc7cef-817b-40ec-8be3-2eec16a6f1d0","resolution":{"observed_at":"2026-08-07T12:02:50.430587Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.208149Z","title":"Watch every step! LLM agent learning via iterative step-level process refinement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.208149Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:7597ce13fec3029f5dc934039b94c772292cb1ccc243fd652445aaf645c9d4cc","observation_id":"19c53e63-1d8d-49b8-bcff-87bf899cb648","resolution":{"observed_at":"2026-08-07T12:02:47.208149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.192321Z","title":"Contrastive preference optimization: Pushing the boundaries of LLM performance in machine translation","venue":null,"work_id":"69900295-5584-4f00-88d5-a27b8117839d","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.319176Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:6b4923a0a21e85af78ed6f35094d2e915d4ebe43aec6c0e451fc6c9cf1e6d240","observation_id":"b197725f-2f5e-4a2c-a2c4-b166dcaef12e","resolution":{"observed_at":"2026-08-07T12:02:50.269168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:02:47.429349Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.429349Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:c5fbd9a72965053af48d480fa14d4494b305f754b3e28c3254b7d2d9513d8af8","observation_id":"a07df27f-0641-4445-b1c3-bf5ee97d8b17","resolution":{"observed_at":"2026-08-07T12:02:47.429349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09560","last_updated":"2025-06-05T07:22:50Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:11:34Z","title":"EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09560","snapshot_observed_at":"2026-08-07T12:02:47.492691Z","title":"Embodiedbench: Comprehensive benchmarking multi-modal large language models for vision-driven embodied agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.492691Z"},"links":{"cited_paper":"/paper/2502.09560","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:feccf82e5537a529625a5eeed5fa1248ee9ed43f105330509d8bf5074cc6452a","observation_id":"cbd61906-62d7-4051-a036-23900ad0d07b","resolution":{"observed_at":"2026-08-07T12:02:47.492691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T12:02:47.598747Z","title":"Dapo: An open-source llm reinforcement learning system at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.598747Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:206a47d19218c02478e62db6556d636ae99b7fa75b57bde7d946321bddb801cd","observation_id":"9af23f9f-4d9b-47fb-8a1b-8f4bbf3eea20","resolution":{"observed_at":"2026-08-07T12:02:47.598747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.959939Z","title":"Advancing LLM reasoning generalists with preference trees","venue":null,"work_id":"da1abe7c-ffb9-4c40-b1b7-895039f78a63","year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.731227Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:f24ebf33b5d7b6d52b95d90ed603674e311fcc65a3e650422e02beffc0e65d5c","observation_id":"ddd56d78-0fac-4c66-8bcc-01143c2e5400","resolution":{"observed_at":"2026-08-07T12:02:50.114514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-07T12:02:47.802104Z","title":"Vapo: Efficient and reliable reinforcement learning for advanced reasoning tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.802104Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:dbbd66eb0bf2d6efbf0299c6d9db3a6eab2964780b33385484b6b89878fb01a4","observation_id":"32d60b21-8cf9-41d5-8188-815c95221139","resolution":{"observed_at":"2026-08-07T12:02:47.802104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-07T12:02:47.920328Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model? arXiv preprint arXiv:2504.13837, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.920328Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:22632e0a593a9818994454e6ebdf4c8b911791b3fea633c2a2d303e9a9134e58","observation_id":"5139680d-f987-4cb5-9adf-875d71ac9ce8","resolution":{"observed_at":"2026-08-07T12:02:47.920328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.817109Z","title":"Chain of preference optimization: Improving chain-of-thought reasoning in llms","venue":null,"work_id":"6ff3d211-1367-4ae9-a0e5-4212d3492bfa","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:48.056505Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:9501fd79b9a81948fbe1e37cc0a72ce6efa04c9ba4289c2e68e3b88ce82f8cfa","observation_id":"ee6b9cf4-c1ce-48e8-8dcc-862e24770cd8","resolution":{"observed_at":"2026-08-07T12:02:49.881664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.127","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.629760Z","title":null,"venue":null,"work_id":"b024b553-aeda-43eb-af1d-7de7e7b815fb","year":2024},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:48.093596Z"},"links":{"citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:119f7c84cc185e2ec07ed786eea159d72d1a934c88ace2deabd406d891201490","observation_id":"65db2cf2-208c-4ba9-9381-c15e4a99d016","resolution":{"observed_at":"2026-08-07T12:02:48.696972Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":79,"verified_exact":4,"verified_fuzzy":17},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 2 inbound Pith citation observations for arXiv:2506.00845."}