{"as_of":"2026-08-07T08:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84225dbf910bb26071c4c4dfb7486ed58fa155289046f0eba4caac15eb263a32","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:51:17.713769Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28301/citation-record","integrity":"/paper/2607.28301/integrity","json":"/paper/2607.28301/citation-record.json","paper":"/paper/2607.28301"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:16.617095Z","title":"InIWOMP 2023, 18–33","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:16.617095Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:5aa70c435b1340fe45bde710002ac69ea15f2e50914e1bc5e2f92f15238ce1d5","observation_id":"7fd94f80-cde0-44d9-90c5-7cfdcf8422cd","resolution":{"observed_at":"2026-07-31T11:51:16.617095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:16.780567Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:16.780567Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:c902320db6f84fbb857c1e47edfe7d4c7a144305b0951a9d599791b206d57cc6","observation_id":"4df1d12c-fb48-4747-8969-240dbe203045","resolution":{"observed_at":"2026-07-31T11:51:16.780567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:16.932725Z","title":"InICPP-W 2025, 1–8","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:16.932725Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:59e5dcf1902ac913912e83ab077625a69981851bab1467c195f357bfe8a4eb89","observation_id":"b7392bfa-6c09-4a4c-aa3f-73b753af7445","resolution":{"observed_at":"2026-07-31T11:51:16.932725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:17.195369Z","title":"InSC-W 2023, 215–223","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.195369Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:e1fcc2df001770aa191d8253df6c6a39a8baed2deb055de1f413dd225e457706","observation_id":"f1db59a4-2846-4528-b9f1-95566329cc1a","resolution":{"observed_at":"2026-07-31T11:51:17.195369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02018","last_updated":"2024-02-07T01:51:21Z","snapshot_observed_at":"2026-08-03T17:48:27.817050Z","submitted_at":"2024-02-03T04:21:07Z","title":"The Landscape and Challenges of HPC Research and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02018","snapshot_observed_at":"2026-07-31T11:51:17.271623Z","title":"Zhang, S.; Zhao, J.; Yu, Q.; Xia, C.; Wang, Z.; Feng, X.; and Cui, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.271623Z"},"links":{"cited_paper":"/paper/2402.02018","citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:df0e2c38f6626947ff2840b1d5f472c02e894288cd33c1405f15af724ff049f8","observation_id":"a79d8740-f6dc-4a32-9803-47b5eaf85d45","resolution":{"observed_at":"2026-07-31T11:51:17.271623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14771","last_updated":"2024-09-23T07:39:01Z","snapshot_observed_at":"2026-08-07T00:29:12.636736Z","submitted_at":"2024-09-23T07:39:01Z","title":"OMPar: Automatic Parallelization with AI-Driven Source-to-Source Compilation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14771","snapshot_observed_at":"2026-07-31T11:51:17.365405Z","title":"Kadosh,T.;Hasabnis,N.;Vo,V.A.;Schneider,N.;Krien,N.; Wasay,A.;etal.2023.ScopeIsAllYouNeed:Transforming LLMs for HPC Code.Preprint, arXiv:2308.09440","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.365405Z"},"links":{"cited_paper":"/paper/2409.14771","citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:e5b97491c6a3cbd693a2247ca0e1169b6cc6850c74952a68d5a84f05d6e6c200","observation_id":"4253ba02-6936-4baa-9bb0-d29385a550bf","resolution":{"observed_at":"2026-07-31T11:51:17.365405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:17.444492Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.444492Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:6b5fa3f3579d8a82d3294d65df6bceda67f0b48673106c98ec9a5d26e2a502e3","observation_id":"e846d069-e54d-434c-9b1b-067ed4fec7e9","resolution":{"observed_at":"2026-07-31T11:51:17.444492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-31T11:51:17.512367Z","title":"DeepSeek-AI.2025.DeepSeek-R1:IncentivizingReasoning Capability in LLMs via Reinforcement Learning.Nature, 645:633–638","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.512367Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:da3df7d142574908d0b17fed240304f93ecf3f2ba23324c61416f37b70363941","observation_id":"84439784-2bf4-4eb8-9a74-82ad13ed103c","resolution":{"observed_at":"2026-07-31T11:51:17.512367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-31T11:51:17.585632Z","title":"Touvron, H.; Martin, L.; Stone, K.; Albert, P.; Almahairi, A.;Babaei, Y.;etal.2023.LLaMA2:OpenFoundationand Fine-Tuned Chat Models.Preprint, arXiv:2307.09288","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.585632Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:a8d2d3cf54edb1c01403d325c325e2cb86896dffe47cbecf6cdcc62e3af34fe6","observation_id":"9de49774-5509-4591-bdff-276636728b8d","resolution":{"observed_at":"2026-07-31T11:51:17.585632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-31T11:51:17.641419Z","title":"Liao, C.; Lin, P.-H.; Asplund, J.; Schordan, M.; and Karlin, I.2017.DataRaceBench:ABenchmarkSuiteforSystematic Evaluation of Data Race Detection Tools","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.641419Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:ce620d87812a6be204e403e4c54601fa0d8e5ae726daed0f12b4ed02901abc92","observation_id":"62dfc74d-22c6-4a6b-b2b6-5aa6a358c002","resolution":{"observed_at":"2026-07-31T11:51:17.641419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14733","last_updated":"2024-12-09T02:55:30Z","snapshot_observed_at":"2026-07-06T20:25:45.259430Z","submitted_at":"2024-12-09T02:55:30Z","title":"LLM as HPC Expert: Extending RAG Architecture for HPC Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14733","snapshot_observed_at":"2026-07-31T11:51:17.089714Z","title":"Preprint, arXiv:2501.14733","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.089714Z"},"links":{"cited_paper":"/paper/2501.14733","citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:b8d0421e7570c10ee606aea30f719dd09de60579b9485d8473483a40cc4f9f7f","observation_id":"44f17e1c-a2ec-401e-99a6-cc067987207d","resolution":{"observed_at":"2026-07-31T11:51:17.089714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:17.713769Z","title":"2020 (ongoing)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.713769Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:536ee1304e997296e73ec3133d794fe1e0f6b7bd7370d4bc5022cc7017f47bb2","observation_id":"24159bee-de49-4a41-a37b-efc79102b5a5","resolution":{"observed_at":"2026-07-31T11:51:17.713769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:16.549534Z","title":"InSC-W 2023, 951–960","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:16.549534Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:fc7d87a59e7a668ebe6562eb1466783afda34ecafc7a0e8f2cce514f3eac6fb3","observation_id":"870b0654-3782-4d6e-b20f-ff45ba825b62","resolution":{"observed_at":"2026-07-31T11:51:16.549534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:16.865154Z","title":"InSC-W 2024, 19–24","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:16.865154Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:ccfa38ce894ead0e495130d535970e984273a852ed6e5b3f6776f4ea621c9e07","observation_id":"dcfc65c8-4cf1-4a77-9e3d-a0ce60e91604","resolution":{"observed_at":"2026-07-31T11:51:16.865154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:16.710813Z","title":"InSC-W 2025, 727–739","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:16.710813Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:b3b8323db2f4b4a44bf85b571ee4eb678ef3f14cd8d460c8a633d2556559fe8b","observation_id":"13d2e9d5-c081-4e65-a032-b7e57c2a9bf1","resolution":{"observed_at":"2026-07-31T11:51:16.710813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:51:17.023860Z","title":"InHigh Performance Com- puting (ISC 2025), Springer, 626–638","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-31T11:51:17.023860Z"},"links":{"citing_paper":"/paper/2607.28301"},"observation_digest":"sha256:a6150b7d24dba0fc2c56b3ad8290dac535ae89bcd7e0a8a4e04e8e50eb049946","observation_id":"b5dcc5a4-4bda-4596-9e08-d996d23e30fd","resolution":{"observed_at":"2026-07-31T11:51:17.023860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28301","last_updated":"2026-07-30T14:41:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T15:50:53.053152Z","submitted_at":"2026-07-30T14:41:05Z","title":"HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2607.28301."}