{"as_of":"2026-08-09T10:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3996d28e8ca6861bd2e9ce1f628bfb20c9d956e6522bcd2d8b020db6f513205c","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:34:00.971942Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.12463/citation-record","integrity":"/paper/2607.12463/integrity","json":"/paper/2607.12463/citation-record.json","paper":"/paper/2607.12463"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:56.164161Z","title":"Front-loading reasoning: The synergy between pretraining and post-training data.arXiv preprint arXiv:2510.03264, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.164161Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:90749dfacc5703d6950b540a9b76b8aba4d2741c872abcd25fbcf007ea8bcb3b","observation_id":"87356b9c-b6e5-458b-80d1-604ef3cf3087","resolution":{"observed_at":"2026-08-02T06:33:56.164161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:56.278225Z","title":"Efficient training of language models to fill in the middle, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.278225Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:25296dbdd92a69a2922864104dc09aa8710925a633093b1bf3a6d7c3d48d0e4f","observation_id":"e1f65f3e-f9b6-4ec0-a1d7-09230d6235ef","resolution":{"observed_at":"2026-08-02T06:33:56.278225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:56.405750Z","title":"Unveiling the key factors for distilling chain-of- thought reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.405750Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:ad05bc31835989f2f7efb1b326de8ffe087a8085335b3a4d2cdc3bf6339aeed3","observation_id":"0c0fcd34-8085-414b-ac71-1f0fcae16bea","resolution":{"observed_at":"2026-08-02T06:33:56.405750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:56.598549Z","title":"Dataflow-guided retrieval augmentation for repository- level code completion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.598549Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:2dc7255c54e783b04421c673036a03e8d63b53511d1e7e0a4110a41ae96c02fd","observation_id":"548e7adb-f369-491f-b1a3-c17da3be1879","resolution":{"observed_at":"2026-08-02T06:33:56.598549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:56.788704Z","title":"Fullstack bench: Evaluating llms as full stack coders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.788704Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:c4d7e3a97e0c6d9f2a3dac1eee06dd06d12b48bea712ffbf3d04e1249ceec1e2","observation_id":"17284814-d1ae-4621-82aa-c69f843717fa","resolution":{"observed_at":"2026-08-02T06:33:56.788704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16941","last_updated":"2025-11-14T22:00:03Z","snapshot_observed_at":"2026-08-06T21:34:46.041153Z","submitted_at":"2025-09-21T06:28:17Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16941","snapshot_observed_at":"2026-08-02T06:33:56.894076Z","title":"Swe-bench pro: Can ai agents solve long-horizon software engineering tasks?arXiv preprint arXiv:2509.16941, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.894076Z"},"links":{"cited_paper":"/paper/2509.16941","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:ead85492c1d30401993048ff7e1ee4c445f1f5ab1101e93c13cef8bd648516b3","observation_id":"44581cb5-c404-4c49-be64-31e323f306a4","resolution":{"observed_at":"2026-08-02T06:33:56.894076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:56.994773Z","title":"Horizon- length prediction: Advancing fill-in-the-middle capabilities for code generation with lookahead planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:56.994773Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:f1beec1ce4d1c7acaf9c7fad281fb48df8e862c4bf1af5c048cca25e5709acfe","observation_id":"5aa54cee-4739-43e2-8120-892359447799","resolution":{"observed_at":"2026-08-02T06:33:56.994773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05999","last_updated":"2023-04-09T14:31:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T16:25:26Z","title":"InCoder: A Generative Model for Code Infilling and Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05999","snapshot_observed_at":"2026-08-02T06:33:57.075664Z","title":"Incoder: A generative model for code infilling and synthesis.arXiv preprint arXiv:2204.05999, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.075664Z"},"links":{"cited_paper":"/paper/2204.05999","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:518cc73f7e35028611702e33d071069661ec3794d3d293724d3f4e1307c72220","observation_id":"d82ff36b-b053-4d80-9844-ca5838a63365","resolution":{"observed_at":"2026-08-02T06:33:57.075664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:57.162384Z","title":"Distil-whisper: Robust knowledge distillation via large-scale pseudo labelling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.162384Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:37291a0495e99a2b562eff2b61daeb758c03ae32dfeae7977113b2d6bdcd31a4","observation_id":"d446880f-f941-4771-b127-36d037e26986","resolution":{"observed_at":"2026-08-02T06:33:57.162384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:57.259006Z","title":"Training long-context, multi-turn software engineering agents with reinforcement learning.arXiv preprint arXiv:2508.03501, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.259006Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:c08b4883f82995308047cf1cc6d2b4c8fd426e79fb3bb9fe4ef946fc490b0356","observation_id":"798a3dcd-f2a5-44d0-91d1-1c212be2afc6","resolution":{"observed_at":"2026-08-02T06:33:57.259006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00204","last_updated":"2025-05-30T20:19:39Z","snapshot_observed_at":"2026-08-08T01:14:12.594755Z","submitted_at":"2025-05-30T20:19:39Z","title":"Structure-Aware Fill-in-the-Middle Pretraining for Code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00204","snapshot_observed_at":"2026-08-02T06:33:57.411921Z","title":"Structure-aware fill-in-the- middle pretraining for code.arXiv preprint arXiv:2506.00204, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.411921Z"},"links":{"cited_paper":"/paper/2506.00204","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:ca20e29af7d86c15da272bcf2d34e52aec6088d45aba170e2e470a46dc3440cf","observation_id":"c1ffcf2f-1ed4-4a34-8622-7e4bff098838","resolution":{"observed_at":"2026-08-02T06:33:57.411921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03003","last_updated":"2024-06-23T01:24:33Z","snapshot_observed_at":"2026-08-05T00:46:05.356084Z","submitted_at":"2024-01-05T06:51:08Z","title":"AST-T5: Structure-Aware Pretraining for Code Generation and Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03003","snapshot_observed_at":"2026-08-02T06:33:57.562334Z","title":"Ast-t5: Structure-aware pretraining for code generation and understanding.arXiv preprint arXiv:2401.03003, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.562334Z"},"links":{"cited_paper":"/paper/2401.03003","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:dce29a7a5b6153236ce1fef9c6b972e22fe08cee79b5e8d4e98abda605ab89a6","observation_id":"c6da5679-11b8-463d-b018-dd6da5043e92","resolution":{"observed_at":"2026-08-02T06:33:57.562334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:57.694508Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.694508Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:cec47af5abd0fccdcae8ea3bd467cc07d478c5e569a309d8c612f70e96e7fb4f","observation_id":"39b38b69-6b6d-400c-8b0d-8fa7b295b913","resolution":{"observed_at":"2026-08-02T06:33:57.694508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:57.810595Z","title":"DeepSeek-Coder: When the large language model meets programming – the rise of code intelligence, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.810595Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:1a32d6b1362d5f628e2ae36ceb7561862669af7e00cab05c751b494b8c34bfc7","observation_id":"9f3ddfdb-2f73-4f52-835b-dc528834992b","resolution":{"observed_at":"2026-08-02T06:33:57.810595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:57.900653Z","title":"Don’t stop pretraining: Adapt language models to domains and tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:57.900653Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:09e320350f64f8f56cc3f51dc794efc792c1273e2c26e614c7a9f3b637a48be8","observation_id":"d92990a3-84f3-44a8-ba63-5575ea81d4f5","resolution":{"observed_at":"2026-08-02T06:33:57.900653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.027303Z","title":"Large language models are reasoning teachers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.027303Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:63f1a80e2cef18cc38193a4a350dd91e560ffd30726ed7264ad43a0001f77f3a","observation_id":"c0bd3c7b-61bb-4f9e-b52e-c071f33c29c8","resolution":{"observed_at":"2026-08-02T06:33:58.027303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.217490Z","title":"Distilling step-by-step! outperforming larger language models with less training data and smaller model sizes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.217490Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:72d92a489a45a24bc09e80364344bdfd6d0e2c4b6f44b77b64d94b569af8de34","observation_id":"ab85b3a3-18b3-470e-9617-69f5d4f4ae8e","resolution":{"observed_at":"2026-08-02T06:33:58.217490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.393122Z","title":"Minicpm: Unveiling the potential of small language models with scalable training strategies, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.393122Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:f1cc6560162de84e253271aaba746a233a04ff5e45ac0c5be751de73b414d8fa","observation_id":"03c3d30f-678f-4d0d-83e8-5b1137cfd7e3","resolution":{"observed_at":"2026-08-02T06:33:58.393122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.523198Z","title":"Remit: Rl-guided mid-training for iterative llm evolution.arXiv preprint arXiv:2602.03075, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.523198Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:6d3e65d21115ef9d7b3ec4595250030a467eba958d9f7ac35a6f9a5a3bd954c1","observation_id":"4eda4e5a-b2e6-40c6-a54f-e1c75902a15b","resolution":{"observed_at":"2026-08-02T06:33:58.523198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.621578Z","title":"Qwen2.5-Coder technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.621578Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:df536b090511b51c56f7a508e40ccf621362f9ac876a3eb14f54f6616f9ea894","observation_id":"5afb4dbe-0c9b-451a-b5f9-7f5df3994a02","resolution":{"observed_at":"2026-08-02T06:33:58.621578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.759109Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.759109Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:b015bff17f331326b7a2e51500373f07cfbecf1bad1003ed12b17cfbc03b75fb","observation_id":"021825f1-96f5-4e64-b97d-070a66580359","resolution":{"observed_at":"2026-08-02T06:33:58.759109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.880140Z","title":"R2E- Gym: Procedural environments and hybrid verifiers for scaling open-weights SWE agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.880140Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:24cfa263cb24b7a6225387ff9bdbfed02eaf76304f2c70b6a9cc16e286a2c34d","observation_id":"92fb6a06-14de-41dc-a9bf-00926157b20b","resolution":{"observed_at":"2026-08-02T06:33:58.880140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:58.985434Z","title":"SWE-bench: Can language models resolve real-world GitHub issues? InThe twelfth international conference on learning representations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:58.985434Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:5aa3cd776b1bc7b2ff039b71ab5423da3bc64bf286c385972a2cf9a11558e4f8","observation_id":"1a3a3d7c-f816-4e6d-8993-32a484057294","resolution":{"observed_at":"2026-08-02T06:33:58.985434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:59.124799Z","title":"StarCoder: May the source be with you!, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.124799Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:7b705fef67951bc915db8031af703db95c170438018ba0a2186d065e56cf1bf7","observation_id":"34ee56de-d241-4837-9631-be9026e4a297","resolution":{"observed_at":"2026-08-02T06:33:59.124799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-02T06:33:59.318359Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.318359Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:9d7d88f8d338660451b54c19ee3479d128dd51c247b729b01332b3a7e26d4f81","observation_id":"d38dfb7a-4470-427f-932a-5bf9d97ded7f","resolution":{"observed_at":"2026-08-02T06:33:59.318359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07003","last_updated":"2024-09-13T07:19:16Z","snapshot_observed_at":"2026-08-07T10:14:47.871491Z","submitted_at":"2024-06-11T06:55:32Z","title":"GraphCoder: Enhancing Repository-Level Code Completion via Code Context Graph-based Retrieval and Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07003","snapshot_observed_at":"2026-08-02T06:33:59.481214Z","title":"Graphcoder: Enhancing repository-level code completion via code context graph-based retrieval and language model.arXiv preprint arXiv:2406.07003, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.481214Z"},"links":{"cited_paper":"/paper/2406.07003","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:bc1f93993952d884a6eecdf79c4ad228be5918ec79362b9dfffba5bde75f698e","observation_id":"4dd3fc73-fa21-4091-9bb2-eaf18b890e9e","resolution":{"observed_at":"2026-08-02T06:33:59.481214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-02T06:33:59.587278Z","title":"Starcoder 2 and the stack v2: The next generation.arXiv preprint arXiv:2402.19173, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.587278Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:6bcaefc21012ff2e6b1b0c324bfd61bf1d1bbdf0f8987df3e9e5fb27195fb77c","observation_id":"081d22a0-34ba-46c5-8151-5b680a052b5a","resolution":{"observed_at":"2026-08-02T06:33:59.587278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:59.646175Z","title":"Terminal-bench: Benchmarking agents on hard, realistic tasks in command line interfaces, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.646175Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:2bbdbfdc67db490a9e6ee40610a5c9d25fafbac792c8997b0f0ef448a9fa60ae","observation_id":"aa31f378-ca5a-448f-b19c-6c38092530c5","resolution":{"observed_at":"2026-08-02T06:33:59.646175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:59.702228Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.702228Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:e8b26def60da0f61bb0142ea5c211f47c6ed34db61702ebbbb8556504ab618fc","observation_id":"0b6e8fd6-29d6-46c0-831f-08cbe8f6f252","resolution":{"observed_at":"2026-08-02T06:33:59.702228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-02T06:33:59.753653Z","title":"Codegen: An open large language model for code with multi-turn program synthesis.arXiv preprint arXiv:2203.13474, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.753653Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:a913443b126214ca22dca228b97a2fc4c9c24d5a876d6ef795776e71c430074c","observation_id":"248fc594-a3b7-47c2-a6b9-4e435495731b","resolution":{"observed_at":"2026-08-02T06:33:59.753653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:59.822919Z","title":"Training software engineering agents and verifiers with SWE-Gym, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.822919Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:8e5223b059573f55b9689d737558013b58052481b24bceeb00cfaa1304002e94","observation_id":"d029276a-2be8-413c-9a45-bcba2ceb02ee","resolution":{"observed_at":"2026-08-02T06:33:59.822919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:59.910458Z","title":"The berkeley function calling leaderboard (bfcl): From tool use to agentic evaluation of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.910458Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:d96544ef0b16af24759b18b047cf9ea4331c46b9503da8514606b05c54e7628a","observation_id":"b344e083-df60-4779-a4a5-0b4636d0bba5","resolution":{"observed_at":"2026-08-02T06:33:59.910458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:33:59.971834Z","title":"Code Llama: Open foundation models for code, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T06:33:59.971834Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:d0d06da9df3c581ca06ae55f527619471976c753d97ec88db50a6d127e5a15a6","observation_id":"01f97947-0c39-4354-8364-92020d2a748c","resolution":{"observed_at":"2026-08-02T06:33:59.971834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.023470Z","title":"Bridging developer instructions and code completion through instruction-aware fill-in-the- middle paradigm.arXiv preprint arXiv:2509.24637, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.023470Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:4b7dbe06a9018cec5c74a32da754f27f0d9010ed9bcac6205bff8beb5be27470","observation_id":"39012456-3693-4399-aae5-648fb2a670b8","resolution":{"observed_at":"2026-08-02T06:34:00.023470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.129257Z","title":"SWE-Lego: Pushing the limits of supervised fine-tuning for software issue resolving, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.129257Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:83379af6ae1c97011f4a9f2a81f52050e8c228b6ae3bd5dee0eaa6f5e4c67aca","observation_id":"4537f41a-4e0c-45eb-8bfe-720f717a5cc6","resolution":{"observed_at":"2026-08-02T06:34:00.129257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.185453Z","title":"A survey on llm mid-training.arXiv preprint arXiv:2510.23081, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.185453Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:c0689eeb719573c6be7ad0a7334154e33639c5944d806794df9055aa1c081175","observation_id":"fa1f1b3f-2308-47f3-98dc-a357de57558a","resolution":{"observed_at":"2026-08-02T06:34:00.185453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.248347Z","title":"OpenHands: An open platform for AI software developers as generalist agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.248347Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:4e331a4fa1f54062630fcb4c2da697af6137db6b5df9878beffc2769ed6631c5","observation_id":"1e59ec34-9868-4f70-bbfb-62ecadfbd2dd","resolution":{"observed_at":"2026-08-02T06:34:00.248347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.346220Z","title":"Ojbench: A competition level code benchmark for large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.346220Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:a338146c8feb2f9c800bd908a83cc996da33437bb4aef42efd968ba87aaf0e92","observation_id":"5b3824d0-ef03-4c51-8343-d4b14af82000","resolution":{"observed_at":"2026-08-02T06:34:00.346220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18552","last_updated":"2026-06-02T06:06:43Z","snapshot_observed_at":"2026-08-03T15:02:08.953642Z","submitted_at":"2025-12-21T00:49:40Z","title":"Toward Training Superintelligent Software Agents through Self-Play SWE-RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.18552","snapshot_observed_at":"2026-08-02T06:34:00.428030Z","title":"Toward training superintelligent software agents through self-play swe-rl.arXiv preprint arXiv:2512.18552, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.428030Z"},"links":{"cited_paper":"/paper/2512.18552","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:feff2765369db8b52bbdf059a9874a0cfd653b8fb8d67bfc58818c998cf7366c","observation_id":"8e62a4c9-eda0-425d-ab96-09f746c8242c","resolution":{"observed_at":"2026-08-02T06:34:00.428030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-02T06:34:00.515627Z","title":"Magicoder: Empow- ering code generation with oss-instruct.arXiv preprint arXiv:2312.02120, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.515627Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:f34adca0f6fe20464dd629e88925836176621a599dfff13e222b8797f2216dd9","observation_id":"6f644539-ff60-42de-9e55-47cedd739415","resolution":{"observed_at":"2026-08-02T06:34:00.515627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01489","snapshot_observed_at":"2026-08-02T06:34:00.586435Z","title":"Agentless: Demystifying llm-based software engineering agents.arXiv preprint arXiv:2407.01489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.586435Z"},"links":{"cited_paper":"/paper/2407.01489","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:920051962246a1db8ed81ad5ecc82dec8647c4b2f19301314fd6c4ffa9a5c968","observation_id":"0061e03d-d629-4a21-bc1a-2656e947a121","resolution":{"observed_at":"2026-08-02T06:34:00.586435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.643700Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.643700Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:ada099ba0e40ffd989f3540bf662444128dab50f974b245fd9c32919adc28772","observation_id":"9bc7f902-8ff3-4e19-8e35-15cf48e1004e","resolution":{"observed_at":"2026-08-02T06:34:00.643700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.703317Z","title":"SWE-agent: Agent–computer interfaces enable automated software engineering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.703317Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:66dd34c1fe906e7becd6b44af26a5faf12cafc0b9af621030cf8cc708532513b","observation_id":"4333be79-8e09-4fb9-86d6-941c508d14c7","resolution":{"observed_at":"2026-08-02T06:34:00.703317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.757353Z","title":"SWE-smith: Scaling data for software engineering agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.757353Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:78e07100b639732fa0c9b59c3ebb7db16f9c9a413ef847ca79da42120333bc64","observation_id":"ff29d423-88d0-48fb-a217-43024f250a2b","resolution":{"observed_at":"2026-08-02T06:34:00.757353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:34:00.844793Z","title":"τ-bench: A benchmark for tool-agent-user interaction in real-world domains, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.844793Z"},"links":{"citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:8dbba99a28b57adeff46ab508bd6282af834fab2191f3ae475aaa01f80cdbb9e","observation_id":"f81da73e-6daa-40b6-8646-c6bd7f54ac23","resolution":{"observed_at":"2026-08-02T06:34:00.844793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-07-30T07:56:48.878578Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-02T06:34:00.902864Z","title":"Multi-swe-bench: A multilingual benchmark for issue resolving.arXiv preprint arXiv:2504.02605, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.902864Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:1a2946f1d24a0e983548d416556da1db50cad602cd99acb81aae9dc209323224","observation_id":"544f1e8c-ec32-4e7f-a77f-0c4dd2190e59","resolution":{"observed_at":"2026-08-02T06:34:00.902864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19290","last_updated":"2025-06-24T03:53:36Z","snapshot_observed_at":"2026-08-09T09:22:49.068638Z","submitted_at":"2025-06-24T03:53:36Z","title":"Skywork-SWE: Unveiling Data Scaling Laws for Software Engineering in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19290","snapshot_observed_at":"2026-08-02T06:34:00.971942Z","title":"Other research-permissive licenses","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:00.971942Z"},"links":{"cited_paper":"/paper/2506.19290","citing_paper":"/paper/2607.12463"},"observation_digest":"sha256:49203fb5b16b0997a56e5d03b76c44bb6903f7cedd611ea792c6fb2c2919e3d9","observation_id":"438264f4-0278-4f16-ab3c-18c2fb495098","resolution":{"observed_at":"2026-08-02T06:34:00.971942Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.12463","last_updated":"2026-07-19T05:59:25Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T03:01:21.849941Z","submitted_at":"2026-07-14T07:44:26Z","title":"Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2607.12463."}