{"as_of":"2026-08-07T08:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:190ffab6d83ad80cf5e6b172ced45e65034c2bc3592e72bda32aa7a02cdba86f","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:28:40.551769Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05141/citation-record","integrity":"/paper/2608.05141/integrity","json":"/paper/2608.05141/citation-record.json","paper":"/paper/2608.05141"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.29489","last_updated":"2026-06-28T16:39:09Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T16:39:09Z","title":"Which Tokens Need Context? A Reference-Based Analysis of Translation Responsibility Using Fertility and Entropy","version":1},"cited_work":{"arxiv_id":"2606.29489","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.29489","snapshot_observed_at":"2026-08-06T04:28:42.404441Z","title":"Which Tokens Need Context? A Reference-Based Analysis of Translation Responsibility Using Fertility and Entropy","venue":"cs.CL","work_id":"d9e6c189-6951-470c-aa01-489f17986ad7","year":2026},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:37.526799Z"},"links":{"cited_paper":"/paper/2606.29489","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:c4068b3217a72e56a4f55ce919d33fa241a3eb030ecb40cd69eef5ab73f82d0b","observation_id":"bf64fde6-b374-48f9-b345-e90c3e44283b","resolution":{"observed_at":"2026-08-06T04:28:42.480531Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.03194","last_updated":"2026-05-26T12:00:46Z","snapshot_observed_at":"2026-08-03T23:49:54.364126Z","submitted_at":"2026-03-03T17:52:01Z","title":"BeyondSWE: Can Current Code Agent Survive Beyond Single-Repo Bug Fixing?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.03194","snapshot_observed_at":"2026-08-06T04:28:37.660245Z","title":"InThe Thirteenth International Conference on Learning Representations, ICLR 2025, Singapore, April 24-28, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:37.660245Z"},"links":{"cited_paper":"/paper/2603.03194","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:f6ba20e31fa798eee769fa3603e33f09a453cb18f9c28fcedad7988dd59584d1","observation_id":"ada90f15-b077-4626-a571-57182deda404","resolution":{"observed_at":"2026-08-06T04:28:37.660245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:43.091291Z","title":"Mariia Fedorova, Nikolay Arefyev, Maja Buljan, Jin- drich Helcl, Stephan Oepen, Egil Rønningstad, and Yves Scherrer","venue":null,"work_id":"c2675eee-62a1-430a-91eb-e5d66c2918d5","year":2026},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.080969Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:518d57979111a8f267bdeb4d5ba2f12780f9d8e5537019c7ab065c5bcfea9fa3","observation_id":"9b6d6858-06fe-4e85-9e2d-d515e5b35fa4","resolution":{"observed_at":"2026-08-06T04:28:43.146796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11005","last_updated":"2025-01-16T10:05:17Z","snapshot_observed_at":"2026-08-02T04:19:26.632510Z","submitted_at":"2024-06-25T20:23:15Z","title":"RAGBench: Explainable Benchmark for Retrieval-Augmented Generation Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11005","snapshot_observed_at":"2026-08-06T04:28:38.233730Z","title":"Yao Fu, Rameswar Panda, Xinyao Niu, Xiang Yue, HannanehHajishirzi,YoonKim,andHaoPeng.2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.233730Z"},"links":{"cited_paper":"/paper/2407.11005","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:3598d055fb844277236ceddda4543933e853c69ffedd8f6c08cf901b8ec1e0f1","observation_id":"1f87e031-5769-4dd8-9be9-7e9d1a9a9c64","resolution":{"observed_at":"2026-08-06T04:28:38.233730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04178","last_updated":"2025-06-05T02:21:52Z","snapshot_observed_at":"2026-08-03T02:41:13.331563Z","submitted_at":"2025-06-04T17:25:39Z","title":"OpenThoughts: Data Recipes for Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04178","snapshot_observed_at":"2026-08-06T04:28:38.557852Z","title":"Daya Guo, Qihao Zhu, Dejian Yang, Zhenda Xie, Kai Dong,WentaoZhang,GuantingChen,XiaoBi,Y.Wu, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.557852Z"},"links":{"cited_paper":"/paper/2506.04178","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:5c94d9f3f8b873b40e12aa98c1583681849110d530447e60e951aab4b2f91943","observation_id":"9165db7a-f39f-49f6-b5cb-c57c7e0bf12f","resolution":{"observed_at":"2026-08-06T04:28:38.557852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-06T04:28:38.663229Z","title":"In27th International Conference on En- gineering of Complex Computer Systems, ICECCS 2023, Toulouse, France, June 14-16, 2023, pages 116–125","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.663229Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:2a4ea1845986fa050657e74e43ce7148c5867a077c3bfa47cb5c15dbe280d136","observation_id":"699dbc31-f320-4042-9b9f-ae655d63c254","resolution":{"observed_at":"2026-08-06T04:28:38.663229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:38.763938Z","title":"Junlong Jia, Xing Wu, Chaochen Gao, Ziyang Chen, Zijia Lin, Zhongzhi Li, Weinong Wang, Haotian Xu, Donghui Jin, Debing Zhang, and Binghui Guo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.763938Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:cdc7fc8d2f3cceb251ec1b97bec9c3594336a4c1ae2553e9aecc37dccb6ffb0e","observation_id":"627f5221-b711-4375-9ab2-7b6f6007ffee","resolution":{"observed_at":"2026-08-06T04:28:38.763938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:42.972583Z","title":"In TheThirteenthInternationalConferenceonLearning Representations, ICLR 2025, Singapore, April 24-28,","venue":null,"work_id":"61153294-f1a4-473a-b2a8-1abf843beea6","year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.905309Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:88e715b6f9b4135d9146a8ea41d47e10c2f893eb590fb19ebaae4596a5bf8a34","observation_id":"39aa7ab4-fb50-45d3-9fc1-ebdc3a8f8d74","resolution":{"observed_at":"2026-08-06T04:28:43.028382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03294","last_updated":"2024-03-31T21:11:08Z","snapshot_observed_at":"2026-08-07T06:18:54.374420Z","submitted_at":"2023-10-05T03:47:57Z","title":"DISTFLASHATTN: Distributed Memory-efficient Attention for Long-context LLMs Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03294","snapshot_observed_at":"2026-08-06T04:28:38.983112Z","title":"Dacheng Li, Rulin Shao, Anze Xie, Eric P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.983112Z"},"links":{"cited_paper":"/paper/2310.03294","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:6595cca5fdd17e2d714f3d5dd0893c7041faac44c917dd3ef62ad015ee7b5354","observation_id":"1e3bcf58-dc7d-4859-8c7b-7455eef74c8a","resolution":{"observed_at":"2026-08-06T04:28:38.983112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-06T04:28:39.107321Z","title":"Yi Lu, Jing Nathan Yan, Songlin Yang, Justin T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:39.107321Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:9e0b0d31910d3233a6cc6e8c0d6edc00b59066ba72daa67b66e9542e47d393c3","observation_id":"323c302a-aa6c-42d0-bb73-49773a734b9c","resolution":{"observed_at":"2026-08-06T04:28:39.107321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:39.408845Z","title":"Maksim Sapronov and Evgeniy Glukhov","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:39.408845Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:80a57239675b1d3ee9580624d6c347971d8565c1b63cc4d4a6b313f284ec9a1e","observation_id":"eb13f4f9-51cc-459e-9031-07625c48d335","resolution":{"observed_at":"2026-08-06T04:28:39.408845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:39.525663Z","title":"CoRR, abs/2512.23675","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:39.525663Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:bd5a1e4e842ff55f5f4065bcafd435fe6fb1af17e4c28b39b0a8ad56f67d470f","observation_id":"8c41b31f-9596-439b-b4b9-4a829a07e3c6","resolution":{"observed_at":"2026-08-06T04:28:39.525663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11857","last_updated":"2024-08-15T20:17:33Z","snapshot_observed_at":"2026-07-06T19:04:13.760549Z","submitted_at":"2024-08-15T20:17:33Z","title":"Hermes 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11857","snapshot_observed_at":"2026-08-06T04:28:39.714015Z","title":"Runchu Tian, Yanghao Li, Yuepeng Fu, Siyang Deng, Qinyu Luo, Cheng Qian, Shuo Wang, Xin Cong, ZhongZhang,YesaiWu,YankaiLin,HuadongWang, and Xiaojiang Liu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:39.714015Z"},"links":{"cited_paper":"/paper/2408.11857","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:035d496e6ec742d88c8da7f3f32dbd1fbe8d9d327c6f79961ce17ae2f886ed12","observation_id":"b4cc29bb-f31f-4cf3-9e84-4ab223f291ad","resolution":{"observed_at":"2026-08-06T04:28:39.714015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:40.026344Z","title":"InFindingsofthe AssociationforComputationalLinguistics,ACL2026, San Diego, California, United States, July 2-7, 2026, pages 13122–13133","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:40.026344Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:499f84b87404cf6d5c379c2f1a30df645d15d61aa9d5de2348598ca251263428","observation_id":"a7f6aa54-16cc-4c57-ab37-6a8a38fe2ec9","resolution":{"observed_at":"2026-08-06T04:28:40.026344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:42.849412Z","title":null,"venue":null,"work_id":"43922a67-960f-4d43-b897-0f78c217992f","year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:40.250519Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:157604db7092819120dea7b918f0685affd3cdb3b843b18c6de28f6a25ed9deb","observation_id":"b42f80a7-fc6d-4b31-9a36-90fe91e62b9b","resolution":{"observed_at":"2026-08-06T04:28:42.906747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:42.722547Z","title":null,"venue":null,"work_id":"e81ccb6e-4e3f-43aa-ba80-ce429159eed6","year":null},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:40.366600Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:635caec485ae71455d87b102bbc03ae48fa35e5d66f3be5051917770ac5cb830","observation_id":"c6d66b5d-4d1d-4fb0-a286-28f20ad4b6c9","resolution":{"observed_at":"2026-08-06T04:28:42.784658Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:42.540816Z","title":null,"venue":null,"work_id":"8f054f33-31b7-4fb0-8bd3-86d1532ca88e","year":2011},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:40.443487Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:09b3c722c9930d691098ca5ec5c49fc0820e0b1450bab55116021f71aeb6aa27","observation_id":"7aef7b35-7c2d-4627-b151-207034e99bee","resolution":{"observed_at":"2026-08-06T04:28:42.617242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7317.9120","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:40.805029Z","title":null,"venue":null,"work_id":"1c5ea03d-9a07-4790-9702-48cea4aef697","year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:40.551769Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:51cb3cfed88d8c07c60ae6d44a3da0bd7d8d38f422ccaa2860b3f00f691238cc","observation_id":"83be0a09-4770-4702-8c50-2ba2a5a78bfb","resolution":{"observed_at":"2026-08-06T04:28:40.941130Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:39.301450Z","title":"InPro- ceedings of the 6th Workshop on Formal Integrated DevelopmentEnvironment,F-IDE@NFM2021,Held online, 24-25th May 2021, volume 338 ofEPTCS, pages 3–18","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:39.301450Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:df9a539e8c5dfaf264ac98f0c1c4b589e411f424244490084f78795b09c65c5a","observation_id":"8022aef4-dd48-498a-ab5c-d9ef0501ca3e","resolution":{"observed_at":"2026-08-06T04:28:39.301450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-06T04:28:40.172684Z","title":"InProceedings of the 60th Annual Meeting of the Association for Computational Lin- guistics(Volume1: LongPapers), ACL2022, Dublin, Ireland, May 22-27, 2022, pages 8003–8016","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:40.172684Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:2dfac03c60589470bad15a18156fbaa6491c7ef29d1a81089be33ecffcadce31","observation_id":"f7fa90b1-c77e-4233-a856-1633452e9182","resolution":{"observed_at":"2026-08-06T04:28:40.172684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:37.949178Z","title":"InProceed- ings of the 2023 Conference on Empirical Methods in Natural Language Processing, EMNLP 2023, Sin- gapore, December 6-10, 2023, pages 3029–3051","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:37.949178Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:6722f61e98042e9e714181da1e954b2cb1fbe5e7314522564d2042edff30c18e","observation_id":"b584ae19-ff4b-4c1e-9382-013afcb73ae4","resolution":{"observed_at":"2026-08-06T04:28:37.949178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.25804","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:42.096330Z","title":"InIEEE International Conference on Software Maintenance and Evolution, ICSME 2024, Flagstaff, AZ, USA, October 6-11, 2024, pages 888–892","venue":null,"work_id":"6d8ee138-33a3-4008-9247-4dfe09abea75","year":2024},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:37.791556Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:fcb228bf956c980d91f35470ceeb033112fd0239a3fbb2e93b40e1874f1437c9","observation_id":"d7c506e5-3951-4476-ac0c-5b53c5e3ed8b","resolution":{"observed_at":"2026-08-06T04:28:42.151842Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:43.234834Z","title":"InThe Thirteenth International ConferenceonLearningRepresentations,ICLR2025, Singapore, April 24-28, 2025","venue":null,"work_id":"7130af96-7326-47ad-8afd-363573d3317e","year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:37.430689Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:bd20dd3dab85770b39555a37810ef625aaf3d5df89207ccf2140d9d94918945d","observation_id":"841c93be-68a2-414a-9e5f-ded1101c3ace","resolution":{"observed_at":"2026-08-06T04:28:43.310784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07981","last_updated":"2026-04-09T08:51:47Z","snapshot_observed_at":"2026-08-05T18:06:44.297905Z","submitted_at":"2026-04-09T08:51:47Z","title":"A Decomposition Perspective to Long-context Reasoning for LLMs","version":1},"cited_work":{"arxiv_id":"2604.07981","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07981","snapshot_observed_at":"2026-08-06T04:28:41.157810Z","title":"A Decomposition Perspective to Long-context Reasoning for LLMs","venue":"cs.CL","work_id":"9820cc3a-78c5-4c45-a89a-e8eecf18063c","year":2026},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:39.832305Z"},"links":{"cited_paper":"/paper/2604.07981","citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:5c71cbc77b8736ebe9c89aa6fee5596e1a9c32f6423219f946dcdb0b29be1223","observation_id":"bee806b5-1d69-45ed-880d-b1d2e59ff175","resolution":{"observed_at":"2026-08-06T04:28:41.247538Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:28:38.373784Z","title":"Charles Goddard","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling","version":1},"reference_index":7399,"source":"pdf_text","source_observed_at":"2026-08-06T04:28:38.373784Z"},"links":{"citing_paper":"/paper/2608.05141"},"observation_digest":"sha256:1dfa8f8382a4e806bee307227fd783d9b693c0440e64cf48b9ec13539ed7b10d","observation_id":"8a2c8a47-3f94-4221-b2e7-a9bc8e3e8924","resolution":{"observed_at":"2026-08-06T04:28:38.373784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05141","last_updated":"2026-08-05T17:58:15Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T08:10:34.948187Z","submitted_at":"2026-08-05T17:58:15Z","title":"OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":4,"verified_fuzzy":3},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2608.05141."}