{"as_of":"2026-08-14T08:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:026dff4593ad9e06f7bb26cbdd05ac8fdbbd0de0a78f6385a74e0b1ca0b95e0c","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:03:57.214846Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.08291/citation-record","integrity":"/paper/2412.08291/integrity","json":"/paper/2412.08291/citation-record.json","paper":"/paper/2412.08291"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.683108Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.683108Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1bdb7e0df9ccfa79053d4958eaba3f5539b58ccd9bb5b8a74f602878edd3d65c","observation_id":"abd2dd17-3a3c-44a2-834d-076b13b611c9","resolution":{"observed_at":"2026-08-11T18:03:56.683108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.689148Z","title":"Codebert: A pre-trained model for programming and natural languages,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.689148Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:16824389833967bfc4cbf6250cb983383b26a37153324ae6e3c6ba1b29a7ca3e","observation_id":"236b3fad-8c3c-4726-8f78-3ea69b7772d2","resolution":{"observed_at":"2026-08-11T18:03:56.689148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.08366","last_updated":"2021-09-13T05:48:51Z","snapshot_observed_at":"2026-07-06T09:56:32.308108Z","submitted_at":"2020-09-17T15:25:56Z","title":"GraphCodeBERT: Pre-training Code Representations with Data Flow","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.08366","snapshot_observed_at":"2026-08-11T18:03:56.694496Z","title":"Graphcodebert: Pre-training code representations with data flow,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.694496Z"},"links":{"cited_paper":"/paper/2009.08366","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1176f58c49558cb8c7b1297758960f76c4274d61361406da28d39903ac07d23d","observation_id":"55e41221-62de-4f42-a652-82add5efe1b5","resolution":{"observed_at":"2026-08-11T18:03:56.694496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T18:03:56.699972Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.699972Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:985cbed56ff0eb46c2cc8cd24c0707d4ef43ba30ce758ecf364adb515a4755fd","observation_id":"31c95a64-e9bb-45bb-b041-d8271a4e3336","resolution":{"observed_at":"2026-08-11T18:03:56.699972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10555","last_updated":"2020-03-23T21:17:42Z","snapshot_observed_at":"2026-08-11T12:55:51.308870Z","submitted_at":"2020-03-23T21:17:42Z","title":"ELECTRA: Pre-training Text Encoders as Discriminators Rather Than Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10555","snapshot_observed_at":"2026-08-11T18:03:56.705240Z","title":"Electra: Pre- training text encoders as discriminators rather than generators,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.705240Z"},"links":{"cited_paper":"/paper/2003.10555","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:68c34e3e77ccaf8c20d1736ea1344d0caf99106455d08c5f751bcbac0e6a5eac","observation_id":"b1642bad-a742-401a-95c7-1419b326cb4b","resolution":{"observed_at":"2026-08-11T18:03:56.705240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.710608Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.710608Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:87827f66fa9cfdae6f65dd129c116d668c2e7b6076e53ddf4528b5b0c8ec73c7","observation_id":"9f8c1a53-513a-4aed-a438-b5403f94d81d","resolution":{"observed_at":"2026-08-11T18:03:56.710608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.716031Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.716031Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:d2bab4cd53b3fd352b82fdbc2bbb4fb60390fe9db0a38cf9513cafe2d1bdffe1","observation_id":"180b1aa5-5708-45f1-a1c5-c240ee25ec01","resolution":{"observed_at":"2026-08-11T18:03:56.716031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-11T18:03:56.720778Z","title":"The falcon series of open language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.720778Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:25bf0d50c3443a623d400bcf9064d48a3657dcccccb63fc8af04496b74e1f11f","observation_id":"ebf99b89-4cbd-40d9-8335-168f9fad7514","resolution":{"observed_at":"2026-08-11T18:03:56.720778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T18:03:56.726471Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.726471Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e69782216182be2de9c7d465cdb89667267020a2b6b7017a9940a8bdcca70778","observation_id":"be20e4d9-de5a-4003-aae8-28fbc2db70f5","resolution":{"observed_at":"2026-08-11T18:03:56.726471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.732254Z","title":"Roformer: Enhanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.732254Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:dc63e05fbbaa50685790825e33ac0e266554acdd3669e2aa22b9e89f6bea7648","observation_id":"733219b2-62ce-41bb-b62f-9e0fa116774e","resolution":{"observed_at":"2026-08-11T18:03:56.732254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.742420Z","title":"Claude technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.742420Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:5f1a5f4842fcec86285e8747c78a5109d612a49868acfcd87470822d3f3907ae","observation_id":"7a3e593b-e8d1-4487-9622-38f913927e00","resolution":{"observed_at":"2026-08-11T18:03:56.742420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.746670Z","title":"Wikipedia corpus,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.746670Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:d2008f06e476eab5bda513531a5ab0222c1a7d18ac8cfdfcab1fbc6a9829c466","observation_id":"78321dd6-bdb5-4ae1-9480-d04ada9e778d","resolution":{"observed_at":"2026-08-11T18:03:56.746670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.751271Z","title":"Common crawl corpus,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.751271Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:423e8af850acb9acc8d0f5cbfed3f17a3cb6c6c9c271a8c884becfd5114b6078","observation_id":"72b5c9a3-e0b9-4695-97e3-6b719c32e9c6","resolution":{"observed_at":"2026-08-11T18:03:56.751271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16349","last_updated":"2024-10-21T17:49:50Z","snapshot_observed_at":"2026-08-12T22:18:18.124749Z","submitted_at":"2024-10-21T17:49:50Z","title":"Large Language Models in Computer Science Education: A Systematic Literature Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16349","snapshot_observed_at":"2026-08-11T18:03:56.755726Z","title":"Large language models in computer science education: A systematic literature review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.755726Z"},"links":{"cited_paper":"/paper/2410.16349","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:68b69e5bcb2f326e00f7e448bf9241eb7bb77d5df476ec27d227113f27642938","observation_id":"15668a15-30fe-4119-a1b4-21a97004970e","resolution":{"observed_at":"2026-08-11T18:03:56.755726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.760055Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.760055Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:674c6ed22cff2d4d946e01f57465cc482878347f0039e7fbe6452850fba9c10c","observation_id":"f91ce128-a971-4ff4-9d35-190fb20eaf89","resolution":{"observed_at":"2026-08-11T18:03:56.760055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.764205Z","title":"On the use of automated text summarization techniques for summarizing source code,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.764205Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:232e92c4019ebe11e982a6db344a04e13c7f63ecc7f7278cf2dba617e2299f0a","observation_id":"892585d1-c75e-4dce-b7e4-d6d319218fdb","resolution":{"observed_at":"2026-08-11T18:03:56.764205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.768698Z","title":"Exemplar: A source code search engine for finding highly relevant applications,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.768698Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:21a215fa6a2584193b9aa33ca24d9c19e46fa0ca7b9ed4f8e5f4ef44e945f5be","observation_id":"38ba2901-0c4c-401c-88c2-6af3e035242b","resolution":{"observed_at":"2026-08-11T18:03:56.768698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.773104Z","title":"Using information retrieval based coupling measures for impact analysis,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.773104Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:a811032f53f3cccc244f51d794392091fdc2cd3101d3829abce7894fd1e507d1","observation_id":"2f26c602-ac8a-4651-afef-d786c40c434e","resolution":{"observed_at":"2026-08-11T18:03:56.773104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.777611Z","title":"Normalizing source code vocabulary,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.777611Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f7bd03c43ab9bdd2bdf868c0cb9397cd4daea061701348e30962823fee96392d","observation_id":"fbcc9d51-37a0-4ffe-8971-129ad8917c88","resolution":{"observed_at":"2026-08-11T18:03:56.777611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.782272Z","title":"Linsen: An efficient approach to split identifiers and expand abbreviations,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.782272Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:74d61afaeb1a9f35a59b3bdc0657987014897e575e47435c19596b7e7ce1fe8e","observation_id":"0f006b88-8633-4e67-b93c-e1689edb3cc2","resolution":{"observed_at":"2026-08-11T18:03:56.782272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.786930Z","title":"Expanding identifiers to normalize source code vocabulary,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.786930Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:b3e9bd16314f75382818f57c75742df1a5d90084165ad6e33d4aedef42727417","observation_id":"c8ce1bb1-18b1-4960-932a-076631902b17","resolution":{"observed_at":"2026-08-11T18:03:56.786930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.791555Z","title":"Fowler, Refactoring: Improving the Design of Existing Code","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.791555Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f5f0b2ea956a846b2097d461863115b13111fbe2a7a6fa3e1b0dd85c32718175","observation_id":"d3b1358c-e0fb-4840-9f05-43c23c4b1130","resolution":{"observed_at":"2026-08-11T18:03:56.791555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.796573Z","title":"Detection strategies: Metrics-based rules for detecting design flaws,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.796573Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ce1e0dbf77752299a5e8ecc52026506aad376e14fd03f9875764a7415131923c","observation_id":"4c1376d9-969b-4057-ab54-68c9d031b29a","resolution":{"observed_at":"2026-08-11T18:03:56.796573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T18:03:56.801563Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.801563Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:a3c263c9c309d271be519808804b9d83183bdb0189e9304f32fe9d18a59bbe1e","observation_id":"d3a1caa0-4def-415b-b080-9a9af6cd8e7c","resolution":{"observed_at":"2026-08-11T18:03:56.801563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.806764Z","title":"Codet5: Identifier-aware unified pre-trained encoder-decoder models for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.806764Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:8b471a55c93f6035393e88d30a170b952feaf70b74d248e803074f0a9895dbdb","observation_id":"b5745d55-b760-4d78-bd30-24a3b9074eb5","resolution":{"observed_at":"2026-08-11T18:03:56.806764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-13T04:25:38.282910Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-11T18:03:56.811365Z","title":"Code llama: Open foundation models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.811365Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:b09ce7f07a29e4132f277bcc5dd4a99df96dde73292f1f04d17b2887c5dba70b","observation_id":"573b037f-3d81-40c3-8b43-9b2b30340fab","resolution":{"observed_at":"2026-08-11T18:03:56.811365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.816453Z","title":"Ernie: Enhanced language representation with informative entities,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.816453Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:24630efd17d88cd52df1fec5a33f4eb561d0008236b2693977609d61832f046a","observation_id":"00a131a9-1ef9-4dd3-8b5d-ce4654c58dd4","resolution":{"observed_at":"2026-08-11T18:03:56.816453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.821080Z","title":"A robustly optimized bert pre- training approach with post-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.821080Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:549ba3e138fbd16f9c62e3f92d2e3176217e9fd2af65e533bfce335981f43d0f","observation_id":"81000103-f4e5-40e4-bfc0-46a6b593b423","resolution":{"observed_at":"2026-08-11T18:03:56.821080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.826353Z","title":"Learning and evaluating contextual embedding of source code,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.826353Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ac67fc9c42db47b0cb098fb32d4a5d57c0416956e9a5e6cd6e6c1814c5f181fa","observation_id":"208ef898-01c8-4cc0-a3b3-a60778c52da3","resolution":{"observed_at":"2026-08-11T18:03:56.826353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.831247Z","title":"Treebert: A tree- based pre-trained model for programming language,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.831247Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:bb0fcf76499ea50dd056a3c6fd42394fe9af075b3f593a9c4db824c2e247d3ce","observation_id":"d929acfa-6034-4647-b81b-09dda948f2e1","resolution":{"observed_at":"2026-08-11T18:03:56.831247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.04556","last_updated":"2021-09-09T12:45:58Z","snapshot_observed_at":"2026-08-13T18:30:48.914826Z","submitted_at":"2021-08-10T10:08:21Z","title":"SynCoBERT: Syntax-Guided Multi-Modal Contrastive Pre-Training for Code Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.04556","snapshot_observed_at":"2026-08-11T18:03:56.836040Z","title":"Syncobert: Syntax-guided multi-modal contrastive pre-training for code representation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.836040Z"},"links":{"cited_paper":"/paper/2108.04556","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ae9c760143e1cae33f73e76caaeb0df422e3db00242740eb6b47e7b21058b3d4","observation_id":"9276f60b-be00-4d3e-af8c-f19267ca5768","resolution":{"observed_at":"2026-08-11T18:03:56.836040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.840952Z","title":"Code-mvp: Learning to represent source code from multiple views with contrastive pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.840952Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:9e2f75890a72342bcdf74af6dfe4ad0a76e546f0cd7d403eb235275cd935ffb4","observation_id":"f3763f8d-76ba-4c25-be82-9fd7cea42d94","resolution":{"observed_at":"2026-08-11T18:03:56.840952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09436","last_updated":"2020-06-08T09:09:28Z","snapshot_observed_at":"2026-08-06T10:54:14.530969Z","submitted_at":"2019-09-20T11:52:45Z","title":"CodeSearchNet Challenge: Evaluating the State of Semantic Code Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09436","snapshot_observed_at":"2026-08-11T18:03:56.846027Z","title":"Codesearchnet challenge: Evaluating the state of semantic code search,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.846027Z"},"links":{"cited_paper":"/paper/1909.09436","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:89d3754c0be230793b2f630b42dd91041678350bcf6fcd38759406018a49da04","observation_id":"d855c302-64d9-4ef9-9edf-846367d2dbfe","resolution":{"observed_at":"2026-08-11T18:03:56.846027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:56.852420Z","title":"Summarizing source code using a neural attention model,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.852420Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:04e5660c25bb3cac9eda1e693ccd6f52669105050da02b361bacda8eb29c2aef","observation_id":"c1583c10-5bb1-414d-84e1-15f001ebd0fd","resolution":{"observed_at":"2026-08-11T18:03:56.852420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.600313Z","title":"Python 150k: A large-scale dataset for python programs,","venue":null,"work_id":"7ad7e40e-6566-48a8-aa2e-de4629aa303f","year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.857380Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:9778dbeb49fb0dc3ce812b0a8af510e74fae9f7cf8672617792fb05f37fb8331","observation_id":"e1ee0684-0d06-41a4-919c-b0aef632a8e1","resolution":{"observed_at":"2026-08-11T18:03:58.604929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.584887Z","title":"Cosqa: 20,000+ web queries for code search and question answering,","venue":null,"work_id":"60a47c36-1dd7-48e3-8a10-3ed2a925d6a4","year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.862161Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:7baf729caa52a80fa3527ab9445376b439bff95bebb1200ef3703e64eb87e0e5","observation_id":"3fc72a6a-8648-4ea1-9498-f55047f19f9e","resolution":{"observed_at":"2026-08-11T18:03:58.589710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.569398Z","title":"Towards a big data curated benchmark of inter-project code clones,","venue":null,"work_id":"245e4102-90a2-461c-a470-16f0e5b935b4","year":2014},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.866985Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:583ff6bcae6e0a56e871bdc4964eb8c26ca437b4ead530847809472877bd309a","observation_id":"5ec78d01-2a37-4a0f-b21c-9625c825fb4b","resolution":{"observed_at":"2026-08-11T18:03:58.574479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.552456Z","title":"Global relational models of source code,","venue":null,"work_id":"6b2d8f9f-7dec-4f05-af78-4356e0aed912","year":2019},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.871729Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e477f473ec1c5f5cbf4fd1ab74dc63b98b477762691b3bec74523b120b62ef2f","observation_id":"ab3442c4-0372-46e8-b6bc-6296df2dc28b","resolution":{"observed_at":"2026-08-11T18:03:58.558269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.11840","last_updated":"2022-02-24T00:27:56Z","snapshot_observed_at":"2026-08-13T16:35:04.714005Z","submitted_at":"2022-02-24T00:27:56Z","title":"Scalpel: The Python Static Analysis Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.11840","snapshot_observed_at":"2026-08-11T18:03:56.876808Z","title":"Scalpel: The python static analysis framework,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.876808Z"},"links":{"cited_paper":"/paper/2202.11840","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:992461b24ec4aa21c5709a5254d95822f9b45bbc2a06a725d12c9914a55e2a63","observation_id":"855c1e2a-5802-46ef-9189-f7f6e40459ec","resolution":{"observed_at":"2026-08-11T18:03:56.876808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.537080Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":"10e20f04-7bfe-4f36-8659-6ed7f9758879","year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.882488Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ca245a2e4252fc88b41413b65fa72733b2d5f39e28d7281eafed149a2551cc5e","observation_id":"c519f7e4-f404-4ace-aba4-c2dcb89bf484","resolution":{"observed_at":"2026-08-11T18:03:58.542108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.520788Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and compre- hension,","venue":null,"work_id":"a817c106-1d43-4cd0-ab47-73913b2bb723","year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.887715Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:8f31c8db30ee6c0203cdcd98a23fd4c3f7775a7f299630b8bcaf93e3d211a650","observation_id":"654a2a50-4d13-4c97-8e1d-829f77db09b0","resolution":{"observed_at":"2026-08-11T18:03:58.526407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.504291Z","title":"Pymt5: multi-mode translation of natural language and python code with transformers,","venue":null,"work_id":"19099506-1084-4667-bdff-dcb3e9b4b8c3","year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.893139Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:0ff80a53573586d55e44e8f0646cc3299afdda7f88cd8073bb3d4509c8cee2ef","observation_id":"584e8861-905c-4c32-8806-1fab4905b884","resolution":{"observed_at":"2026-08-11T18:03:58.509510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07922","last_updated":"2023-05-20T07:27:15Z","snapshot_observed_at":"2026-08-08T01:28:05.271964Z","submitted_at":"2023-05-13T14:23:07Z","title":"CodeT5+: Open Code Large Language Models for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07922","snapshot_observed_at":"2026-08-11T18:03:56.897883Z","title":"Codet5+: Open code large language models for code understanding and generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.897883Z"},"links":{"cited_paper":"/paper/2305.07922","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:368dab18f459a29b602fd4992c8cab80314e8c1b0b6a2c631e83d92db931d358","observation_id":"cbd2066a-2bd5-4bc8-a574-9b7b148c05d9","resolution":{"observed_at":"2026-08-11T18:03:56.897883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.489096Z","title":"Spt-code: Sequence- to-sequence pre-training for learning source code representations,","venue":null,"work_id":"6594fdef-ecd8-4af9-923c-9f1ee11893da","year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.903563Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:c83cb0899309e225c2717c91a6bc4310f3cc0c31b56c70a7c7f90bd8b4882ba5","observation_id":"73b7a8fd-2381-4e0b-b258-54142492e23a","resolution":{"observed_at":"2026-08-11T18:03:58.493953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.473922Z","title":"Competition-level code generation with alphacode,","venue":null,"work_id":"8a3d7249-bc7b-4df2-aba3-fb8788194be4","year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.908716Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1bfe80ae09c29676434d65ef3e242248575298ae21aff0eb96a3864f296e8d7b","observation_id":"3b1f24c7-b439-445b-bc95-3c2961d54e78","resolution":{"observed_at":"2026-08-11T18:03:58.478987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.458559Z","title":"Unified pre- training for program understanding and generation,","venue":null,"work_id":"2c216fdf-a57f-42c0-accf-78ec8cfebe8f","year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.914047Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:48633adc9b385bbf727a8156dd1e976319a9f500d01f540e25aaa386ef726ea6","observation_id":"096220dd-bab3-44f6-8a58-daa61941c243","resolution":{"observed_at":"2026-08-11T18:03:58.463505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.442201Z","title":"Gpt-neox-20b: An open- source autoregressive language model,","venue":null,"work_id":"10dc0d4d-0f56-4b37-af14-45aed1f0b023","year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.919028Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e8e9e7b077ecf1884424c97e8201c257517c50893de3d6fdd6489aef8c5ee0aa","observation_id":"20dff08e-ae29-40c3-b62e-3a34453c1a4c","resolution":{"observed_at":"2026-08-11T18:03:58.446699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07636","last_updated":"2023-03-14T05:39:08Z","snapshot_observed_at":"2026-08-13T12:25:11.854660Z","submitted_at":"2023-03-14T05:39:08Z","title":"Existence of spiky stationary solutions to a mass-conserved reaction-diffusion model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07636","snapshot_observed_at":"2026-08-11T18:03:56.923788Z","title":"Your language model is secretly a multilingual programmer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.923788Z"},"links":{"cited_paper":"/paper/2303.07636","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f1c7dbb91771b0bb77c566fbc35c90950bb0e0f75f3403899cb626d5ecaa4aa1","observation_id":"5d6fe403-f0fb-4aad-9b48-8086c7dc4fbf","resolution":{"observed_at":"2026-08-11T18:03:56.923788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-11T18:03:56.929650Z","title":"Program synthesis with large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.929650Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:61e47531e1bcaf8146b7837dbd59fa8577f44a1c24db210300c3c35dca31afed","observation_id":"d099a78b-31ee-4089-b413-7f1d68df74b8","resolution":{"observed_at":"2026-08-11T18:03:56.929650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.426589Z","title":"Introducing the next generation of Claude,","venue":null,"work_id":"76303c9b-3d87-40d1-b4f3-0c31db10a9a1","year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.934997Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:0241cf8aec08525e3b38ee4a509c2f39d3168aef1d580ee2edddfcfa38b94269","observation_id":"e4c095fd-22a9-439b-a019-e3b30291bcab","resolution":{"observed_at":"2026-08-11T18:03:58.432190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01234","last_updated":"2024-08-02T12:48:40Z","snapshot_observed_at":"2026-08-12T23:09:37.558828Z","submitted_at":"2024-08-02T12:48:40Z","title":"Entanglement Routing in Quantum Networks: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01234","snapshot_observed_at":"2026-08-11T18:03:56.940865Z","title":"Gpt-4 omni: A comprehensive multimodal model for language, vision, and beyond,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.940865Z"},"links":{"cited_paper":"/paper/2408.01234","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:420a12f7b1a3868663f72f8ac739899bc1b52f3905e5b7ab945f87ca4f02f0f0","observation_id":"014e4190-9e96-4c0c-9f8d-5d275d88be09","resolution":{"observed_at":"2026-08-11T18:03:56.940865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T18:03:56.956555Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.956555Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:26caa722d74774f376849a52e82cba2ebe7b366639bc7b79aa4909f6f3828470","observation_id":"670229e0-b88b-46e2-896b-cb3b3282a8eb","resolution":{"observed_at":"2026-08-11T18:03:56.956555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08568","last_updated":"2025-05-27T07:40:36Z","snapshot_observed_at":"2026-08-13T11:17:21.801042Z","submitted_at":"2023-06-14T15:18:48Z","title":"WizardCoder: Empowering Code Large Language Models with Evol-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08568","snapshot_observed_at":"2026-08-11T18:03:56.961893Z","title":"Wizardcoder: Empowering code large language models with evol-instruct,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.961893Z"},"links":{"cited_paper":"/paper/2306.08568","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:44a55055294600cbb756fdd27bac0d52bbf3913df91ccb3a76ff3ff747b3c80a","observation_id":"d2c382f9-4d0d-497d-b381-27f58ba0b9cf","resolution":{"observed_at":"2026-08-11T18:03:56.961893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11704","last_updated":"2024-08-06T22:37:06Z","snapshot_observed_at":"2026-08-12T23:40:54.718397Z","submitted_at":"2024-06-17T16:25:04Z","title":"Nemotron-4 340B Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11704","snapshot_observed_at":"2026-08-11T18:03:56.967539Z","title":"Nemotron-4 340b: Technical report on large-scale code models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.967539Z"},"links":{"cited_paper":"/paper/2406.11704","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:c284e99bcf0ac1bc4a518dc9cc4165c9611c6b44b61b119747f2016fa30f1693","observation_id":"da80e8cf-d6a2-4492-a62e-2bade36cdc46","resolution":{"observed_at":"2026-08-11T18:03:56.967539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04324","last_updated":"2024-05-07T13:50:40Z","snapshot_observed_at":"2026-08-13T00:13:05.937137Z","submitted_at":"2024-05-07T13:50:40Z","title":"Granite Code Models: A Family of Open Foundation Models for Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04324","snapshot_observed_at":"2026-08-11T18:03:56.972620Z","title":"Granite code models: A family of open foundation models for code intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.972620Z"},"links":{"cited_paper":"/paper/2405.04324","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:4d07e5e4519f312ba09d0f7a9074e65b28a9901b38906dfef49ecfdebd9d296a","observation_id":"2e4280dd-a8ee-49e5-b6ea-3b83d14701f7","resolution":{"observed_at":"2026-08-11T18:03:56.972620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-08-13T05:10:10.136134Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-11T18:03:56.978971Z","title":"Magicoder: Source code is all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.978971Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f2d9c8b232bae776ef60854c854b40fe31b61a495a2db69d9ca3c535f1560aed","observation_id":"ed21f96e-9870-4965-8331-73e5f0157a4c","resolution":{"observed_at":"2026-08-11T18:03:56.978971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.411289Z","title":"phind-codellama,","venue":null,"work_id":"44dee674-c4c9-4e68-988e-759bd8b61e6b","year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.983599Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f3a72a8d03347a5e6456a2b07cdb996eea121fbe9ff810a6fe543e096d8fb47b","observation_id":"c32c3e43-555f-499c-8884-c53a4f8a9ac2","resolution":{"observed_at":"2026-08-11T18:03:58.416276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-11T18:03:56.987869Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.987869Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:4c533a9686e744e8279a679396c2307fb7f6aef3949a23b2e7b9294fac496179","observation_id":"4af053ca-1820-4b54-befb-1bf32072ad30","resolution":{"observed_at":"2026-08-11T18:03:56.987869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-13T11:19:55.436754Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-11T18:03:56.992749Z","title":"Textbooks are all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.992749Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:324ca6c0351c10b8748bc4c2475f32094dc649c5d7fdd6a628f673a2bf68c543","observation_id":"5be131c0-85dd-4b25-a5c7-11f10560bab5","resolution":{"observed_at":"2026-08-11T18:03:56.992749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-11T18:03:56.997594Z","title":"Textbooks are all you need ii: phi-1.5 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:56.997594Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e5bb7afe72931db21e87e42551154b52cd47046bab4eb2deea4e9e236dba31de","observation_id":"3990a5a1-cccc-47ed-98d9-c325f179c70b","resolution":{"observed_at":"2026-08-11T18:03:56.997594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-11T18:03:57.008458Z","title":"Starcoder 2 and the stack v2: The next generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.008458Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:3daf80b8d04ee7e3b5f25ff695701070c920f89dbba616a615a490d3619f185f","observation_id":"5504d4b5-acb1-40fb-bfb6-050060d32e52","resolution":{"observed_at":"2026-08-11T18:03:57.008458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-11T18:03:57.013607Z","title":"Palm 2 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.013607Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:8ef682cd44cf3b5d9837ef931ed7381ab5f00d6e1b6bc05fb2cf7313f852b088","observation_id":"9e7cb977-e4a5-44cd-a03c-a4781260c23c","resolution":{"observed_at":"2026-08-11T18:03:57.013607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-11T18:03:57.019337Z","title":"Starcoder: may the source be with you!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.019337Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e7e0309de465edb8c8df8e63aca5e05824526051639e9c40c760cfa24e0f246b","observation_id":"8ed03555-15a2-4305-a205-d863cc5dfd4f","resolution":{"observed_at":"2026-08-11T18:03:57.019337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-11T18:03:57.025185Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.025185Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:092098fc09df9af3229381f1c2876089f18ddfec2050dede5a38607d0e29509a","observation_id":"7ea35fc9-6202-46c8-a1f4-0c18ef62edb6","resolution":{"observed_at":"2026-08-11T18:03:57.025185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03988","last_updated":"2023-02-24T09:53:40Z","snapshot_observed_at":"2026-08-13T13:07:56.285029Z","submitted_at":"2023-01-09T10:52:35Z","title":"SantaCoder: don't reach for the stars!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03988","snapshot_observed_at":"2026-08-11T18:03:57.030230Z","title":"Santacoder: don’t reach for the stars!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.030230Z"},"links":{"cited_paper":"/paper/2301.03988","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:b20d8bfad29c637e0fcf62befc328e2192682bb651c41ed3be5b3cb70cc813f7","observation_id":"75a1c0da-66a2-42cd-8503-ba7f7a25b365","resolution":{"observed_at":"2026-08-11T18:03:57.030230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T18:03:57.036079Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.036079Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ec8f0eaea305e8e922019c11d208ade288540bddf8386e1cae6511c8db1d11eb","observation_id":"fda6f2a9-9dac-47cd-a27a-c9c3b10c2138","resolution":{"observed_at":"2026-08-11T18:03:57.036079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T18:03:57.041467Z","title":"Training compute-optimal large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.041467Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:7081ee48755346316c09ac73e0c882a91b6d0b2711c6e374fb08bd126740b693","observation_id":"a002d4b4-e3e2-42fa-9f44-4b43efea057d","resolution":{"observed_at":"2026-08-11T18:03:57.041467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-14T03:33:46.294739Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-11T18:03:57.046753Z","title":"Roformer: En- hanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.046753Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:00ed6963a2c65e8ea5bdec025e8b203efb5a93d4b778724b419d5b2d095fd956","observation_id":"3c772ee3-daa5-4d41-b050-962ab4c3a579","resolution":{"observed_at":"2026-08-11T18:03:57.046753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02155","last_updated":"2018-04-12T18:51:33Z","snapshot_observed_at":"2026-08-13T22:40:49.725132Z","submitted_at":"2018-03-06T13:13:11Z","title":"Self-Attention with Relative Position Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02155","snapshot_observed_at":"2026-08-11T18:03:57.052101Z","title":"Self-attention with relative position representations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.052101Z"},"links":{"cited_paper":"/paper/1803.02155","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:c01c30c24ccade444410d0d9825674bf00eb8a3ab935e256f269896115a94dc4","observation_id":"590982fb-eb64-4900-9b0d-561159283783","resolution":{"observed_at":"2026-08-11T18:03:57.052101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T18:03:57.058204Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.058204Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:8353733c43fabcb51d893da9052320769c115d67d6c3b49f6baacba8887c2408","observation_id":"5b688769-cc4a-47de-a5dc-418b9f6270d4","resolution":{"observed_at":"2026-08-11T18:03:57.058204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02061","last_updated":"2025-03-05T01:58:08Z","snapshot_observed_at":"2026-08-13T23:05:20.614745Z","submitted_at":"2024-06-04T07:43:33Z","title":"Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02061","snapshot_observed_at":"2026-08-11T18:03:57.063782Z","title":"Alice in wonderland: Simple tasks showing complete reasoning breakdown in state-of-the-art large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.063782Z"},"links":{"cited_paper":"/paper/2406.02061","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:5e0be2d89e90be6eb47dee132d96c672592107d73e9d8b97b815fe482f95b7f6","observation_id":"2b106ca9-166c-4b7c-a306-3f03d989ac17","resolution":{"observed_at":"2026-08-11T18:03:57.063782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.396036Z","title":"O’Reilly Media, Inc","venue":null,"work_id":"b6e834c8-acfb-4d79-8c95-c03d368dafba","year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.070136Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e502840e4ea26cc1d9212a5e08377b05e76dfb5815aefa52832c080d51be9477","observation_id":"d0710b0d-b43b-46d4-b884-20da87046b5e","resolution":{"observed_at":"2026-08-11T18:03:58.400971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-11T18:03:57.075052Z","title":"Glu variants improve transformer,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.075052Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:fc9b13ac945624e3ac54e968ddf53aade6f763d1f6e7ea2d455fbcfbb9156122","observation_id":"a6d6c352-021a-4047-91c6-61330c149223","resolution":{"observed_at":"2026-08-11T18:03:57.075052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.05941","last_updated":"2017-10-27T17:45:21Z","snapshot_observed_at":"2026-08-08T18:23:31.977872Z","submitted_at":"2017-10-16T18:05:45Z","title":"Searching for Activation Functions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.05941","snapshot_observed_at":"2026-08-11T18:03:57.079664Z","title":"Searching for activation functions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.079664Z"},"links":{"cited_paper":"/paper/1710.05941","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1e7bc261f62c3e81d9d499e921a0dd8f78130795e23b2dc8f2cf2e41c54b1947","observation_id":"adf48453-d4ab-4c86-9ef5-42d347cf45bc","resolution":{"observed_at":"2026-08-11T18:03:57.079664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.380104Z","title":"Language modeling with gated convolutional networks,","venue":null,"work_id":"5f05fa3f-6c3a-4632-8414-802b8ff97bb2","year":2017},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.084949Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:69cc4bb5e803543a23743fd8175cc3bfeb6663acfde43313499a7fb94df62dee","observation_id":"59390f26-f634-401a-b381-4bbfd71aa22a","resolution":{"observed_at":"2026-08-11T18:03:58.385433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.363032Z","title":"Rectified linear units improve restricted boltzmann machines,","venue":null,"work_id":"3df12925-37e1-4f6e-a7fb-8163c523393d","year":2010},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.089581Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ee6e511bea765a1d152d355d2be4e020e5c8d8e9ba4a5bac2de126d2c531103c","observation_id":"4c4dda27-6767-4592-b65a-fe822de6ddb6","resolution":{"observed_at":"2026-08-11T18:03:58.368693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T18:03:57.094992Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.094992Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1719f5aeeaa1a6ededeaf4ac094de99fb233c6828558c4c01cb81daf5fb86628","observation_id":"afbf8f92-efb5-4b46-8235-b7a25123c5bb","resolution":{"observed_at":"2026-08-11T18:03:57.094992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-11T18:03:57.099779Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.099779Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:e25e7f0085e5d92d9d88bcd2ad9fa6c0830734f36db22a9f8bc70d1e56a1454c","observation_id":"0b2e66a1-0d64-485a-a96c-e7cd693fbfca","resolution":{"observed_at":"2026-08-11T18:03:57.099779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-11T18:03:57.105396Z","title":"Wizardlm: Empowering large language models to follow complex instructions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.105396Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:da40ef9e11b88441b2c3f1f742cc09452a584af0554ec77c32185dc7911e25cf","observation_id":"8279f2b7-ce56-40fe-88fe-c5f64621ef15","resolution":{"observed_at":"2026-08-11T18:03:57.105396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07124","last_updated":"2024-02-18T09:46:06Z","snapshot_observed_at":"2026-08-13T10:34:55.330090Z","submitted_at":"2023-08-14T13:53:54Z","title":"OctoPack: Instruction Tuning Code Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07124","snapshot_observed_at":"2026-08-11T18:03:57.110310Z","title":"Octopack: Instruction tuning code large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.110310Z"},"links":{"cited_paper":"/paper/2308.07124","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:b8fe3d01920656080cdc8909acbc2eecbfd2cd9c10abedbb5cb9e1014d676ba9","observation_id":"6486f7e6-033e-4586-a03b-e856a60f0725","resolution":{"observed_at":"2026-08-11T18:03:57.110310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05523","last_updated":"2024-03-11T04:58:52Z","snapshot_observed_at":"2026-08-14T08:39:08.610911Z","submitted_at":"2024-03-08T18:44:23Z","title":"Beyond Finite Data: Towards Data-free Out-of-distribution Generalization via Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05523","snapshot_observed_at":"2026-08-11T18:03:57.115098Z","title":"Codegemma: Open code language models for code generation and analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.115098Z"},"links":{"cited_paper":"/paper/2403.05523","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:c82b1ec89d5895f0165a9ab44038f3566c9fc1a67410ada878524c1ddb3ed308","observation_id":"89873307-f394-406d-aece-51c564ae9f26","resolution":{"observed_at":"2026-08-11T18:03:57.115098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.345998Z","title":"Gemma: Open models based on gemini research and technol- ogy,","venue":null,"work_id":"a70050fb-4ecf-4d88-97bc-e41ea7a0e926","year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.119857Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:b2843acf349841c784bd81b8fbe359c000fb7a4be9d38e6a6faf57d7c513b5cc","observation_id":"4d7af0a0-0e48-4e83-bb3e-c90b78cc0db7","resolution":{"observed_at":"2026-08-11T18:03:58.351073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17736","last_updated":"2024-10-23T10:11:40Z","snapshot_observed_at":"2026-08-12T22:16:51.646663Z","submitted_at":"2024-10-23T10:11:40Z","title":"MojoBench: Language Modeling and Benchmarks for Mojo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17736","snapshot_observed_at":"2026-08-11T18:03:57.124185Z","title":"Mojobench: Language modeling and benchmarks for mojo,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.124185Z"},"links":{"cited_paper":"/paper/2410.17736","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:18b90f45a5fcb705d629353130bc8d0a0f0cc681f18a81e32bced4da21a7d687","observation_id":"64b03f76-ff7d-4389-b747-a2eed74b1546","resolution":{"observed_at":"2026-08-11T18:03:57.124185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T18:03:57.129123Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.129123Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:2aaab73965683e2bfafa7252696504b19bc2170c47b9e772232f33ca232f7f61","observation_id":"470b9f8e-c59d-43e1-97c2-b8e059f7e0b5","resolution":{"observed_at":"2026-08-11T18:03:57.129123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16694","last_updated":"2024-03-24T15:41:21Z","snapshot_observed_at":"2026-08-13T22:46:34.001827Z","submitted_at":"2024-02-26T16:09:00Z","title":"HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16694","snapshot_observed_at":"2026-08-11T18:03:57.135276Z","title":"Humaneval-xl: A multilingual code generation benchmark for cross-lingual natural language generalization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.135276Z"},"links":{"cited_paper":"/paper/2402.16694","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f9f5bf56feb5eca96ee428dbca2463bb0b41fc71385222b4a2fde2729e81c404","observation_id":"9540c42d-030f-4e93-8b35-6ea0e8777553","resolution":{"observed_at":"2026-08-11T18:03:57.135276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15037","last_updated":"2025-01-26T00:56:43Z","snapshot_observed_at":"2026-08-13T17:56:31.838930Z","submitted_at":"2024-10-19T08:44:26Z","title":"mHumanEval -- A Multilingual Benchmark to Evaluate Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15037","snapshot_observed_at":"2026-08-11T18:03:57.140567Z","title":"mhumaneval–a multilingual benchmark to evaluate large language models for code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.140567Z"},"links":{"cited_paper":"/paper/2410.15037","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:68b9e9f9c3f3a1e6c7fd9cf3be951b8ebf32065f6f883878e1c4ff7e453a01aa","observation_id":"490b0b5f-ac71-49bf-9f23-c1957230a739","resolution":{"observed_at":"2026-08-11T18:03:57.140567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.08227","last_updated":"2022-12-19T10:30:12Z","snapshot_observed_at":"2026-08-13T14:43:58.557701Z","submitted_at":"2022-08-17T11:16:52Z","title":"MultiPL-E: A Scalable and Extensible Approach to Benchmarking Neural Code Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.08227","snapshot_observed_at":"2026-08-11T18:03:57.147196Z","title":"Multipl-e: A scalable and extensible approach to benchmarking neural code generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.147196Z"},"links":{"cited_paper":"/paper/2208.08227","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:f9d1fbcd0a11cc53ed172e74da98d511a06b1362793bf37e86bab7eaccfc6437","observation_id":"63495120-6e32-4cfd-a125-a2cedc611067","resolution":{"observed_at":"2026-08-11T18:03:57.147196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.329948Z","title":"Ds-1000: A natural and reliable benchmark for data science code generation,","venue":null,"work_id":"9354fa07-cb49-4d40-b436-5143d095518b","year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.152714Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:5d4a0dc87495ba9dc48ef344b9d448da7e44698154de8762234eb7c210480601","observation_id":"bd79d8be-57f3-4c91-b2bc-3e0d2a843503","resolution":{"observed_at":"2026-08-11T18:03:58.334823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.313677Z","title":"Cseprompts: A benchmark of introductory computer science prompts,","venue":null,"work_id":"b322f9b4-d0f6-4bca-93ed-35e42f7ed986","year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.157716Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1713499ee78f303399f8c2e1b3251bb758a8f5e459ab496a4585e0baf9e0e1ae","observation_id":"482b05a9-1c3c-42ea-9c9f-0bf1f4d407d6","resolution":{"observed_at":"2026-08-11T18:03:58.318439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:03:58.297729Z","title":"On the performance of large language models on introductory programming assignments,","venue":null,"work_id":"93c3ee8c-5000-411e-bd91-1a7ec36a638f","year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.162771Z"},"links":{"citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:ef1d538f8663a474a436dbda89f2595b4c573509fdd6dbf326ff2b79bad550e5","observation_id":"e399c2e5-9a49-4014-bfd1-b33f200e8b28","resolution":{"observed_at":"2026-08-11T18:03:58.302730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17903","last_updated":"2023-10-27T05:32:57Z","snapshot_observed_at":"2026-08-13T19:54:16.849965Z","submitted_at":"2023-10-27T05:32:57Z","title":"Pitfalls in Language Models for Code Intelligence: A Taxonomy and Survey","version":1},"cited_work":{"arxiv_id":"2310.17903","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.17903","snapshot_observed_at":"2026-08-11T18:03:57.479407Z","title":"Pitfalls in Language Models for Code Intelligence: A Taxonomy and Survey","venue":"cs.SE","work_id":"65fae8b5-2ef9-47b2-8977-1a56333ebd04","year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.168280Z"},"links":{"cited_paper":"/paper/2310.17903","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:8e21a4686d06a00dbeeaf75e588f877c1afd2ea55627f57fe43eeda6f4d0e819","observation_id":"6966666a-3bf1-44fb-834d-6d06a7829fdf","resolution":{"observed_at":"2026-08-11T18:03:57.485035Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-11T18:03:57.173433Z","title":"Holistic evaluation of language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.173433Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:463ead4fca2682afdadb1e3d5a9225d1c9f6df2567fd2ec3785d550cfe3ed97a","observation_id":"c29116bd-d715-461e-bc48-61ca2bbfff9a","resolution":{"observed_at":"2026-08-11T18:03:57.173433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-07-06T10:39:42.676631Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-11T18:03:57.178464Z","title":"Codexglue: A machine learning benchmark dataset for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.178464Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:a67996d3fa5abb17dc6c86a94ca8ee159b9dd7c069f17ce4f0e003bb6f2c020f","observation_id":"ddea4f29-51ee-43bf-b3ac-54b621e21989","resolution":{"observed_at":"2026-08-11T18:03:57.178464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10226","last_updated":"2024-05-01T22:04:31Z","snapshot_observed_at":"2026-08-13T12:58:48.955586Z","submitted_at":"2023-01-24T18:52:59Z","title":"A Watermark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10226","snapshot_observed_at":"2026-08-11T18:03:57.183563Z","title":"An impact study of code quality and quantity on ai code generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.183563Z"},"links":{"cited_paper":"/paper/2301.10226","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1dfdfce353ca39d4c9f5d516b2e3df92cdc6621677455b6ef88afe7144d4ab7c","observation_id":"273fdda7-9a53-4cc2-a2a6-c7ce36d5c4d3","resolution":{"observed_at":"2026-08-11T18:03:57.183563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10730","last_updated":"2020-10-19T10:04:50Z","snapshot_observed_at":"2026-07-06T09:57:54.236173Z","submitted_at":"2020-09-22T18:00:01Z","title":"Josephson effect in graphene bilayers with adjustable relative displacement","version":2},"cited_work":{"arxiv_id":"2009.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.10730","snapshot_observed_at":"2026-08-11T18:03:57.401670Z","title":"Josephson effect in graphene bilayers with adjustable relative displacement","venue":"cond-mat.mes-hall","work_id":"e8602d89-773f-410f-a9d5-dee5956db908","year":2020},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.188861Z"},"links":{"cited_paper":"/paper/2009.10730","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:1dfe33f5ed63f0d92ecf7d986bfdc33c44c48dc6a274e4d5605542ca294f3dc8","observation_id":"56606d63-a804-4627-b5da-5b5de451f256","resolution":{"observed_at":"2026-08-11T18:03:57.409597Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.09293","last_updated":"2021-12-16T15:54:11Z","snapshot_observed_at":"2026-08-11T03:33:33.320419Z","submitted_at":"2021-08-20T17:30:33Z","title":"Asleep at the Keyboard? Assessing the Security of GitHub Copilot's Code Contributions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.09293","snapshot_observed_at":"2026-08-11T18:03:57.193810Z","title":"Asleep at the keyboard? assessing the security of github copilot’s code contributions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.193810Z"},"links":{"cited_paper":"/paper/2108.09293","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:95b3131da8d75d932a2e55aea86ff6988b09e3dbcc814292b4809200f427477e","observation_id":"061d4f1e-0792-48a0-b5fd-c14f0d4a188e","resolution":{"observed_at":"2026-08-11T18:03:57.193810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13975","last_updated":"2022-09-05T10:19:11Z","snapshot_observed_at":"2026-07-06T11:52:19.105210Z","submitted_at":"2021-09-28T18:32:14Z","title":"Quantum walk approach to simulating parton showers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13975","snapshot_observed_at":"2026-08-11T18:03:57.199280Z","title":"The unsolved problems in ai security,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.199280Z"},"links":{"cited_paper":"/paper/2109.13975","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:24cc2b66cbca1ae4803c9ec1253f02a3dfd42993d141e1f85ab023cfd1295402","observation_id":"d65c2dd3-4745-47c4-82e9-40ec7646e4ad","resolution":{"observed_at":"2026-08-11T18:03:57.199280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15533","last_updated":"2022-11-20T18:15:30Z","snapshot_observed_at":"2026-08-13T13:38:46.469939Z","submitted_at":"2022-11-20T18:15:30Z","title":"The Stack: 3 TB of permissively licensed source code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15533","snapshot_observed_at":"2026-08-11T18:03:57.204260Z","title":"The stack: 3 tb of permissively licensed source code,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.204260Z"},"links":{"cited_paper":"/paper/2211.15533","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:59c9e532464ab34b4a094b2b8cec48e8fd3e895b28e0b5d2a878d5058a7a0772","observation_id":"2ccee093-9a8c-43c9-b1f4-d6afe8dd20c2","resolution":{"observed_at":"2026-08-11T18:03:57.204260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-11T18:03:57.209381Z","title":"Bloom: A 176b-parameter open-access multilingual language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.209381Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:6a3c582f8912ad826351216a02d8fc449d7a9c8c20961fd542464b38201ef117","observation_id":"cb2c1a36-5c13-4f25-b7b1-5972f0b96756","resolution":{"observed_at":"2026-08-11T18:03:57.209381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07827","last_updated":"2024-02-12T17:34:13Z","snapshot_observed_at":"2026-08-13T04:20:25.932319Z","submitted_at":"2024-02-12T17:34:13Z","title":"Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07827","snapshot_observed_at":"2026-08-11T18:03:57.214846Z","title":"Aya model: An instruction finetuned open-access multilingual language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-11T18:03:57.214846Z"},"links":{"cited_paper":"/paper/2402.07827","citing_paper":"/paper/2412.08291"},"observation_digest":"sha256:91e955d3b3fbb5b5075238405e16114601e1265d583c9f4a2693095e13215d3d","observation_id":"cba4f618-06c3-4cae-b858-19446545d157","resolution":{"observed_at":"2026-08-11T18:03:57.214846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.08291","last_updated":"2024-12-11T11:07:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T22:47:38.535911Z","submitted_at":"2024-12-11T11:07:50Z","title":"Code LLMs: A Taxonomy-based Survey"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":78,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 0 inbound Pith citation observations for arXiv:2412.08291."}