Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T12:29:19.342174Z
Paper Citation Record · LEDGER
As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2505.24324.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T12:29:19.342174Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
31 of 31 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation beea5b85-87fa-4e8f-af78-6c00c5c3b812 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Evaluating Large Language Models Trained on Code
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fdfd9c76-f6c0-43a0-b88d-7513e345f0ed · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis,
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation a7abdd35-4b4e-412e-b899-3b8573467071 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation A Systematic Evaluation of Large Language Models of Code
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c225c370-6ffa-4b0f-ac48-1692011462c6 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 179b10cf-8abc-4b9c-b004-bbf94ff66f0c · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Code Llama: Open Foundation Models for Code,
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation e80f189a-dbe1-49ed-aeab-78742db7615c · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Code Completion by Modeling Flattened Abstract Syntax Trees as Graphs,
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 993299aa-b9fc-4646-bcbb-4c01309223e5 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Lost in Translation: A Study of Bugs Introduced by Large Language Models while Translating Code,
Reference 7
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation f2b866d3-1975-437f-bd25-af74eacae51b · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Few-shot training LLMs for project-specific code-summarization
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 187c8295-2312-4503-9d86-e9a619655250 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Program Synthesis with Large Language Models
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1ee8ea2e-ba01-48dd-b29d-1ce5a23110e6 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Multi-lingual Evaluation of Code Generation Models,
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 4e8e84b3-d10f-49f2-b574-4d8f8eaf4e04 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Large Language Models Meet NL2Code: A Survey
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ba0c226f-54b7-4ea7-9d9a-fd90facb5e6b · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Measuring Coding Challenge Competence With APPS
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fcc5be15-61c6-4ab8-9267-2194bece6ba9 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b966ab95-d45a-4334-a0b9-ba15c86ccff5 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation MultiPL-E: A Scalable and Extensible Approach to Benchmarking Neural Code Generation,
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 08259e35-cb6d-4722-9b32-b986b9a79b8e · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 28ff50ae-dac9-4b29-ad6e-4aa66b623c37 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation The RedMonk Programming Language Rankings: June 2024,
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 17e14ba7-40c0-475d-9163-b51da64b5e20 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation BLEU: a method for automatic evaluation of machine translation,
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 889cb942-2ff9-4f1b-844a-d6d684838f2d · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation CodeBLEU: a Method for Automatic Evaluation of Code Synthesis
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fb1ad3e0-5e03-4ab1-aeff-d7c4f5f9f56d · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Rethinking Benchmark and Contamination for Language Models with Rephrased Samples
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e5e5128d-a80f-418b-8437-e1711082ceea · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a067a680-2594-451c-a942-61d846b27d0d · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation ClassEval: A Manually-Crafted Benchmark for Evaluating LLMs on Class-level Code Generation
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0ed1519f-bcdd-4d7b-9da1-022f0af9d30a · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation CrossCodeEval: A Diverse and Multilingual Benchmark for Cross-File Code Completion
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3b067938-c473-46de-8d0b-3fae1dd81151 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 420e91c7-9ceb-44a7-802d-b81cf01f07ec · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation mHumanEval -- A Multilingual Benchmark to Evaluate Large Language Models for Code Generation
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a4d59dc5-d10c-4dec-b44c-3c756e2311f8 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2e236130-4401-4941-b8b7-dd26f15a5daf · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Qwen2.5-Coder Technical Report
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 50e71aca-cd44-43f1-b3e0-ee6ecb237f6e · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Codestral: Hello, World!,
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 1cb66ead-1dad-43e4-8f56-ea15961c4df8 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation CPP-UT-Bench: Can LLMs Write Complex Unit Tests in C++?
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation cc0aa898-2ecb-4237-9d8a-c5a1cccae062 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation HumanEval.jl,
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 4fbff495-e80d-48c8-9c27-092512988089 · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation Rust Compiling Benchmark,
Reference 31
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 87e2efdb-0046-440d-9965-ce658358a6ec · outbound
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation MultiPL-E: A Scalable and Extensible Approach to Benchmarking Neural Code Generation
Reference 2022
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
No inbound Pith citation observations are available.