Pith. sign in

Paper Citation Record · LEDGER

Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2412.18573.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.18573 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 10 of 10 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 10 of 10 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T23:37:38.185745Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-19T16:22:39.562491Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation a0af9734-15f1-45dc-acae-13acc96ead33 · inbound

OmniGIRL: A Multilingual and Multimodal Benchmark for GitHub Issue Resolution cites this paper.

OmniGIRL: A Multilingual and Multimodal Benchmark for GitHub Issue Resolution Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-15T23:27:58.501148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:27:58.501148Z digest=sha256:da632e9e224cb4b76a7c5775a08c5a7ea81b54f5aba639c5754af8ba45b0500e

Observation 6c60a45d-133e-47b6-ad9b-36028ea59cd5 · inbound

LLM Code Customization with Visual Results: A Benchmark on TikZ cites this paper.

LLM Code Customization with Visual Results: A Benchmark on TikZ Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-15T23:37:38.185745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:37:38.185745Z digest=sha256:da745ba686d800358d0a95259367fc4f66c6776fcd3f5a6a0f87ea311fea5353

Observation b56dff38-2269-4311-9d09-2d1988dba53b · inbound

OSS-Bench: Benchmark Generator for Coding LLMs cites this paper.

OSS-Bench: Benchmark Generator for Coding LLMs Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:08.952533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:08.952533Z digest=sha256:a98bffc7258af1f87f2e04102ddf60eb167e228b014e39c3a6a44f4ac46ca15c

Observation 2e1fe199-bb2d-41af-97c4-c0f839cd60d5 · inbound

Domain Specific Benchmarks for Evaluating Multimodal Large Language Models cites this paper.

Domain Specific Benchmarks for Evaluating Multimodal Large Language Models Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T00:39:41.642717Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:39:41.642717Z digest=sha256:6f7ed2a23f68de4d534a8fb0dd2ea23193bf045cf08cc5b63d65d218b809a4a2

Observation 004e92b6-2cf3-4757-afd8-e981219f7fd5 · inbound

Context-Aware CodeLLM Eviction for AI-assisted Coding cites this paper.

Context-Aware CodeLLM Eviction for AI-assisted Coding Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:20.078029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:20.078029Z digest=sha256:5469445a3bcda90abd0d9214b4e066d371ff5465214714aea11be56a2ad56cff

Observation 75df892a-b039-4a0a-81ac-b00c35f00305 · inbound

Can Large Language Models Integrate Spatial Data? Empirical Insights into Reasoning Strengths and Computational Weaknesses cites this paper.

Can Large Language Models Integrate Spatial Data? Empirical Insights into Reasoning Strengths and Computational Weaknesses Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-05T23:40:02.933462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T23:40:02.933462Z digest=sha256:881b7bddc81dae881ab51c3be7c5255e6230868d0958e49f187646be35528282

Observation f9837e94-f9df-4ab1-a3df-45116d0bbc1d · inbound

On Fixing Insecure AI-Generated Code through Model Fine-Tuning and Prompting Strategies cites this paper.

On Fixing Insecure AI-Generated Code through Model Fine-Tuning and Prompting Strategies Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 69

Resolution
verified exact
arxiv_id, observed 2026-05-11T20:26:09.930254Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-08T09:12:15.486780Z digest=sha256:a91aaa745b49d346af7ab6f2ef7d00670cebf499c16d29244c580e9fd92e1d28

Observation e04dcb25-6b34-4830-802c-5ef9bcf4084a · inbound

Probing Privacy Leaks in LLM-based Code Generation via Test Generation cites this paper.

Probing Privacy Leaks in LLM-based Code Generation via Test Generation Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-19T16:22:39.564606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=arxiv_source observed=2026-05-19T16:21:11.506550Z digest=sha256:1742184a1188affb4ceafe7728ee70e25dfaf668b721120fe96899245d5e3c8d

Observation e0ea7035-782e-4f98-b107-63d93e71f17e · inbound

PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents cites this paper.

PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-01T14:11:55.334757Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T14:11:55.334757Z digest=sha256:fbd66b3830379c8a5a059538e1fc72202b4b5b365a9d42e1dfb7fc2c47c67c74

Observation 001b658e-aba6-4c7a-bf78-1504a1c16f58 · inbound

RepoReasoner: Evaluating Repository-Level Code Reasoning Ability of Long-Context Language Models cites this paper.

RepoReasoner: Evaluating Repository-Level Code Reasoning Ability of Long-Context Language Models Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-01T00:57:40.738151Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T00:57:40.738151Z digest=sha256:e896c9e92d55094cd2e5a883ad9e265f830f034e4820c166cead0a00de8e3cee