{"as_of":"2026-08-10T02:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe2d3019e6e70c7e30ab0dddd95517a357dda98b9945083a6c201212ecce464b","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T05:53:52.470666Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.02949/citation-record","integrity":"/paper/2607.02949/integrity","json":"/paper/2607.02949/citation-record.json","paper":"/paper/2607.02949"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:e4dd681c1a4b17e8a3ba3136b71105d222e49ec0e9f577ed0f75116f81c65df7","observation_id":"f2aa70b2-929f-469d-8c94-bb1799977a65","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Program synthesis with large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:4c0bf8fcba584107bd12f659dca2af61da4e6d2d0b86307f81bc744b950325d0","observation_id":"503121c1-4d66-4e75-ad09-dde159267411","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Competition-level code generation with AlphaCode,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:f03e1c5695719cc5fb325cd21e20d6e32486d4baadbef60ff8c3b560398ddb4b","observation_id":"b62651cd-5c63-49c9-ad94-886e879006ae","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"A survey on large language models for code generation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:d1db5b22350d2e1a3d6146e5cc15ea7a66eeb21177c6ec57b1ac2a22f5ed7f85","observation_id":"4e33ad03-93e2-4eb9-9fef-b2cbd6029239","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Large language models for software engineering: Sur- vey and open problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:3e13d599e289eeef40cb2c52d68cbb2b3cc93c0738271398c555bca84144ab57","observation_id":"b93ddf22-65da-47b8-921e-50b37d53ea04","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Automated repair of ambiguous problem descriptions for LLM-based code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:6cf592fb2d6bafd588138a53be21765d48478c35b4daac937f6786ad3f95f733","observation_id":"c6548bad-6a7a-4383-8e04-35fde027ae3d","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Aligning requirement for large language model’s code generation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:2f0e52fa5e21db33a1627ae6f83060e68022fe3631c12d65cc5d6e748f43a208","observation_id":"e5f945a5-0e40-4ec2-8740-c38ab37c0c9b","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Fixing large language models’ speci- fication misunderstanding for better code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:170bb644decc37c241928d269750c89cf39f0a09ee62c3b86bc36f282076c68e","observation_id":"e3cae908-935d-4a97-bbd7-91ab0e9edbe6","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"ClarifyGPT: A framework for enhancing LLM-based code generation via requirements clarification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:59ce2c8afb96fbcb4c2b0f68c448626fa90214cb340d062fbc87ee3fe45195ab","observation_id":"b5aef482-83ec-4022-8f02-a815ec9b1523","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.16198","last_updated":"2026-04-17T16:08:05Z","snapshot_observed_at":"2026-07-06T23:03:34.795570Z","submitted_at":"2026-04-17T16:08:05Z","title":"Bridging the Gap between User Intent and LLM: A Requirement Alignment Approach for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.16198","snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Bridging the gap between user intent and llm: A requirement alignment approach for code generation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"cited_paper":"/paper/2604.16198","citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:5d37c401a9dbd123088cb26246ff64dc3d02d08d118f3129c68de2e67b11b2e4","observation_id":"41f865c8-8e78-450a-a31f-6e0ab3a21d84","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.16276","last_updated":"2026-06-17T06:16:12Z","snapshot_observed_at":"2026-08-08T19:40:32.199875Z","submitted_at":"2026-06-15T06:30:52Z","title":"SpecAlign: Efficient Specification-Grounded Alignment of Large Language Models via Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.16276","snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Specalign: Efficient specification-grounded alignment of large language models via synthetic data,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"cited_paper":"/paper/2606.16276","citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:0f23fd8b432e9395a4b6c167cc2c5a155d191198f2342f4089bed36067b5f7ff","observation_id":"5894884e-8d7c-409c-a1d4-2e613de02ec6","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Teaching large language models to self-debug,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:88bb2a212f2205391c4e82d97e1dba10c563f0965ac40fe2b4c93919b45c999b","observation_id":"96f09384-6fab-4df4-8e5d-c11bfa8e47ab","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Is self-repair a silver bullet for code generation?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:6245f51a3e8a1b360fced92fc8cb44caeae9cbbc5a69dd029aa8557910fc3a47","observation_id":"379f5321-02e6-42ec-910e-3ea42b9058e0","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13010","last_updated":"2024-05-24T11:47:24Z","snapshot_observed_at":"2026-07-06T17:05:56.282078Z","submitted_at":"2023-12-20T13:22:41Z","title":"AgentCoder: Multi-Agent-based Code Generation with Iterative Testing and Optimisation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13010","snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"AgentCoder: Multi-agent-based code generation with iterative testing and optimisation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"cited_paper":"/paper/2312.13010","citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:ed54a40f198986e31500ae08c7309aba21a5ac717cda7898a5aaddaabb34ffd3","observation_id":"89a2b1b2-a13d-48de-a4dd-32078896913a","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Self-collaboration code gener- ation via ChatGPT,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:e84d80585134ec237178930d475b6a779de4fa9312ccf73d1d94b1c94bb1ce77","observation_id":"b1c1323a-6973-4841-be62-391030445065","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"A pair programming framework for code generation via multi-plan exploration and feedback- driven refinement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:3ec4a90df842f9b745392265cc45d99b7ab9eb9290b536352988873790825797","observation_id":"24572a7c-d9df-4b17-8d6f-bea1954607d0","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Structured chain-of-thought prompting for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:712c1def08d7ee7ab7fdf174a8846cfc21c62742687277e5f5b3ae1ce66e07c3","observation_id":"4a26e5f0-9cd8-4bad-bbf1-b82d0b67d327","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Mutation-Guided Unit Test Generation With a Large Language Model ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:672da470897b8c7bc253f500ec8747acdd0a6ab3c6c9ff51948bd53b8afc969d","observation_id":"e733066a-46c9-48cc-9581-27c709b46aef","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Available: https://doi.ieeecomputersociety.org/10.1109/ TSE.2026.3682975","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:402243a9ccb6637d096d5bcdda0a0836c27c00a32affce40595edcb713f3da92","observation_id":"00cf67aa-36d8-422c-9de6-50fbbb428a0e","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Hallucination to consensus: Multi-agent llms for end-to-end junit test generation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:3fd952f70ff02295ee2ae17c0bb0199493f223424ab76175ae4aefd0e3ed83c4","observation_id":"1b1862ef-8877-40eb-9f4f-b7294e30dadb","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03786","last_updated":"2024-12-10T00:45:24Z","snapshot_observed_at":"2026-07-06T18:10:37.836239Z","submitted_at":"2024-05-06T18:37:35Z","title":"TOGLL: Correct and Strong Test Oracle Generation with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03786","snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"TOGLL: Correct and Strong Test Oracle Generation with LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"cited_paper":"/paper/2405.03786","citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:343034161560c5009509f1aa2817fafe88e98ee0dc4cc3faf9b14337f90bfaca","observation_id":"b127f97d-495c-4f39-a80e-09e57235dd18","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Quantum machine learning-based test oracle for autonomous mobile robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:ba67d51a41c0b299a8569b3bff4d7f4a19ff24ce80622dc4248db4cb684e466b","observation_id":"2596bb44-248d-4549-8233-dd564c32d262","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"CodeT: Code generation with generated tests,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:a3edca557d1f7d50668c6212241b7a43c042e1d2528a04a3c33cbed23f3fc285","observation_id":"ec33b57e-b50b-426d-938c-73d5649c21c0","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Enhancing large language mod- els in coding through multi-perspective self-consistency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:94889d93cc7ea4fe45a9539b0c11e1954b44732e5d089daa7a7374440c56d3e4","observation_id":"beee1c06-1722-4c7f-8253-a9e6f8eecff9","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"XCodeEval: An execution-based large scale multilingual multitask benchmark for code understanding, generation, translation and retrieval,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:8d5a8537895f8a33c35d05fdc1185971bb1fccf14cf09ac062b007e4b775d227","observation_id":"d8b8ae08-2599-4bb7-8004-c32055c1533f","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Measuring coding challenge competence with APPS,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:56da0dbd63b9c72b66260f953669177f0b1ff39497cc529a68b25782d0dd7f46","observation_id":"9225b8e0-a116-4c29-95e4-5a7109dfbd97","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"LiveCodeBench: Holistic and contamination-free evaluation of large language models for code,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:89a33830297f243b3088a4aaebc6a36e0897d6c0cf163ecc216d9d7ea6a1d6de","observation_id":"e3a254b6-7b83-4bde-b9b7-e4b31ade6336","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"OpenRouter: The unified interface for LLMs,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:6bd0d763e7c59ebaeb6694ab60f6ef0e9ab25f8ba8ee95b2c3f80ca523b6010a","observation_id":"8001787a-0b37-427b-99f0-8ff6e9ab50e9","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"The measurement of observer agreement for categorical data,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:622310e828daa7869ffec93b8b30a7f350769e69ba60d75dd967171da329c9b0","observation_id":"c393cdcf-d29f-4b37-8c40-0de254f0ca4c","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"A coefficient of agreement for nominal scales,","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:373a4c9403efcbe635b43c4b90d367afa0ff32ae203b6c3880c8c11c31665240","observation_id":"b05489b7-ada9-4e7e-9567-aa6c3532f9f6","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Judging LLM-as-a-judge with MT-Bench and Chatbot Arena,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:a5d5ea4022ef624cfbe1c0396acf71f501032b447fe185c7abfc27a8732529e5","observation_id":"d0de9e63-2b2d-413d-8132-a9f9da4ceff5","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T05:53:52.470666Z","title":"Self-refine: Iterative refinement with self-feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T05:53:52.470666Z"},"links":{"citing_paper":"/paper/2607.02949"},"observation_digest":"sha256:605fe43338290d6bd8aec65013a745afff392bebf220de46486ff7dcf0c6f330","observation_id":"8432cc99-0841-45ff-ba86-147735770428","resolution":{"observed_at":"2026-07-12T05:53:52.470666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.02949","last_updated":"2026-07-03T04:48:45Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-08T19:41:02.132408Z","submitted_at":"2026-07-03T04:48:45Z","title":"BeSpec: Behavior-Level Specification Alignment for Code Generation"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2607.02949."}