{"as_of":"2026-08-12T04:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1023dbfc8656de57487751aadd3bd75306dea1541e88efae0a2226d86b0fe1bd","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:43:14.383453Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:27:41.491607Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:44:02.092336Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"cited_work":{"arxiv_id":"2507.18130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18130","snapshot_observed_at":"2026-08-04T01:57:46.600006Z","title":null,"venue":null,"work_id":"be738549-916a-4f3e-bdd4-63fd787b7235","year":2025},"citing_paper":{"arxiv_id":"2604.11270","last_updated":"2026-07-30T10:58:23Z","snapshot_observed_at":"2026-08-02T23:57:43.901147Z","submitted_at":"2026-04-13T10:24:28Z","title":"Evaluating LLM Agents on Automated Software Analysis Tasks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:38:12.144252Z"},"links":{"cited_paper":"/paper/2507.18130","citing_paper":"/paper/2604.11270"},"observation_digest":"sha256:0ac7a80482a497c19fa1138aa106da7389ca412a1dbeb0ac91791400cf7d808e","observation_id":"6334d273-62ac-4d2e-91b4-c23e2f895269","resolution":{"observed_at":"2026-08-04T01:57:46.600006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18130","snapshot_observed_at":"2026-08-02T16:27:41.491607Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.11270","last_updated":"2026-07-30T10:58:23Z","snapshot_observed_at":"2026-08-02T23:57:43.901147Z","submitted_at":"2026-04-13T10:24:28Z","title":"Evaluating LLM Agents on Automated Software Analysis Tasks","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T16:27:41.491607Z"},"links":{"cited_paper":"/paper/2507.18130","citing_paper":"/paper/2604.11270"},"observation_digest":"sha256:ff3850f03fe8bc1e225653e4fab2c9e60492214a11ff8099f874b681bc85538c","observation_id":"7ac59ec0-b3f7-423a-9513-8b21ce1d0c3b","resolution":{"observed_at":"2026-08-02T16:27:41.491607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"cited_work":{"arxiv_id":"2507.18130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18130","snapshot_observed_at":"2026-08-04T01:57:46.600006Z","title":null,"venue":null,"work_id":"be738549-916a-4f3e-bdd4-63fd787b7235","year":2025},"citing_paper":{"arxiv_id":"2604.16021","last_updated":"2026-04-20T05:47:29Z","snapshot_observed_at":"2026-07-06T23:03:26.308324Z","submitted_at":"2026-04-17T12:49:18Z","title":"Neurosymbolic Repo-level Code Localization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T08:26:02.980824Z"},"links":{"cited_paper":"/paper/2507.18130","citing_paper":"/paper/2604.16021"},"observation_digest":"sha256:2e0d82d76054ad5accbb310b55719f1f8d70a46ca391f27919fd3adcf9ab5982","observation_id":"9c2bfa89-9269-4709-a3e0-f35539c07c12","resolution":{"observed_at":"2026-08-04T01:57:46.600006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"cited_work":{"arxiv_id":"2507.18130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18130","snapshot_observed_at":"2026-08-04T01:57:46.600006Z","title":null,"venue":null,"work_id":"be738549-916a-4f3e-bdd4-63fd787b7235","year":2025},"citing_paper":{"arxiv_id":"2605.04320","last_updated":"2026-05-07T19:11:05Z","snapshot_observed_at":"2026-08-11T14:09:34.261077Z","submitted_at":"2026-05-05T21:49:52Z","title":"Reproduction Test Generation for Java SWE Issues","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T16:56:33.346935Z"},"links":{"cited_paper":"/paper/2507.18130","citing_paper":"/paper/2605.04320"},"observation_digest":"sha256:619b3bea0cbe0b9a22ceb5505013a2ef1b341c565871e5471c27e930651ef0cf","observation_id":"bb8d263a-4b43-4f1d-83ce-369018640cd0","resolution":{"observed_at":"2026-08-04T01:57:46.600006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"cited_work":{"arxiv_id":"2507.18130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18130","snapshot_observed_at":"2026-08-04T01:57:46.600006Z","title":null,"venue":null,"work_id":"be738549-916a-4f3e-bdd4-63fd787b7235","year":2025},"citing_paper":{"arxiv_id":"2605.04320","last_updated":"2026-05-07T19:11:05Z","snapshot_observed_at":"2026-08-11T14:09:34.261077Z","submitted_at":"2026-05-05T21:49:52Z","title":"Reproduction Test Generation for Java SWE Issues","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T00:48:28.794195Z"},"links":{"cited_paper":"/paper/2507.18130","citing_paper":"/paper/2605.04320"},"observation_digest":"sha256:c5e1b9c18e9fc6da0f525b086aae20b1ce289ee94456491d57d71ee2cb88447b","observation_id":"8b93b7b0-67e4-4050-85dd-184aaa9c23ac","resolution":{"observed_at":"2026-08-04T01:57:46.600006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"cited_work":{"arxiv_id":"2507.18130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18130","snapshot_observed_at":"2026-08-04T01:57:46.600006Z","title":null,"venue":null,"work_id":"be738549-916a-4f3e-bdd4-63fd787b7235","year":2025},"citing_paper":{"arxiv_id":"2605.25356","last_updated":"2026-05-25T02:20:29Z","snapshot_observed_at":"2026-08-08T08:42:04.909843Z","submitted_at":"2026-05-25T02:20:29Z","title":"Names Are All You Need: Effective and Safe Regression Test Selection for Python","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T21:07:10.225387Z"},"links":{"cited_paper":"/paper/2507.18130","citing_paper":"/paper/2605.25356"},"observation_digest":"sha256:6d37a2fa098760c33892f3318325d686b128eaae7e6bcf15031233b2eb5fdaba","observation_id":"0dab70a1-1e79-422f-acb6-1289b7dec24e","resolution":{"observed_at":"2026-08-04T01:57:46.600006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18130/citation-record","integrity":"/paper/2507.18130/integrity","json":"/paper/2507.18130/citation-record.json","paper":"/paper/2507.18130"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.890893Z","title":null,"venue":null,"work_id":"9f83a259-a0b7-4fb1-8bd2-fc8eaca99ca7","year":2019},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.262991Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:87e96722f9fb40480dbfd55d29b5b3a7003e5d273a8dfe79152845130a20ef92","observation_id":"733c37ce-153f-4b08-817d-950d81e2ae7b","resolution":{"observed_at":"2026-08-06T14:43:14.893845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.882927Z","title":null,"venue":null,"work_id":"1df24306-33ef-44fd-b143-bc69e785b50e","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.266264Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:dfcc90e53d2ce63252caa36bd1823a984b0a023e989e8b1da50f6a0a017742ae","observation_id":"bebbfaac-7e62-4b8b-874d-37cc30faf89e","resolution":{"observed_at":"2026-08-06T14:43:14.885765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.874905Z","title":null,"venue":null,"work_id":"7eeb0ab6-b4a8-47e6-aa04-9bc44cf59079","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.269276Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:bd871c0519c56a3833bc27e7b9298007c5cc710d06bb9faaa83eec82bea85dc5","observation_id":"03a8c34a-b913-4f01-9709-56be5d71bfd9","resolution":{"observed_at":"2026-08-06T14:43:14.877792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.865764Z","title":null,"venue":null,"work_id":"79a2dc6d-d3a8-4bce-937b-adb198e97dd7","year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.271948Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:10eb693d8bde8df8c9b69923463a5de6b83eeeeac9fbd2c88be59aff23dd1b28","observation_id":"b8f866f0-9607-428c-8a92-6e5aebf4efa3","resolution":{"observed_at":"2026-08-06T14:43:14.868958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.856019Z","title":null,"venue":null,"work_id":"1e17ee8a-5521-446c-aca7-476cd648db90","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.274534Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:5be96e3d977addff4805ef0a65ecd6d95885d79bbb8c685ac98e6f29ff4ad204","observation_id":"4964010a-830a-4784-9731-37e7bf017f55","resolution":{"observed_at":"2026-08-06T14:43:14.859921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.846837Z","title":null,"venue":null,"work_id":"577bc5f3-ae4f-4887-9129-6007845c19d6","year":2020},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.277804Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:c086f181423f753a017c861daed454240ef749f05f62c427cf4396c9cf5fc96d","observation_id":"5d258ce8-d459-4ccc-9760-80404074deb9","resolution":{"observed_at":"2026-08-06T14:43:14.850015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.838093Z","title":null,"venue":null,"work_id":"3d6ba483-abdb-4eb7-9b98-21ce1969200f","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.280520Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:9a5fa0025167cd9fe88c29e0d21bd4c0e78bc8228003352f95852655ee2466df","observation_id":"10db8e0a-c7f4-454b-b307-7d490531d042","resolution":{"observed_at":"2026-08-06T14:43:14.841140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.829471Z","title":null,"venue":null,"work_id":"a09b3b80-8008-41f8-becb-9a70b8424647","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.282964Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:540cb64fd343b273f7887c9756e1edd99a7d736fd89ccf75d391bc03f00c8ea6","observation_id":"440bde2c-6ca4-47de-ae52-a372a0e47903","resolution":{"observed_at":"2026-08-06T14:43:14.832385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.819519Z","title":null,"venue":null,"work_id":"af3f841f-af8e-4700-8ef1-61ebd37e82c1","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.285407Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:4840f62ecdf4c95ff3370aecb701d6b9c25edac5209443672cc70e3e4ba52221","observation_id":"a5b97720-58b2-4b57-9c8b-d165f48ca220","resolution":{"observed_at":"2026-08-06T14:43:14.823477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T14:43:14.287777Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.287777Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:7b4e327a7cadc1beff3d5d84774cfc59b853d48dbd425349d96658481fb687c2","observation_id":"68481218-e7dd-4b5e-8105-0ae4bb0ad055","resolution":{"observed_at":"2026-08-06T14:43:14.287777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.809327Z","title":"Jimenez, John Yang, Leyton Ho, Tejal Patwardhan, Kevin Liu, and Aleksander Madry","venue":null,"work_id":"3d6715c7-8492-4ecd-af76-084a3708560c","year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.290538Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:30b7e96f1dd39a52a63ae91a73905d234aa68915cf153191617774c6a9f12d66","observation_id":"485b04a1-c8a1-444d-94ba-f111840a68c1","resolution":{"observed_at":"2026-08-06T14:43:14.812635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.798928Z","title":null,"venue":null,"work_id":"a7aba928-d114-40ae-8272-efe684c6740c","year":2016},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.293016Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:84c1aa8a6377ad265cfd96619d036f41fe97c80de75c9e523ce6c8f5e3e20d89","observation_id":"64461c92-eb9a-4e56-989d-e58a0146b5d2","resolution":{"observed_at":"2026-08-06T14:43:14.802275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.788499Z","title":null,"venue":null,"work_id":"a24e6578-bed1-4890-b794-b5658be253e3","year":2001},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.295380Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:d43bcee362ecfdfb5e1df17434d384878fd3947cff1fa527895b8a9a71a6c876","observation_id":"54c3eb89-88e0-4f4b-bcf3-718f78a8dc94","resolution":{"observed_at":"2026-08-06T14:43:14.792205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.778123Z","title":null,"venue":null,"work_id":"41c3fc09-aba8-4095-938e-854ee90dc59d","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.297579Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:ba55a70080811d94f863e24a31011b3263ee5df216a1f825c44cda602de77368","observation_id":"bc34194d-c587-4232-810a-babaf5a139c7","resolution":{"observed_at":"2026-08-06T14:43:14.781828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.768408Z","title":null,"venue":null,"work_id":"de2e16ed-713b-45f8-afe8-4fb58f8f0be1","year":2023},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.299839Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:4b0b3f66509c1c7781099123fc49cd234d8b0368f4c94ee15d5dd16c376ca37b","observation_id":"ad7b1351-1708-4be8-a507-a0e05ddee227","resolution":{"observed_at":"2026-08-06T14:43:14.772113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.302175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.302175Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:4675f60f9f43fba792834a141b7f2560cc1f754390a283a390a697cb91fb343a","observation_id":"d6641181-2442-4712-914e-1183641e21d4","resolution":{"observed_at":"2026-08-06T14:43:14.302175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.754524Z","title":null,"venue":null,"work_id":"7e8af397-abf9-4cd6-b57c-e0efb2dd8dfc","year":2023},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.304757Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:73639bd8b1dc0418e92888a29cee66a76b9ea703d252968bb4ccd1d1b456a12e","observation_id":"37f60e10-1686-4a98-b436-c97efba55b5e","resolution":{"observed_at":"2026-08-06T14:43:14.757485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.745452Z","title":null,"venue":null,"work_id":"36519ad3-841c-4dc5-a738-08d0c9cc2aec","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.307311Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:9f800ae05a936185638cbabb5d206cccbcdadf1c386d2f4063477b38a55072ae","observation_id":"2f06833c-0bf2-4cb8-b758-61b7536f29ed","resolution":{"observed_at":"2026-08-06T14:43:14.748745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06680","last_updated":"2025-06-19T02:42:41Z","snapshot_observed_at":"2026-08-07T17:18:47.690953Z","submitted_at":"2025-03-09T16:11:57Z","title":"FEA-Bench: A Benchmark for Evaluating Repository-Level Code Generation for Feature Implementation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06680","snapshot_observed_at":"2026-08-06T14:43:14.309928Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.309928Z"},"links":{"cited_paper":"/paper/2503.06680","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:6aa395fc74317a5cbbea5e99b68639686427d8dd18ae210aa118c019a5a9fa0b","observation_id":"9cf92708-93f2-40e8-8a85-a2c6df496ffb","resolution":{"observed_at":"2026-08-06T14:43:14.309928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.735599Z","title":null,"venue":null,"work_id":"cfcdaac1-e92d-4ebd-a673-78fc8a29acce","year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.312861Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:a565bb9b0c6f5da2d946be385e2e37c78b96b3892cb37ddb6512d84b049ba7cc","observation_id":"270c441a-3e03-49f4-b4cd-a20492db771c","resolution":{"observed_at":"2026-08-06T14:43:14.738598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.315412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.315412Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:ecf219e493273920cb19decdb09b156e307d7060e3cd3a34680a138edf79b092","observation_id":"6af1df62-334d-450e-b42d-979615867bf5","resolution":{"observed_at":"2026-08-06T14:43:14.315412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T14:43:14.317738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.317738Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:ef42bd43f90fc634238f37f342be07c7b983b663a24ab718ae69021d5f6337bd","observation_id":"2493913b-39b1-4a01-b21b-371b79fac0b0","resolution":{"observed_at":"2026-08-06T14:43:14.317738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.726229Z","title":null,"venue":null,"work_id":"eac73206-0a57-4f80-874a-e1966f22264f","year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.320122Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:8c297b94326ef1b07d84395863da7825b305b8a6efeaaa8fd5fe80511f6b7761","observation_id":"5f04209c-a2a2-4536-8354-e8451f568687","resolution":{"observed_at":"2026-08-06T14:43:14.729163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.717097Z","title":null,"venue":null,"work_id":"e3fb4176-2a62-4468-86ef-8ec8ed37760f","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.323007Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:7d91bee75403957bb60c57bc7be3cd050a5d5c40d448949a8fe265e00177c4d5","observation_id":"f9aac29c-d0d9-4621-9e85-6bbf893b4aff","resolution":{"observed_at":"2026-08-06T14:43:14.720124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.707284Z","title":null,"venue":null,"work_id":"adb589eb-fb63-42de-ad2b-7e4242d39147","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.326655Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:189d387f66e57950c8f131343e288170ffdfb021f49a3672142f789c4d801683","observation_id":"0b5e861b-bf35-4e54-ac1f-0f49fda45e15","resolution":{"observed_at":"2026-08-06T14:43:14.711179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.697891Z","title":null,"venue":null,"work_id":"812b5244-33f7-4540-be69-b48149be96d1","year":2019},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.329136Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:f513153ae7d20bbdae636d116ad8ce95ca33b2237063269ba335a6bec1cc0a8f","observation_id":"322fea1a-391a-4329-ab43-fc2bbd3d5a4c","resolution":{"observed_at":"2026-08-06T14:43:14.701045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.331844Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.331844Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:0e8168d66cf6b33a171911cc6dbf865523b6dc892697a05752a3ab67ed1fb0d8","observation_id":"e1a90696-cf96-40f1-80f2-cd99dfa1be90","resolution":{"observed_at":"2026-08-06T14:43:14.331844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08703","last_updated":"2025-04-23T20:22:37Z","snapshot_observed_at":"2026-08-10T02:18:45.862185Z","submitted_at":"2025-04-11T17:08:02Z","title":"SWE-PolyBench: A multi-language benchmark for repository level evaluation of coding agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08703","snapshot_observed_at":"2026-08-06T14:43:14.337616Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.337616Z"},"links":{"cited_paper":"/paper/2504.08703","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:bad3b3ba338c614455cdd66d35c55021115b8feeafd52b428ca429b7b1467d95","observation_id":"9db39d24-7605-4fab-ab05-23178030fac3","resolution":{"observed_at":"2026-08-06T14:43:14.337616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07531","last_updated":"2025-01-13T18:09:25Z","snapshot_observed_at":"2026-08-10T20:36:53.255445Z","submitted_at":"2025-01-13T18:09:25Z","title":"Evaluating Agent-based Program Repair at Google","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07531","snapshot_observed_at":"2026-08-06T14:43:14.340240Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.340240Z"},"links":{"cited_paper":"/paper/2501.07531","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:58c4eb3735c79918e8402bf5a1fcfa502879c07b21b655e5220c3cd53243f9ec","observation_id":"bd6c01a8-7067-4071-a951-b66c888fa0d9","resolution":{"observed_at":"2026-08-06T14:43:14.340240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02232","last_updated":"2024-12-11T11:18:54Z","snapshot_observed_at":"2026-08-09T13:30:46.182806Z","submitted_at":"2024-08-05T04:53:01Z","title":"SpecRover: Code Intent Extraction via LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02232","snapshot_observed_at":"2026-08-06T14:43:14.343532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.343532Z"},"links":{"cited_paper":"/paper/2408.02232","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:c82600d127d3012fdfab7d7dc1ee3df1cfc8dfc70ed74b066165a40de499d180","observation_id":"b55bcfa7-9faf-4e34-9566-c49349fde958","resolution":{"observed_at":"2026-08-06T14:43:14.343532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.674819Z","title":null,"venue":null,"work_id":"363f80ef-5375-4c5b-b3fe-27788826a42a","year":2020},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.346525Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:f90b0bcf9b79e5f722e40919ead42ab963f4769db5d595329038f86becabbaee","observation_id":"b2957699-7d72-4d9b-ac49-49280ae48909","resolution":{"observed_at":"2026-08-06T14:43:14.677931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.665678Z","title":null,"venue":null,"work_id":"ab089f63-9218-403d-8a6f-3b70d13ad63f","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.348970Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:f0ba87995fb6a59e0c27c6d18c74cd0e9c65e268eb5327f87de988ab9a4d65ab","observation_id":"1669ad58-ac92-46bc-9656-158f66f16662","resolution":{"observed_at":"2026-08-06T14:43:14.669410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.656157Z","title":"Xu, Xiangru Tang, Mingchen Zhuge, Jiayi Pan, Yueqi Song, Bowen Li, Jaskirat Singh, Hoang H","venue":null,"work_id":"76192e28-f966-450a-b7d6-433dfe48f6ae","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.351356Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:7d2374743e4bffad1b972b0ed8edcd8bf5f6577793a0b0b92bc5a6f68cd42a44","observation_id":"a1432d15-69e0-4923-b7f6-bbf8bda87d25","resolution":{"observed_at":"2026-08-06T14:43:14.660245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.647539Z","title":null,"venue":null,"work_id":"5ffe7299-a473-4062-a18a-441ed28536b8","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.353838Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:0ad344439316471e7fc4ae409c19b89fa1f31760d411769d72cfe9db5a514db4","observation_id":"db9d1249-d622-49c4-9bfe-2a2cf1fb15f3","resolution":{"observed_at":"2026-08-06T14:43:14.650626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05040","last_updated":"2025-05-07T04:06:41Z","snapshot_observed_at":"2026-08-10T21:17:50.464883Z","submitted_at":"2025-01-09T07:54:24Z","title":"SWE-Fixer: Training Open-Source LLMs for Effective and Efficient GitHub Issue Resolution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05040","snapshot_observed_at":"2026-08-06T14:43:14.356628Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.356628Z"},"links":{"cited_paper":"/paper/2501.05040","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:50203df1de2364259d0ea67955f04193345e059fb68823464d6cf8a9a74ee1ba","observation_id":"73f451ca-e7b1-4a5d-88d0-9cad2f3648f7","resolution":{"observed_at":"2026-08-06T14:43:14.356628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.637981Z","title":null,"venue":null,"work_id":"8ff60495-c3cb-45e9-9ae4-db09f77d2ecc","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.359152Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:7dce61e586ef68276ebcbf9d2b4b01c29ecedb27d6e2fbf83c409a8199be7e63","observation_id":"210bc757-2461-4a61-b0a6-4d252afad372","resolution":{"observed_at":"2026-08-06T14:43:14.641649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11817","last_updated":"2025-02-13T08:11:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-22T10:26:14Z","title":"Hallucination is Inevitable: An Innate Limitation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11817","snapshot_observed_at":"2026-08-06T14:43:14.361465Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.361465Z"},"links":{"cited_paper":"/paper/2401.11817","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:3df126ae3a394492fc222bd971361af6b6216af72a2997a08c8eb9511d0bb67a","observation_id":"e6e58472-c8a4-4290-9fff-ecf0c5e4c6bc","resolution":{"observed_at":"2026-08-06T14:43:14.361465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.629029Z","title":null,"venue":null,"work_id":"6674fe2a-76a9-4ead-ab8f-68fa324012dd","year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.363955Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:e0a6affd99ac011d98312fad05ae657e08ed986af09d09df334f191f39c12a19","observation_id":"4cfed32c-e5fd-4c60-864e-3bf3519ed302","resolution":{"observed_at":"2026-08-06T14:43:14.631898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.619366Z","title":"Jimenez, Alex L","venue":null,"work_id":"ba7c3977-6d74-449e-94c1-1b02b7090629","year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.366281Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:4cafbaa783692ce1505f2796eb76d89d83591ea7eef20a15a2963856c0e5cad6","observation_id":"14353f41-7176-4593-b81a-5b9b4db3a407","resolution":{"observed_at":"2026-08-06T14:43:14.622860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21798","last_updated":"2025-05-21T17:21:45Z","snapshot_observed_at":"2026-08-11T02:21:44.551484Z","submitted_at":"2025-04-30T16:56:06Z","title":"SWE-smith: Scaling Data for Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21798","snapshot_observed_at":"2026-08-06T14:43:14.368798Z","title":"Jimenez, Alexander Wettig, Kabir Khandpur, Yanzhe Zhang, Binyuan Hui, Ofir Press, Ludwig Schmidt, and Diyi Yang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.368798Z"},"links":{"cited_paper":"/paper/2504.21798","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:09b5a37c6fcc8df87dcabfe09b515dc28509ce1f1d4e0e21baed901739c7229a","observation_id":"fece8940-7317-4167-8288-4c30d5e4ba22","resolution":{"observed_at":"2026-08-06T14:43:14.368798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.610740Z","title":null,"venue":null,"work_id":"7750fa4c-9c64-479b-94d0-de190590ac33","year":2017},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.371251Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:4a1bdd9e3df225bd9b6e81425e572d85dd308f84784bff937ca27f02ff3f1f79","observation_id":"ecae2225-2c4f-4d45-9c2e-e786af9b3f88","resolution":{"observed_at":"2026-08-06T14:43:14.613735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.602692Z","title":null,"venue":null,"work_id":"3343448a-1785-464f-8686-3b9d7abfa3d1","year":2009},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.373555Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:98341b836ca78d36dcbd19cac61008b2df50b6a2d29f3a48db4edef004918f32","observation_id":"e3544be7-c3e1-4be7-b1de-138886a7b9ee","resolution":{"observed_at":"2026-08-06T14:43:14.605333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-08-09T23:51:45.534260Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-06T14:43:14.376031Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.376031Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:6fb4ce240666b39d19c9ffe34596c49e28f4ec0f3689a732eac23134254fdab3","observation_id":"263468f8-5862-4328-befc-d9ebd881a351","resolution":{"observed_at":"2026-08-06T14:43:14.376031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14354","last_updated":"2024-08-26T15:30:05Z","snapshot_observed_at":"2026-08-10T18:57:19.903703Z","submitted_at":"2024-08-26T15:30:05Z","title":"SWE-bench-java: A GitHub Issue Resolving Benchmark for Java","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14354","snapshot_observed_at":"2026-08-06T14:43:14.378522Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.378522Z"},"links":{"cited_paper":"/paper/2408.14354","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:d09afc543c3e25975d9bd8cedda3f4286677286c73a9d9c93e853d3eb41c0771","observation_id":"e0ca7024-b7ec-4390-bc36-c3b0778c7dea","resolution":{"observed_at":"2026-08-06T14:43:14.378522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-06T14:43:14.380986Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.380986Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:a3331f0cdecbf97db252d80f8f66f0a0d2082658d7ec1c180ec5ad715a052245","observation_id":"6077e96b-8dbd-40f8-94f5-e2f0dd52f71c","resolution":{"observed_at":"2026-08-06T14:43:14.380986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.593713Z","title":null,"venue":null,"work_id":"d04b5023-ddc0-490b-9d9d-68c43ffd78ef","year":2024},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.383453Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:8efd804002a895c195d45c7ed775bfa535b5effff8965af3c4cc5a5f14575435","observation_id":"5f1dadeb-d6c6-48f7-954e-6512f906a516","resolution":{"observed_at":"2026-08-06T14:43:14.597165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:14.683272Z","title":"In Proceedings of the 29th International Conference on Intelligent User Interfaces","venue":null,"work_id":"5ec951ab-8792-402e-9f45-681241c363bf","year":null},"citing_paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:14.334990Z"},"links":{"citing_paper":"/paper/2507.18130"},"observation_digest":"sha256:413d0e967952ac71d23e1b5c01cfda17f8a73af4053a7bf51a8e233b1334c36f","observation_id":"4d1f2ff6-5169-46ec-98a8-f83355354aab","resolution":{"observed_at":"2026-08-06T14:43:14.686753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.18130","last_updated":"2025-08-18T15:26:59Z","latest_version":3,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-08T07:09:28.375868Z","submitted_at":"2025-07-24T06:38:19Z","title":"NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 6 inbound Pith citation observations for arXiv:2507.18130."}