{"as_of":"2026-08-13T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85478b835e095e209d9bb7fa1e2aaf2104fd563a32b64fd5211ce99eea7cca1c","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:46:20.720359Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17927/citation-record","integrity":"/paper/2411.17927/integrity","json":"/paper/2411.17927/citation-record.json","paper":"/paper/2411.17927"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.229907Z","title":"Emergent abilities of large language models,","venue":null,"work_id":"663d375e-1e23-4515-bfe7-6bfcfd9c58d3","year":2022},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.629809Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:5a474f47ff47b8d663f40ea62e6f7a1f42475a30641f4d5609ec6cbdc8a5367b","observation_id":"416a0a09-8e82-45ef-8f66-1d9a829c47e1","resolution":{"observed_at":"2026-08-12T11:46:21.235060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05129","last_updated":"2023-02-13T22:22:47Z","snapshot_observed_at":"2026-08-04T20:40:33.811426Z","submitted_at":"2022-12-09T22:10:46Z","title":"Measuring Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05129","snapshot_observed_at":"2026-08-12T11:46:20.635199Z","title":"Measuring Data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.635199Z"},"links":{"cited_paper":"/paper/2212.05129","citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:6f1e6fc76090d2105d8be86176f000668e63114f4fc667bd15fd71176376eb8e","observation_id":"5bc978b2-c081-4760-a448-9185af02ba53","resolution":{"observed_at":"2026-08-12T11:46:20.635199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.215040Z","title":"Codegen: An open large language model for code with multi-turn program synthesis,","venue":null,"work_id":"ccf7d02c-ec9a-4d61-a96e-993339f5b5d6","year":2023},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.640309Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:a14856831839fef0d85f0c287acdf4e9f3bcd1323e3a49b6badb6a02422a5573","observation_id":"61a3bf9a-5e2c-4cbc-a950-ebcc70b0facc","resolution":{"observed_at":"2026-08-12T11:46:21.219840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.199928Z","title":"Codegen2: Lessons for training llms on programming and natural languages,","venue":null,"work_id":"7bc6c9eb-b289-4690-9a9c-7c78e66193a1","year":2023},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.644399Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:bef022d4c74fc14dc1476ad763660aaa3550a6524a13ac10ff14689228bb2dd1","observation_id":"711e452f-e0a4-4044-a102-69c20d0a9b10","resolution":{"observed_at":"2026-08-12T11:46:21.204675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.184155Z","title":"Are emergent abilities of large language models a mirage?","venue":null,"work_id":"608cc095-738e-4861-8e8a-51c8badd2c49","year":2023},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.648696Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:d65e0cdcba0364577156d927ea38ec169b93d97bbe5a810cccb5a5002ae7da23","observation_id":"668ce3b1-fe11-4e53-8a0a-79854a11e0d2","resolution":{"observed_at":"2026-08-12T11:46:21.188892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.168111Z","title":"Are emergent abilities in large language models just in-context learning?","venue":null,"work_id":"ac777bcb-7c31-4da1-b195-f4dbd1f9e6bb","year":2023},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.652847Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:0fd1e3ac0bce749587f8f552acecebf3deac2e3c04f046e621cfae5c0e5feefc","observation_id":"0c6cc93c-b5de-42ef-96f5-49d776dd93db","resolution":{"observed_at":"2026-08-12T11:46:21.173138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.152820Z","title":"Beyond the imitation game: Quantify- ing and extrapolating the capabilities of language models,","venue":null,"work_id":"c436e93a-4547-4023-ac7e-c0221e4a1472","year":2023},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.657440Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:fb18d152ddc40ebf689cf266d3aeb157308e0a6363db250a654342690856d691","observation_id":"60f56d2f-ec20-49d0-9401-6fff90858473","resolution":{"observed_at":"2026-08-12T11:46:21.157271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.138103Z","title":"Beyond accuracy: Behavioral testing of nlp models with checklist,","venue":null,"work_id":"68df39b6-80dd-4a9c-8a59-ba0f90d17e40","year":2020},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.662185Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:48f4b0333e35448ada474fb055b47d430fc534f0b3f4638811050fe6e3b41743","observation_id":"b83ed9ba-fb9c-4d6d-ba85-8e463f8b74a7","resolution":{"observed_at":"2026-08-12T11:46:21.142687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:20.666642Z","title":"A Structured Review of the Validity of BLEU,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.666642Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:ef8676fe9afeefc01c798ce3a33d474280cfb70c317ecdab33dc0aedfc8c0d8c","observation_id":"f5abe65a-cb60-4d74-a6e0-bb1042d0500e","resolution":{"observed_at":"2026-08-12T11:46:20.666642Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.122848Z","title":"ORANGE: a method for evaluating automatic evaluation metrics for machine translation,","venue":null,"work_id":"5fb475ac-cccb-47bd-9fb7-bc3a3407a741","year":2004},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.671240Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:5d1ce10b0a26069b95c9aa34ae91edbe98f650e66700e1e7967c2395728168b6","observation_id":"59fd066c-88d0-4a62-adbb-23a430fbfd9c","resolution":{"observed_at":"2026-08-12T11:46:21.127455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.105849Z","title":"Codebleu: a method for automatic evaluation of code synthesis,","venue":null,"work_id":"5cb1a07d-aad7-4c8e-8a26-28b65235c7b3","year":2020},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.675622Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:fa40a25b80aab96da932fda6f244ae064ff2ecf1c20b6d581e0c6af6ed7b7faf","observation_id":"e9d362b6-e235-47ec-9ee4-4f28c95c61ec","resolution":{"observed_at":"2026-08-12T11:46:21.111813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.089821Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":"fe2a561e-9249-46fe-b58a-ce4958356784","year":2002},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.679900Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:72a898287397864b2b1835fc0cbb6d93247ea9d43710210f29ad486820eb1b3e","observation_id":"b9992ad7-473d-4397-92b5-725acb4cd55b","resolution":{"observed_at":"2026-08-12T11:46:21.094623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-07-06T10:39:42.676631Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-12T11:46:20.684520Z","title":"Codexglue: A machine learning benchmark dataset for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.684520Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:38fda9cbc7d15d287c33e23c11699b558f167cd797adca784080b2cf78988719","observation_id":"5b8c493f-07b1-42b4-83ba-283f5fffc07c","resolution":{"observed_at":"2026-08-12T11:46:20.684520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.074197Z","title":"Pypi/k4black/codebleu,","venue":null,"work_id":"acab9701-c32e-4c81-9eec-ddf4d7732b23","year":2024},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.689247Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:1a61aec0abadccaef828042a6a99714283fd20178ac74f68f3bcd273432efb92","observation_id":"4674ae1c-6d29-474e-84dc-8053821ecbf2","resolution":{"observed_at":"2026-08-12T11:46:21.078945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2019/552","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:20.761095Z","title":"Commit message generation for source code changes,","venue":null,"work_id":"935ae197-2458-405d-bb75-fdea1db55e94","year":2019},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.693722Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:e1db6f65eceec6877c217e577727b091c07266eff91266da743f76a98d2d8905","observation_id":"b18a490e-abf3-40d8-95a8-6e2dbbca4656","resolution":{"observed_at":"2026-08-12T11:46:20.766944Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.057886Z","title":"Using large language models for commit message generation: A preliminary study,","venue":null,"work_id":"6410f318-8395-4431-8ba9-840e315c66e2","year":2024},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.698369Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:89b6ea25af124f92c1a62f5ecb6808b9b99c975a35b76f8051f5865ecf713d74","observation_id":"5577396c-4775-498a-b4ba-2dc8edd8f87b","resolution":{"observed_at":"2026-08-12T11:46:21.062819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"docview/3106577","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:20.974830Z","title":"Emergent capabilities of LLMs for software engineering,","venue":null,"work_id":"87ac9b82-465a-4db9-9674-f547ed599645","year":2024},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.702787Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:f3c8fb0fafed54be7d08a0d51438f483144730973d93d9ceb7d09d16e11cb155","observation_id":"8529a88b-818d-46be-844e-261a1e4fd7fb","resolution":{"observed_at":"2026-08-12T11:46:20.982681Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.042144Z","title":"On the evaluation of commit message generation models: An experimental study,","venue":null,"work_id":"a83301d4-f192-4807-b71e-b8ca6a1476dc","year":2021},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.707149Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:7f0d23289d120d047f5feb637f09a14902741e447f71d912573e055ddc642a68","observation_id":"aa2e705e-ee08-4f5c-b3d3-af45a455abbc","resolution":{"observed_at":"2026-08-12T11:46:21.046873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:20.711526Z","title":"On the dangers of stochastic parrots: Can language models be too big?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.711526Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:6076ce1a1a31911db2d4968b1a0ec7d302cf5b050eadb08cce4043df8939f791","observation_id":"c5ed9eb3-ab0f-4eeb-b045-b066387e313b","resolution":{"observed_at":"2026-08-12T11:46:20.711526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:20.715940Z","title":"Detecting emergent intersectional biases: Contextualized word embeddings contain a distribution of human-like biases,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.715940Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:ba2dc722c6a59efe09d19ba9cf314d449bc2ac30d84e6d5c6762826f05e0b905","observation_id":"5a61fe14-d7c4-4141-bbcf-41c14aea55bc","resolution":{"observed_at":"2026-08-12T11:46:20.715940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:46:21.025957Z","title":"Social biases in NLP models as barriers for persons with disabilities,","venue":null,"work_id":"449cee95-0cdf-46b2-b60b-9f930403a3db","year":2020},"citing_paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:46:20.720359Z"},"links":{"citing_paper":"/paper/2411.17927"},"observation_digest":"sha256:dd4abb8b1d4dd3c1118593945e03e6290b412d303eda4ad34dcbccd205ea5023","observation_id":"a9fe2d3b-8c2d-4803-b330-362a36cf7ccc","resolution":{"observed_at":"2026-08-12T11:46:21.031613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17927","last_updated":"2024-11-26T22:48:55Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-13T07:21:13.176776Z","submitted_at":"2024-11-26T22:48:55Z","title":"Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2411.17927."}