{"as_of":"2026-08-14T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a7a8749cef1455517b6e02f359cbba3548d1f7e8038f99fd93ca3cc87da690c","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:40:26.135061Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T12:16:40.086291Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T12:17:52.011169Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"cited_work":{"arxiv_id":"2412.05288","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05288","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e9ec393e-31bb-4372-88bf-e60316654e93","year":2024},"citing_paper":{"arxiv_id":"2601.16456","last_updated":"2026-05-05T04:47:57Z","snapshot_observed_at":"2026-08-11T17:19:21.192202Z","submitted_at":"2026-01-23T05:28:48Z","title":"RubberDuckBench: A Benchmark for AI Coding Assistants","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T12:16:40.086291Z"},"links":{"cited_paper":"/paper/2412.05288","citing_paper":"/paper/2601.16456"},"observation_digest":"sha256:26e571ff672f39133ddd836b3ec6d8c4a85384ed210be29348cfe8c71d37a479","observation_id":"fc622f00-0f46-499d-bdff-6e8086ba1788","resolution":{"observed_at":"2026-05-16T12:17:52.012845Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.05288/citation-record","integrity":"/paper/2412.05288/integrity","json":"/paper/2412.05288/citation-record.json","paper":"/paper/2412.05288"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:27.016091Z","title":"Large Enough — mistral.ai","venue":null,"work_id":"c23bdd93-c5df-47ae-8461-c0b00908d2ff","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.853782Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:7a0dbbd3169c7d795b7a5ce8afe3ee9bc4847feaf14ac6e2583e7fdbe4a39510","observation_id":"65ea882b-0010-4620-a691-58eb41b566fb","resolution":{"observed_at":"2026-08-12T15:40:27.021130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.996702Z","title":"Mistral NeMo — mistral.ai","venue":null,"work_id":"7b776024-5fe0-45c7-94db-78eaaf697477","year":null},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.859644Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:c02599ba54ed04ed00e87096c262e92d3574f5163ece002ad2ec10f7f646ce26","observation_id":"eb39ff62-e240-4c65-bcc3-db7c736b27f1","resolution":{"observed_at":"2026-08-12T15:40:27.002993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.958240Z","title":"Introducing claude 3.5 sonnet","venue":null,"work_id":"f20a5442-1bf1-46b9-9ab9-84e1265ae781","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.875607Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:8de9aa38cc814f5159ea280d3560532a7a7c589495f8cbc5a55e52065e79e1ca","observation_id":"1a147000-5500-460a-9326-e888991e5421","resolution":{"observed_at":"2026-08-12T15:40:26.962868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.943890Z","title":"Introducing the Claude 3 family","venue":null,"work_id":"f30f717c-bae7-46ef-b55a-d82817c69eb0","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.883671Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:d68bd3638671d516e720310ef95684b3d6e5aa5d1146c505d967a5d8a84af461","observation_id":"fe80a1f8-817c-400b-b3e5-1522a3687d16","resolution":{"observed_at":"2026-08-12T15:40:26.948216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.928446Z","title":"Multi-lingual evaluation of code generation models, 2023","venue":null,"work_id":"46277a66-7598-4471-8ae9-73ca1e0d1a68","year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.892073Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:64eefd306a137dcc6a7c7639a028eb7958bb1830282da41054e997e596d61f73","observation_id":"f7e9907b-bf29-48b9-92f4-9d6ca1bc1b7b","resolution":{"observed_at":"2026-08-12T15:40:26.934080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.908164Z","title":"Program synthesis with large language models, 2021","venue":null,"work_id":"d4bf34cb-9ad6-4c9d-a754-980eb548b36f","year":2021},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.897567Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:ea90a03b56db77de927bd057d014cce93c840dfa5540f5b228ad5c8536825966","observation_id":"9955b0ad-c798-40a2-8461-f81f88692459","resolution":{"observed_at":"2026-08-12T15:40:26.915004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:25.905345Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.905345Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:1054e5e0d9f3224ecbe778e348729dc921cf65e06505fed4b3da3d4ed8c0d1c5","observation_id":"3f48137f-d357-4eba-bd06-e9a40f9847ae","resolution":{"observed_at":"2026-08-12T15:40:25.905345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:25.910185Z","title":"Multipl-e: A scalable and extensible approach to benchmarking neural code generation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.910185Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:312ebea381dfb55ab08b51a1097000d509f67c61d94cbfe5c2b43180bff7574c","observation_id":"d3f416a6-215b-4b7c-b368-d66d5ca48bc3","resolution":{"observed_at":"2026-08-12T15:40:25.910185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T15:40:25.915910Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.915910Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:8d7e24bba997e7e7c9702bbec46cd3a2052a08c3f540134fd69250114cdc2493","observation_id":"27331acb-5ca4-45c2-be37-545a66d1c496","resolution":{"observed_at":"2026-08-12T15:40:25.915910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:25.927162Z","title":"Meta large language model compiler: Foundation models of compiler optimization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.927162Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:a3402c5cfaf15732ce3df20599d5ab8232b2e2343c40f5345400b99161da9e7b","observation_id":"98b31dc7-6dff-425e-9575-9f36703bc96d","resolution":{"observed_at":"2026-08-12T15:40:25.927162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.839378Z","title":"Zhang, Hanwei Xu, Hao Yang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":"8904807f-ba87-4b56-a43a-8a679402d642","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.934298Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:c94a52e02daedf47679d65a6459dd69ee118a883186d65b9fb015cbb848dcde5","observation_id":"6da4e34c-5f15-483e-a404-b0731ef07ae9","resolution":{"observed_at":"2026-08-12T15:40:26.845959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.817154Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":"05a91959-f50c-484e-b56f-eaba792a9b68","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.939477Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:ea35c94d2860325166cfbbb1137a68ea7b66322ccb6807482e577c3003fa557f","observation_id":"239b3626-51c5-4bbc-bd90-7d9d37bfe464","resolution":{"observed_at":"2026-08-12T15:40:26.822923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-12T15:40:25.945175Z","title":"Length-controlled alpacaeval: A simple way to debias automatic evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.945175Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:b751560bbde6fa9fae9fa85777e36e537223f680166838d41b1bc10b9e908924","observation_id":"326cd81b-c638-4de3-982d-455e01fccca1","resolution":{"observed_at":"2026-08-12T15:40:25.945175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.799930Z","title":"Gemini 1.5: Unlocking multimodal under- standing across millions of tokens of context, 2024","venue":null,"work_id":"0bde96b4-64e5-46fd-ad7b-fff455c2e060","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.956859Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:8718859f3960c1617ad95308a4aab2acb9e4b5cce8e2701f9dbc4ba99f23f7be","observation_id":"491d141e-d9e8-409a-b7f1-e6a6d6bd7fa4","resolution":{"observed_at":"2026-08-12T15:40:26.805360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.779510Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":"3b3291ae-f472-4655-a6e7-442d82fcda37","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.962940Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:3ff72d6cd43389643ea667e6d4583f9135bcc8e8a5458f60b1d88f23e79b7222","observation_id":"db24aa86-8dec-47c9-97de-7b693e0bd739","resolution":{"observed_at":"2026-08-12T15:40:26.787116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.757731Z","title":null,"venue":null,"work_id":"34d74be3-9618-474c-be93-cabbab14d3b5","year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.967866Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:d70d7114674a97cce8baac96981edf78532396faaedf98db75fc06bd6cb31ede","observation_id":"a779f551-ce0a-488f-89d7-802581ee57c3","resolution":{"observed_at":"2026-08-12T15:40:26.766887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-12T15:40:25.972607Z","title":"Swe-bench: Can language models resolve real-world github issues? arXiv preprint arXiv:2310.06770, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.972607Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:80dde18d52c0a197f8bdfc6e3f1dad82792d0e09b6b2be4b971b50951b96d576","observation_id":"11c20530-8ee6-46ef-8a76-8b897cac8c57","resolution":{"observed_at":"2026-08-12T15:40:25.972607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01186","last_updated":"2023-02-17T12:57:15Z","snapshot_observed_at":"2026-08-13T14:33:48.764640Z","submitted_at":"2022-09-02T17:31:51Z","title":"Gravity theories with local energy-momentum exchange: a closer look at Rastall-like gravity","version":2},"cited_work":{"arxiv_id":"2209.01186","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.01186","snapshot_observed_at":"2026-08-12T15:40:26.181661Z","title":"Gravity theories with local energy-momentum exchange: a closer look at Rastall-like gravity","venue":"gr-qc","work_id":"b7418a5a-5eae-443c-930e-e132db15f7ed","year":2022},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.977597Z"},"links":{"cited_paper":"/paper/2209.01186","citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:7ef9cd28d4cf1cd01946a0f1101e2882ed8cc2319b027595e17888b797fc9678","observation_id":"13050429-d2e8-4a4d-b2be-0576d511c097","resolution":{"observed_at":"2026-08-12T15:40:26.197442Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:25.983311Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.983311Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:c20aed97e173c6ad9b3bccb8b039ba2319a6630eb129752597d216620a47c7b9","observation_id":"39595990-f61a-48b7-bd17-631d8b460e40","resolution":{"observed_at":"2026-08-12T15:40:25.983311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.714641Z","title":"Wildbench: Benchmarking language models with challenging tasks from real users in the wild, 2024","venue":null,"work_id":"f031c573-5e34-4015-ad42-eb711baca95a","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.990456Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:08ed34e81947d809e731e01c51e52b94d23ece3e830e729596c5344b5346e800","observation_id":"34100273-9e7b-415b-a52f-5ca3ea3a9665","resolution":{"observed_at":"2026-08-12T15:40:26.722743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:25.996802Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.996802Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:e670641fa5a75ccd830b4d0b2c13e65978bc8e38ebfec58c7019355c54f25535","observation_id":"84334a51-918d-4467-99dc-2f21a3097627","resolution":{"observed_at":"2026-08-12T15:40:25.996802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.688583Z","title":"llama-3_1-nemotron-70b-instruct | NVIDIA NIM — build.nvidia.com","venue":null,"work_id":"5c4ac8c6-f6f7-4b87-84f3-dfffafd8a3eb","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.004907Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:72cf54287c553b53d1f473d6e1b05218d84af499920f84bff358597c00330ec6","observation_id":"ba35ff5f-d32e-49f0-aa0b-933a916571b7","resolution":{"observed_at":"2026-08-12T15:40:26.695011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.672127Z","title":"New models and developer products announced at devday","venue":null,"work_id":"1b10b084-bc0d-4d85-80ad-08e31cde70ff","year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.010059Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:dd839aae48908ca9cc3a6676b8e3a8eee649578bb034cc784dc54d270bd8455c","observation_id":"a3894810-abc8-4ba5-a310-edc7c67c0e97","resolution":{"observed_at":"2026-08-12T15:40:26.678352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.651257Z","title":"Introducing openai o1-preview","venue":null,"work_id":"ed45091b-8772-4f14-96ba-5f2cb549c9a6","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.017756Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:9612c066ce015bc36f6a0bd4c82f45e41a593ed102c9ad07737ff1b8da94781f","observation_id":"f781adb2-fb6d-4d70-9618-fe232a51aea0","resolution":{"observed_at":"2026-08-12T15:40:26.659211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.627718Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":"472c8b21-5f02-4a64-bb52-cdb4e7acc3ef","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.024936Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:59f1a7a157284151d2d8cfd0dcf2bf6b759a44e541dbb11e2ba62090ab0b1bcb","observation_id":"2ccaf991-8a35-4cf0-9476-ebe78c2a8f53","resolution":{"observed_at":"2026-08-12T15:40:26.635690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.606758Z","title":"Stack overflow developer survey 2023, 2023","venue":null,"work_id":"e9dcb2be-a976-4fb3-89fb-9af2f5e5429d","year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.030417Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:88d1848cc8ed3c9a3ad3dd68f3dc274702b72c4b69dc435c7954b2a6c0f1f738","observation_id":"0d23d370-f193-49c8-8914-f59a7e7ee38a","resolution":{"observed_at":"2026-08-12T15:40:26.611296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.591858Z","title":"Bowman, and Shi Feng","venue":null,"work_id":"ebd43553-7171-4e43-ad06-f11be06181b8","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.035627Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:223eaa9ff971be1adcc786d991a8b36638850ae176f6363c42d293ad8d868237","observation_id":"a22ab879-8454-4b48-b730-fb885af3f4c7","resolution":{"observed_at":"2026-08-12T15:40:26.596482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.575390Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"dff05ca3-d8c4-459c-91bf-8b7496405466","year":2002},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.040480Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:3391f5b21f0d0615439025f9dc1de3f44820b596e8dc2fd4fdff286c7fc26265","observation_id":"8121e2be-55ef-4fca-9239-8d1caea92fab","resolution":{"observed_at":"2026-08-12T15:40:26.580488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.559329Z","title":"Can foundation models label data like humans? Hugging Face Blog, 2023","venue":null,"work_id":"2d0527f6-554f-47e6-bfb2-4baf6a7bb3ed","year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.044744Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:ac1eb5e1c127277f3388a2c33a89785904bae7105c737dd438c45b0236f75fe8","observation_id":"e08fd9d7-3279-47ed-97f0-7a3ae546050e","resolution":{"observed_at":"2026-08-12T15:40:26.564127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.049132Z","title":"Codebleu: a method for automatic evaluation of code synthesis, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.049132Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:539cb4899e8fa2d9745de7f7beebbc4e23fdf5a9e2def124c492a4310482652f","observation_id":"f0a70ca9-41ec-4b19-80bf-3a37129838b0","resolution":{"observed_at":"2026-08-12T15:40:26.049132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.053117Z","title":"Code llama: Open foundation models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.053117Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:b131b6ac27100f04b7dc7821f920434f8fa8d9df509acc0f12a63af9d7fa04f3","observation_id":"15a40489-797b-4e54-802a-abc3cc7091a7","resolution":{"observed_at":"2026-08-12T15:40:26.053117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.057338Z","title":"Learning performance-improving code edits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.057338Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:87812b2c18879cb3de0f72ac61bbd9306ee5bb79de9b85bca843f2b5ce5d14e3","observation_id":"570a897c-4658-4730-a51e-d66550d74b03","resolution":{"observed_at":"2026-08-12T15:40:26.057338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.508131Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters, 2024","venue":null,"work_id":"3f1d084b-d94d-41c4-800c-444210a05d29","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.062816Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:e59389ab10bcf537bc91091f7410ce1f1a6b16cdd93402876a57f38a90e6c238","observation_id":"cd168baa-b7fd-4c41-9c10-f9f7262830ec","resolution":{"observed_at":"2026-08-12T15:40:26.513131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.490178Z","title":"Large language models are incon- sistent and biased evaluators, 2024","venue":null,"work_id":"2a57ddad-8d98-4c01-9072-3c0e081c735f","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.066823Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:708b86d4779f7b408a35ae48f312e708b28171209140d584eaaf6a4a6f40fb0a","observation_id":"f81df30c-5256-4881-bd7c-5931704dfb26","resolution":{"observed_at":"2026-08-12T15:40:26.495780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.071690Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.071690Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:b515dd46e0e5525ac24f757d0593e7bfc8c3640217acd948ae155bc1dc75f5ce","observation_id":"51221124-dbaf-4b49-b581-fc16bf209623","resolution":{"observed_at":"2026-08-12T15:40:26.071690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.075618Z","title":"Large language models are not fair evaluators, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.075618Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:ac886be3bf6397dfcd1dfe042c6241f50a8767344f708bc3e1046b26d2979d4a","observation_id":"cee711e6-e6fd-4bd1-ad52-1cae2075a15b","resolution":{"observed_at":"2026-08-12T15:40:26.075618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.079768Z","title":"Chain-of-thought prompting elicits reasoning in large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.079768Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:25b044abcb85323da944c4e84c0772943cffe68f95d828fda8f5ea69df84f665","observation_id":"92befad6-f4ef-492e-9024-98f8a240e561","resolution":{"observed_at":"2026-08-12T15:40:26.079768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.434266Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","venue":null,"work_id":"dfb2bfb8-67eb-452a-95e5-2c45cc65d434","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.085086Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:2c00deb839cd9d0b91d76b543b6fcba462cecada20389e0d4162d628d671d023","observation_id":"77c2d629-eeb8-4fe8-9ca6-0763a77477b3","resolution":{"observed_at":"2026-08-12T15:40:26.440778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.404800Z","title":null,"venue":null,"work_id":"c2d4cba7-c597-42fe-83a9-ae0404f63864","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.089419Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:74156ea733340a7acbed64ac0cf3c1b31d7fb37ddd9d6cd12fbf2e6b887d2cd5","observation_id":"a1d42979-98cb-4d31-a0d5-17d9b4888b15","resolution":{"observed_at":"2026-08-12T15:40:26.411116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.383936Z","title":"Thinking before speaking: A role-playing model with mindset, 2024","venue":null,"work_id":"6b349e36-f583-4c34-846e-2b3b36196a8c","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.094463Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:5951d09573fcc1cef06b1a209fc2ab12e08ed38c88fb840771286932bff794fd","observation_id":"16d73fa3-9b9b-4519-a766-6012279b1f9f","resolution":{"observed_at":"2026-08-12T15:40:26.392289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.098783Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.098783Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:7f80a28d1efd6244bbeb2c0c0a5d549d943e067fad8b42529c1b9570f704ef29","observation_id":"5e3b4a28-d257-4bb5-ba59-0c1d21dbc2e0","resolution":{"observed_at":"2026-08-12T15:40:26.098783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.343554Z","title":"Codegeex: A pre-trained model for code generation with multilingual evaluations on humaneval-x, 2023","venue":null,"work_id":"376d835c-a4ac-43bd-8bad-233030202742","year":2023},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.104062Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:8cf95f93ce1733cf2d13bf3c92dc788fa5efb7037a300902256590428d334d0f","observation_id":"1c9a51e0-32ed-4afe-97e2-6b7a6c360bb1","resolution":{"observed_at":"2026-08-12T15:40:26.350514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.326022Z","title":null,"venue":null,"work_id":"4af1bfd3-2db1-4736-b515-c7f3450d7991","year":null},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.109316Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:399ed32ca251114af114f0841a9a86516904ef29bfe476cea7a128b5ac78d698","observation_id":"23f00ec4-0965-41c1-aa23-b3baf7879777","resolution":{"observed_at":"2026-08-12T15:40:26.331682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.307029Z","title":null,"venue":null,"work_id":"69af5f43-cdf1-44c4-80c9-20c6855d269a","year":null},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.117338Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:1baeb881ed9e2adf16337c7f7230fb8b408e3626347ab75e3efa7c0eee327d79","observation_id":"d909a09e-781d-47c6-8879-446dbee3b482","resolution":{"observed_at":"2026-08-12T15:40:26.316220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.290369Z","title":null,"venue":null,"work_id":"65c1fb82-92f6-4a2d-8dc0-fe19a9ce6212","year":null},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.127631Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:d0bafe07499384b93b9ee80ff8a9de2307b224f0446cf165d7ba4921597ace0a","observation_id":"5b865bf3-50b7-4e3e-a9f5-06ea51dfbac5","resolution":{"observed_at":"2026-08-12T15:40:26.295482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.267510Z","title":"questionAnalysis","venue":null,"work_id":"3069fafe-51bc-41b4-a0d0-82619d2d4410","year":null},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:26.135061Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:4fe1bd3d7a854fb6f6fb4f0a3c77b7cfab9fc519434cc0c640aaea52932185c2","observation_id":"e1129173-6bcf-44be-b3c3-76a9cb51f359","resolution":{"observed_at":"2026-08-12T15:40:26.275429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:40:26.972646Z","title":null,"venue":null,"work_id":"8aefff46-36ed-40a2-9d32-db14ee626808","year":2024},"citing_paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:25.867499Z"},"links":{"citing_paper":"/paper/2412.05288"},"observation_digest":"sha256:8793ed3d6d011b6e7ece7999af41566d308f15661584d2304cf0f3520e5be58a","observation_id":"6718e648-5e30-405d-b1b8-58c346afb64c","resolution":{"observed_at":"2026-08-12T15:40:26.981076Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.05288","last_updated":"2024-11-21T11:20:48Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-12T15:34:39.711405Z","submitted_at":"2024-11-21T11:20:48Z","title":"StackEval: Benchmarking LLMs in Coding Assistance"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":20,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2412.05288."}