{"as_of":"2026-08-16T03:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf149262270721bce9bc65cec8eb6d723eb082511860a093af059e3667d82bf9","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:48:10.705158Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04195/citation-record","integrity":"/paper/2608.04195/integrity","json":"/paper/2608.04195/citation-record.json","paper":"/paper/2608.04195"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.09610","last_updated":"2022-09-13T15:07:00Z","snapshot_observed_at":"2026-08-15T20:40:40.213866Z","submitted_at":"2021-10-18T20:13:38Z","title":"A Survey on Machine Learning Techniques for Source Code Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.09610","snapshot_observed_at":"2026-08-15T14:48:10.420271Z","title":"A survey on machine learning techniques for source code analysis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.420271Z"},"links":{"cited_paper":"/paper/2110.09610","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:3b630ef3f3600c0824748c93b977a35fd4cf238e4c211f69ce7b17eca60b9932","observation_id":"2a5364de-c8d9-4ebf-80a8-77fd376c18a6","resolution":{"observed_at":"2026-08-15T14:48:10.420271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07959","last_updated":"2025-08-23T15:44:13Z","snapshot_observed_at":"2026-08-15T03:48:06.226009Z","submitted_at":"2024-07-09T05:48:42Z","title":"Source Code Summarization in the Era of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07959","snapshot_observed_at":"2026-08-15T14:48:10.425655Z","title":"Source code summarization in the era of large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.425655Z"},"links":{"cited_paper":"/paper/2407.07959","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:05ff9f57cb01748748c5f7bb278724c9f0278f0da742e1c87704e0b725dd523d","observation_id":"e7c1857b-f3c4-434d-9108-6cc2fb0e5aed","resolution":{"observed_at":"2026-08-15T14:48:10.425655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.430348Z","title":"Calibration of large language models on code summarization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.430348Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:11a2ce436bafb24365d7c9c50d4236fd7b0f1f910d2ddfd8768b21481fee32c9","observation_id":"24a31dbc-54d4-40a1-bb98-6170e2447382","resolution":{"observed_at":"2026-08-15T14:48:10.430348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.434658Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.434658Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:671763afde976e481523c6758e486117ab4cee8b695f86ea7d4234576e4ef86e","observation_id":"e467b685-37d5-4066-9ade-8a4c18d8f3f7","resolution":{"observed_at":"2026-08-15T14:48:10.434658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3660769","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.793607Z","title":"Simllm: Calculating semantic similarity in code summaries using a large language model-based approach,","venue":null,"work_id":"4f4d5069-89b7-40bc-b865-f45e70e1ac05","year":2024},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.438848Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:68c281b882378e61df6ed01449bdba4fe4d15e18ba8a95dd1dea89b7d528d486","observation_id":"249460e6-b777-4ce6-ae1b-0cd156886b96","resolution":{"observed_at":"2026-08-15T14:48:10.797591Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15475","last_updated":"2023-12-24T13:12:39Z","snapshot_observed_at":"2026-08-13T04:54:31.916402Z","submitted_at":"2023-12-24T13:12:39Z","title":"Evaluating Code Summarization Techniques: A New Metric and an Empirical Characterization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15475","snapshot_observed_at":"2026-08-15T14:48:10.443137Z","title":"Evaluating code summarization techniques: A new metric and an empirical characterization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.443137Z"},"links":{"cited_paper":"/paper/2312.15475","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:ff348ca25e67c26ad853c8c3863f09309bfb985cd612e28a422526d552198c1d","observation_id":"c01bcd49-f3ab-4bb8-975e-83997036b19e","resolution":{"observed_at":"2026-08-15T14:48:10.443137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.552927Z","title":"METEOR: An automatic metric for MT evaluation with improved correlation with human judgments,","venue":null,"work_id":"74907ea7-4288-440e-9700-10783fdbfaee","year":2005},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.448262Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:1ea075e2f851ae63ba887775c4f6ad4ead3e7e7a9b6a50a5ff9d42c47065aca3","observation_id":"f9c3d10e-7d02-4132-9d0d-e996ad291bf1","resolution":{"observed_at":"2026-08-15T14:48:12.563284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.533988Z","title":"Rouge: A package for automatic evaluation of summaries,","venue":null,"work_id":"c2024c09-28df-42a4-a16d-6aaf4fbd8270","year":2004},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.451832Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:e1ad74948c17d2be8b4f26bb923241edd8f67e860ecd53be41b704e6d789e038","observation_id":"632d443d-ae30-4dbf-8841-b1a670c4353a","resolution":{"observed_at":"2026-08-15T14:48:12.540097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16587","last_updated":"2025-07-22T13:40:26Z","snapshot_observed_at":"2026-08-15T08:59:58.423419Z","submitted_at":"2025-07-22T13:40:26Z","title":"On the Effectiveness of LLM-as-a-judge for Code Generation and Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16587","snapshot_observed_at":"2026-08-15T14:48:10.455446Z","title":"On the effectiveness of llm-as-a-judge for code generation and summarization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.455446Z"},"links":{"cited_paper":"/paper/2507.16587","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:8213c206126302b952ea5c999a5d33cddd6b363885305166f49bfc689d6aa1fa","observation_id":"5073aef9-4247-4b5d-ae4a-780ea613824a","resolution":{"observed_at":"2026-08-15T14:48:10.455446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.514283Z","title":"Can large language models serve as evaluators for code summarization?","venue":null,"work_id":"dabf0dab-428b-4012-8083-37823c084f01","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.459624Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:b8de0dc122ff838c39ecd4cebcdaaa0360107b1180fd476a3e5c61e05150cf2a","observation_id":"1510a3ee-8bfb-4415-b560-02723184fd7c","resolution":{"observed_at":"2026-08-15T14:48:12.519395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.495938Z","title":"Artificial intelligence for software engi- neering: The journey so far and the road ahead,","venue":null,"work_id":"2264875b-6b9e-4770-95f5-96b076e2aa6f","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.463363Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:49922b432819681215c99e34ca84310dfba32a809edeb3d9dfa65b28b31581f0","observation_id":"20847f32-47e3-4c45-8f48-d2443ae49378","resolution":{"observed_at":"2026-08-15T14:48:12.500826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-15T09:29:24.626239Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07611","snapshot_observed_at":"2026-08-15T14:48:10.467087Z","title":"Optimizing datasets for code summarization: Is code-comment coherence enough?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.467087Z"},"links":{"cited_paper":"/paper/2502.07611","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:75c1b09c5f3d635ca306d092d25fa4db4213ecd7856f95c88142414e8aa21d1c","observation_id":"17dc11db-f503-49d2-b6fd-3274f34faf77","resolution":{"observed_at":"2026-08-15T14:48:10.467087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.479180Z","title":"Unicor: Modality collaboration for robust cross-language hybrid code retrieval,","venue":null,"work_id":"05e37e4b-2051-4534-aebb-d621d8d210da","year":null},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.470872Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:8b18b9251639fa33aedc24a00fd1f512b79f075b9d34f864e909d0cdc7ef0ded","observation_id":"1c3fb1ff-5922-41c9-8b18-197625bd6690","resolution":{"observed_at":"2026-08-15T14:48:12.483474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.479562Z","title":"Doc2oracll: Investigating the impact of documentation on llm-based test oracle generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.479562Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:d29ac37f0282860bf44e735b8a962b717aa051427760242ec0848d133dd45e05","observation_id":"4271ddf4-6e6c-4785-8503-b6ed8ca27834","resolution":{"observed_at":"2026-08-15T14:48:10.479562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.465874Z","title":"Nl in the middle: Code translation with llms and intermediate representations,","venue":null,"work_id":"ecaef6b9-3769-4415-9e99-27df9d624b69","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.484605Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:e47ee4313a34b65f49a5c0374845da982ad95350564ce9b0719b17dc86eb6e89","observation_id":"d670c376-5279-4293-96a2-7ee47f91e977","resolution":{"observed_at":"2026-08-15T14:48:12.470163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.451097Z","title":"Summarize and generate to back-translate: Unsupervised translation of programming languages,","venue":null,"work_id":"37c5247a-a838-428d-8bac-8b33bd8782b8","year":2023},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.488537Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:253d5ef09dba303b948ff2be00d5b11a7fe4afd5a328e72f881a47533d9b5b90","observation_id":"cab6f69e-f4bd-4629-b164-bc33b76231b3","resolution":{"observed_at":"2026-08-15T14:48:12.455933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.437200Z","title":"Unsupervised evaluation of code llms with round-trip correctness,","venue":null,"work_id":"f75c5de8-6635-47e1-b585-c832f980b285","year":2024},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.494286Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:84784e9add0a656cc65e730e3ade27f1eee2e572c8237873dd1fe0bf8ca1cd27","observation_id":"ec3592b6-89a5-4021-bb67-473e2cbf60e2","resolution":{"observed_at":"2026-08-15T14:48:12.441421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19392","last_updated":"2025-05-26T01:16:41Z","snapshot_observed_at":"2026-08-13T15:02:04.141497Z","submitted_at":"2025-05-26T01:16:41Z","title":"Simple and Effective Baselines for Code Summarisation Evaluation","version":1},"cited_work":{"arxiv_id":"2505.19392","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.19392","snapshot_observed_at":"2026-08-15T14:48:11.924963Z","title":"Simple and Effective Baselines for Code Summarisation Evaluation","venue":"cs.CL","work_id":"14fcc6e0-5a3f-4917-ba9a-665c59bf1851","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.498400Z"},"links":{"cited_paper":"/paper/2505.19392","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:53a2e055b5d34030a8b25fad85efc297cf84e9319f038bedd26c69773e62d61a","observation_id":"97a82b6d-6048-4548-9343-8fb8b41ce3cd","resolution":{"observed_at":"2026-08-15T14:48:11.929428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14053","last_updated":"2024-02-26T18:56:08Z","snapshot_observed_at":"2026-08-13T05:44:03.907426Z","submitted_at":"2023-10-21T16:14:56Z","title":"Beyond Accuracy: Evaluating Self-Consistency of Code Large Language Models with IdentityChain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14053","snapshot_observed_at":"2026-08-15T14:48:10.503740Z","title":"Beyond accuracy: Evaluating self-consistency of code large language models with identitychain,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.503740Z"},"links":{"cited_paper":"/paper/2310.14053","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:b7e1957646b84bac6ac8e76be31f30eec0bea6401d38c056c44d0d4c4acbce3a","observation_id":"c7e6f3d9-374f-4b16-82ee-1c1de32151e2","resolution":{"observed_at":"2026-08-15T14:48:10.503740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.507937Z","title":"Reassessing automatic evaluation metrics for code summarization tasks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.507937Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:abe621aeb809ef0169aa3959aadc10595a7217147a2d8e06f1bc5978a4eb5d4b","observation_id":"4b25ac53-e860-426b-9625-ed4ffb4adaea","resolution":{"observed_at":"2026-08-15T14:48:10.507937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.511860Z","title":"Bertscore: Evaluating text generation with bert,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.511860Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:c7b5886015b499d89360b11c0e2cc3131f19d04f1dda692f4e410c052786c87c","observation_id":"ec53721d-ec47-4a8b-b52f-3c034f892e23","resolution":{"observed_at":"2026-08-15T14:48:10.511860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.414510Z","title":"Bleurt: Learning robust metrics for text generation,","venue":null,"work_id":"1b2e26cb-200d-40d4-aaf1-795998dfe824","year":2020},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.516372Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:02595cb8575887e71439f7034e671854f50c546956daa239d82d6a5fab1c10a0","observation_id":"e52ba98f-8fb6-47c1-94c9-5a62aaac74b8","resolution":{"observed_at":"2026-08-15T14:48:12.418960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-15T14:48:10.520657Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.520657Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:6c1c1fbf029e793c620657ab8ccae96f11108f7308fe90ccc05f88579e253d98","observation_id":"0d1cfdcd-1a8c-42e8-beef-ed5667339cac","resolution":{"observed_at":"2026-08-15T14:48:10.520657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.525983Z","title":"A large-scale empirical study on code-comment inconsistencies,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.525983Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:325af8369005d4a2bfdbf3f88b7f7353ce6a5240a194ef62ea19d22a2aafaa4d","observation_id":"0b6a3606-a82f-400c-8c07-00f854b923b5","resolution":{"observed_at":"2026-08-15T14:48:10.525983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21161","last_updated":"2025-04-29T20:23:56Z","snapshot_observed_at":"2026-08-07T15:58:03.239138Z","submitted_at":"2025-04-29T20:23:56Z","title":"Automated Test Generation from Program Documentation Encoded in Code Comments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21161","snapshot_observed_at":"2026-08-15T14:48:10.530326Z","title":"Automated test generation from program documentation encoded in code comments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.530326Z"},"links":{"cited_paper":"/paper/2504.21161","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:25bf24570dfe2a7f15918627e1893cabfb5fa6b2f53551c2690b2703128061de","observation_id":"a01a08b5-d30e-4446-a03e-22be3ce95331","resolution":{"observed_at":"2026-08-15T14:48:10.530326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.534524Z","title":"Automatic generation of oracles for exceptional behaviors,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.534524Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:373225963688ac444494a933ed48c4b3b1e30e89846d8ceba89db6dbfc728676","observation_id":"a8cac817-34a1-42b0-ac37-4b52b71e8d5c","resolution":{"observed_at":"2026-08-15T14:48:10.534524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1049/sfw2.12060","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.770021Z","title":"An approach of method-level bug localization,","venue":null,"work_id":"0e67a25f-26b3-41b6-8ca0-ad93579e1419","year":2022},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.538309Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:8416cc8b2b7ef5d621149106f4df443bb9b4446a02a639341ae46dff4c221768","observation_id":"bbc6b428-fd31-423e-9af4-490a80fba0ee","resolution":{"observed_at":"2026-08-15T14:48:10.773762Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.05908","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:11.642067Z","title":"Natural language summarization enables multi-repository bug localization by llms in microservice architectures,","venue":null,"work_id":"74705a63-44c4-4a13-b127-eda5e24adfa6","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.543095Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:874f37fec7f6dfe8b902084f2ba037631327d0ad136b465acbd9a5bdca691179","observation_id":"1422a61c-dd28-4eeb-81b5-11e652ccec76","resolution":{"observed_at":"2026-08-15T14:48:11.650503Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15885","last_updated":"2025-03-20T06:14:26Z","snapshot_observed_at":"2026-08-09T02:51:35.237618Z","submitted_at":"2025-03-20T06:14:26Z","title":"Human or LLM? A Comparative Study on Accessible Code Generation Capability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15885","snapshot_observed_at":"2026-08-15T14:48:10.547183Z","title":"Human or llm? a comparative study on accessible code generation capability,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.547183Z"},"links":{"cited_paper":"/paper/2503.15885","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:7ebbf5f58b1daac0a6ca4d6f8324acd2b7b8bbbe7ef0f2fda1e6fd96dfaba253","observation_id":"d05e6474-fb21-4f8b-b498-e51b8768e2b4","resolution":{"observed_at":"2026-08-15T14:48:10.547183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.551314Z","title":"Inside out: Uncovering how comment internalization steers llms for better or worse,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.551314Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:5babd4d7efcadd36a8ee84de35fe69cf27346bd6400fe990e62c954536e5a206","observation_id":"f683f13f-b940-49cd-a3de-cd2a417628cb","resolution":{"observed_at":"2026-08-15T14:48:10.551314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.555599Z","title":"Analyzing and mitigating surface bias in code evaluation metrics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.555599Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:e077fd5f58e4b124f3212527bf57aeab545be5b96df0987c899ccfc5b3c1a5cc","observation_id":"b9232efc-9246-4b28-bdcf-17ca231b3d92","resolution":{"observed_at":"2026-08-15T14:48:10.555599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15761","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:11.384370Z","title":"A differential fuzzing-based evaluation of functional equivalence in llm-generated code refactorings,","venue":null,"work_id":"ec87c1f4-4773-4f0d-a536-a7168b502f8f","year":2026},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.559976Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:d5fa12f96df605d2e398214d442b9aba9d4009c4c733d6b968079a60475681ec","observation_id":"372dfcb4-14d2-41c0-9aef-0457d822a29d","resolution":{"observed_at":"2026-08-15T14:48:11.395313Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-12T14:26:33.940158Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-15T14:48:10.565089Z","title":"Codebleu: a method for automatic evaluation of code synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.565089Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:72afd2882bf8c68b2defb4beab1ba107f2ba0d2f2f4db639190ab47182bc79f3","observation_id":"613ec06b-4d60-4a14-bdaf-d94dba481623","resolution":{"observed_at":"2026-08-15T14:48:10.565089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09436","last_updated":"2020-06-08T09:09:28Z","snapshot_observed_at":"2026-08-15T20:39:17.343191Z","submitted_at":"2019-09-20T11:52:45Z","title":"CodeSearchNet Challenge: Evaluating the State of Semantic Code Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09436","snapshot_observed_at":"2026-08-15T14:48:10.569101Z","title":"Codesearchnet challenge: Evaluating the state of semantic code search,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.569101Z"},"links":{"cited_paper":"/paper/1909.09436","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:55c7ed07508e3d5d4611cb165ef93a41b5d15c98935469d8172c3a633f8389ac","observation_id":"a447d867-b78b-48f9-afa1-22a4186cf002","resolution":{"observed_at":"2026-08-15T14:48:10.569101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.573196Z","title":"A neural model for generating natural language summaries of program subroutines,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.573196Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:a0eea288188cb5a4c4378c187d504e5a7934414c6d18147a4bdafc4b643f52aa","observation_id":"d7dff7d7-4b4f-429b-a22f-5babdf5cd078","resolution":{"observed_at":"2026-08-15T14:48:10.573196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.400966Z","title":"Joern - the bug hunter’s workbench,","venue":null,"work_id":"77ee47df-a2cb-43c4-80d9-a6d7e0c080a1","year":2026},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.576754Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:17c354dc0f06a66a87edc1656ae91759ab5e50069480f2a6ed07729f557854e9","observation_id":"bc3a79a4-51de-46e4-b1e7-9a8f829a0fce","resolution":{"observed_at":"2026-08-15T14:48:12.405433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.389816Z","title":"Deep learning code fragments for code clone detection,","venue":null,"work_id":"500746ea-5315-4b58-8f09-cba4103d9e3b","year":2016},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.581007Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:72d5a964c6f241d6540ace1459afd6a2375b464c94573db94b0200193d90586e","observation_id":"8053ac61-111a-463e-bc3d-dee563edcc73","resolution":{"observed_at":"2026-08-15T14:48:12.393390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.378357Z","title":"Supervised deep features for software functional clone detection by exploiting lexical and syntactical information in source code,","venue":null,"work_id":"ecf31fb1-1d42-4854-8482-7a626f84681f","year":2017},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.584359Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:61dd0e42d6e8120aafe968c27c461c9bafa375e68bedbf6ef02bc3fe6dc584cf","observation_id":"65b87af2-93d0-480c-a83d-e2decd68a9ed","resolution":{"observed_at":"2026-08-15T14:48:12.382689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.11179","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:11.218732Z","title":"A systematic literature review on source code similarity measurement and clone detection: Techniques, applications, and challenges,","venue":null,"work_id":"f877b15e-3ef6-4193-b67a-f5ee56b7652e","year":2023},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.588233Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:8e99120c41b43de81766c810beea156d23f904d64a871f82bef9c02d999ce385","observation_id":"ba10e571-1205-4097-bd0a-1cb00921790a","resolution":{"observed_at":"2026-08-15T14:48:11.225856Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.366931Z","title":"Sebyte: Scalable clone and similarity search for bytecode,","venue":null,"work_id":"5ebf3be1-b6e9-40d1-8b7e-5bd0e51c235b","year":2014},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.591535Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:fe361ab2c7e1a4dba5025b859cc1d2ee480afdf449c6550773ad417fcd504152","observation_id":"313fcf24-8cb3-43eb-a4ad-a6c6601f6d63","resolution":{"observed_at":"2026-08-15T14:48:12.370874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.355055Z","title":"DExperts: Decoding-time controlled text generation with experts and anti-experts,","venue":null,"work_id":"70cbe1ee-9c96-4eff-a6cf-41a09c92727f","year":2021},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.596175Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:16b5af183e92a78eb957c3debd2a91454225df42afbf598799aee39a8f59c50f","observation_id":"2e77a828-5c4f-46e1-88b5-92caf5b21a9a","resolution":{"observed_at":"2026-08-15T14:48:12.358970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.342796Z","title":"A contrastive framework for neural text generation,","venue":null,"work_id":"5ee5663c-61f8-4f0f-a273-0c1d4a3a98d3","year":2022},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.600104Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:d03fe860a56cc10033a2e17ef80d5219ef4907433325c13318a648848739af8c","observation_id":"724d8148-fe51-4538-bafa-5eeb91c2ebd9","resolution":{"observed_at":"2026-08-15T14:48:12.346704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.331268Z","title":"Summarizing source code with transferred api knowledge,","venue":null,"work_id":"2f715f50-804a-44fe-b27a-222acf35e605","year":2018},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.603994Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:87ed6bb48c4614377e765cb4d69c0b4073439cc245342504b26f5f32a9918e8c","observation_id":"600dcc45-b3e0-4070-bb97-608304525de8","resolution":{"observed_at":"2026-08-15T14:48:12.335087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.02275","last_updated":"2017-07-07T17:15:27Z","snapshot_observed_at":"2026-08-14T20:49:00.133205Z","submitted_at":"2017-07-07T17:15:27Z","title":"A parallel corpus of Python functions and documentation strings for automated code documentation and code generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.02275","snapshot_observed_at":"2026-08-15T14:48:10.607922Z","title":"A parallel corpus of python functions and documentation strings for automated code documentation and code generation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.607922Z"},"links":{"cited_paper":"/paper/1707.02275","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:795653b099716d8c710fc8dbf1bc7d7a65cf876b4374499a2913e8c79d11220c","observation_id":"ad6af319-ba8c-478b-8afc-e8110c5338b4","resolution":{"observed_at":"2026-08-15T14:48:10.607922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T14:48:10.612185Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.612185Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:1d9a7b999d4b20d244a7fbe56d2c44c61b0425206987a14c700bcd313ab82e5b","observation_id":"68fcea5b-60f1-4bb7-90dd-b84d02185511","resolution":{"observed_at":"2026-08-15T14:48:10.612185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-15T14:48:10.616191Z","title":"Program synthesis with large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.616191Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:5c80ce48e5e4238cb4cef5954b9d43dcf1f45b09a265205f89e82a8b5f623309","observation_id":"c5eafffb-23d2-4e97-af35-d7f2f08ddce0","resolution":{"observed_at":"2026-08-15T14:48:10.616191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-08-14T15:45:30.011625Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-15T14:48:10.620014Z","title":"Bigcodebench: Benchmarking code generation with diverse function calls and complex instructions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.620014Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:c4c72e3a9193fbbff3d7bf1488072b9aea83f3e799ece2804f5d7219c4b67a7a","observation_id":"81ca12d9-6f40-427b-957d-a4c99e31fd4f","resolution":{"observed_at":"2026-08-15T14:48:10.620014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.319402Z","title":"The vault: A comprehensive multilingual dataset for advancing code understanding and generation,","venue":null,"work_id":"96aa1170-9b6c-4b1e-9b73-21fb1885ef34","year":2023},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.624093Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:72d7ccfae5d81fcbcbe360843230fefdce6c970e8b489cb7fd6f347a76b3e8a3","observation_id":"977a9998-81b4-42de-b0d0-6a452b7d21c3","resolution":{"observed_at":"2026-08-15T14:48:12.323956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.306741Z","title":"Olmo 3: Charting a path through the model flow to lead open- source ai,","venue":null,"work_id":"0c96ccf9-08bf-405b-b117-0068821c95f1","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.628480Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:dd82d91d42ac477c004050a39a43aebf8b26ab97953b89eede4b52e42257ec3c","observation_id":"93c0b63f-f616-46a9-8e36-10a09384cb08","resolution":{"observed_at":"2026-08-15T14:48:12.310825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.294970Z","title":"Bigcodebench (hard) leaderboard,","venue":null,"work_id":"e611f539-87f3-43dd-abd6-fa65d3ab7834","year":2026},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.632180Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:cdf4e3c35a14d95af9d60f2ee2175b5714e3c876ad94f849e134a706153960f8","observation_id":"47fcc651-540f-4b69-9212-25aeb317dc84","resolution":{"observed_at":"2026-08-15T14:48:12.298772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.280662Z","title":"Docstringeval: Evaluating the effectiveness of language models for code explanation through docstring generation,","venue":null,"work_id":"b83d4ff4-11c6-4971-99aa-efc6b1819fb3","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.636145Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:d2df66317962d5d0d0754bf4939cc4951f46813838dab055d920e5d340f8af4b","observation_id":"8a793a59-cb89-42b9-9256-6f6be19b8e98","resolution":{"observed_at":"2026-08-15T14:48:12.285265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.267549Z","title":"Best ai for reasoning in 2026,","venue":null,"work_id":"ea45a9ad-cebd-4c50-9a94-3183c72f1978","year":2026},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.639767Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:2680a89bf69276e119c97efe393af3f91ded30cdb2ed6aad2d06018f4f01df6d","observation_id":"fb11dabf-d275-484d-a1e6-d841a65f60c4","resolution":{"observed_at":"2026-08-15T14:48:12.272577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.255288Z","title":"Data augmentation for code translation with comparable corpora and multiple references,","venue":null,"work_id":"f2ee403d-0fef-4cee-938c-0662cdd5b009","year":2023},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.643544Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:85a8b77f26782c051e61221f20006c3fe1056a6ef97de972dfa2076c6dcc132c","observation_id":"4821814a-a0dd-4064-8c30-e08b739886b2","resolution":{"observed_at":"2026-08-15T14:48:12.258990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.240016Z","title":"Who evaluates the evaluators? on automatic metrics for assessing ai-based offensive code generators,","venue":null,"work_id":"b3a22b59-2d69-463c-93f2-9d712bd73ceb","year":2023},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.647331Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:3c56d738a808d585818f651faa1e0641842b9519ab75f71fc77b163d43c479e3","observation_id":"07bff73b-281e-421f-97b0-21fd0d51d77d","resolution":{"observed_at":"2026-08-15T14:48:12.244833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.651007Z","title":"Coffe: A code efficiency benchmark for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.651007Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:aba8b2b8854ff1885a5dcc27b552bb8f0508e19a0781a425cf95c80f9ac50313","observation_id":"ed2123e5-8c7d-48b8-ab6f-9198e2f74bcc","resolution":{"observed_at":"2026-08-15T14:48:10.651007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.657124Z","title":"Togll: Correct and strong test oracle generation with llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.657124Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:a24fe8d5cdc6dde3b8b4f16efb0aa1d6b74e7d73d97645612937b1d8acb9c54b","observation_id":"41f87812-808d-4e4a-8d60-c15459c4e9b9","resolution":{"observed_at":"2026-08-15T14:48:10.657124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.228212Z","title":"CoIR: A comprehensive benchmark for code information retrieval models,","venue":null,"work_id":"5bfddfe6-8157-4e34-aed0-848cc623abd7","year":2025},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.661539Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:63f96aab23abaa648795ab87f139afdac60fc59134eeaa57a43b45a4054c11d3","observation_id":"b93b66ef-e379-46e1-b791-6b409b966cd4","resolution":{"observed_at":"2026-08-15T14:48:12.232169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.212795Z","title":"[research paper] crolsim: Cross language software similarity detector using api documentation,","venue":null,"work_id":"35a36d63-5311-4b1a-a64f-cf03cc004a22","year":2018},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.665903Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:955f23e10aba2194a793be256c0da07270fafed617a01c950922516ff1af77a0","observation_id":"804df050-87c2-44f9-b7fc-0644f266bcbc","resolution":{"observed_at":"2026-08-15T14:48:12.217595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.198700Z","title":"Directional diffusion-style code editing pre-training,","venue":null,"work_id":"ce2384a7-3817-46e2-be72-2a2202544f51","year":null},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.669581Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:aef332c65999aa6c41384eab6cfb37050a0bc0f82a6acb764db2f0dc122b3930","observation_id":"83d2f6e3-893c-4224-8826-77312f6e557a","resolution":{"observed_at":"2026-08-15T14:48:12.202905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04494","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.886263Z","title":"Naturaledit: Code modification through direct interaction with adaptive natural language representation,","venue":null,"work_id":"82224a26-5e9a-42f9-a029-fe4c400c0d61","year":2026},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.678651Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:4549e4da5b45ec826e36fd6aaf576212da593da3df6d4e1f2db13c0d0d65865d","observation_id":"ac00f775-e56d-433d-a46a-c6fee4ef19ec","resolution":{"observed_at":"2026-08-15T14:48:10.894667Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17683","last_updated":"2026-06-16T08:49:56Z","snapshot_observed_at":"2026-08-13T21:22:44.536116Z","submitted_at":"2026-06-16T08:49:56Z","title":"Bridging Functional Correctness and Runtime Efficiency Gaps in LLM-Based Code Translation","version":1},"cited_work":{"arxiv_id":"2606.17683","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17683","snapshot_observed_at":"2026-08-15T14:48:10.819401Z","title":"Bridging Functional Correctness and Runtime Efficiency Gaps in LLM-Based Code Translation","venue":"cs.CL","work_id":"0316a012-e4f1-4152-86fd-b0469f12a8c0","year":2026},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.682878Z"},"links":{"cited_paper":"/paper/2606.17683","citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:ace5e608af3f52b92015ae9a386788f47be07d1f2813b54a3b09cc6a659db33e","observation_id":"a2fff36e-2b3a-4d27-8192-edfa311d6b54","resolution":{"observed_at":"2026-08-15T14:48:10.824261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.185843Z","title":"The fault in our stars: Quality assessment of code generation benchmarks,","venue":null,"work_id":"3f9b0ed8-8ef7-45d7-b335-8ac3f9c48b22","year":2024},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.687376Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:4828694734861349ca14e73f0e7c36ec669e98d4473c329f2dd996b7d5340328","observation_id":"da1e9790-7b65-44a3-b818-04a181df1cf8","resolution":{"observed_at":"2026-08-15T14:48:12.190200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.692142Z","title":"The proof and measurement of association between two things,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.692142Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:2d2b6bd0c8039965567a2a3cc4eafa3f36ebf08e6c968654ad328170d0597398","observation_id":"2da0c5ba-085b-4ce0-b95e-b761a0727304","resolution":{"observed_at":"2026-08-15T14:48:10.692142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.696361Z","title":"An analysis of variance test for normality (complete samples)†,","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.696361Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:7274921f28d983b595b7c568e8d3afa62ea4fa54b277d02f76d0bbbfa4923072","observation_id":"f9de22de-6aa1-42f7-a9de-5c41f1519af6","resolution":{"observed_at":"2026-08-15T14:48:10.696361Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/00221309809595548","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.740317Z","title":"Averaging correlations: Expected values and bias in combined pearson rs and fisher’s z transformations,","venue":null,"work_id":"d97ee1d0-7c75-4b9b-ac13-04f26d6fda04","year":1998},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.700143Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:f7749cb93439a8e392bd66c5d4ff4963e6dc13ddb0e42a4f9e8378468d856dc0","observation_id":"a9aa3d10-1a6c-46e0-ba38-003ab40b633c","resolution":{"observed_at":"2026-08-15T14:48:10.745814Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.160812Z","title":"Odds ratios and logistic regression: further examples of their use and interpretation,","venue":null,"work_id":"8f8ff358-52cb-4b53-9232-a753cb31cc4c","year":2003},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.705158Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:4d5aac2a624a63762eedaf8452ef84acac19cc56b2a5585e82cd28258e42eda5","observation_id":"490672f9-6c5b-478d-ae0b-80122d8a05b9","resolution":{"observed_at":"2026-08-15T14:48:12.166354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.12079","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:10.971691Z","title":"Available: https://arxiv.org/abs/2501.12079","venue":null,"work_id":"7b1000c4-6ca9-4960-a9d4-3b888333f572","year":null},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.674034Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:eefdc4bcae4c8e7f775338cfe814ba946976b58d290b175a70afa9ba90caec1c","observation_id":"a1b021e8-ec4f-4142-9b6b-a58c347068d7","resolution":{"observed_at":"2026-08-15T14:48:10.980231Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.10452","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:48:12.001634Z","title":"Available: https://arxiv.org/abs/2512.10452","venue":null,"work_id":"d45287ba-aaa6-4674-9e5d-8bd810fb7bd4","year":null},"citing_paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-15T14:48:10.474641Z"},"links":{"citing_paper":"/paper/2608.04195"},"observation_digest":"sha256:03ea759628133e27b5138d06f0236050b134eac7f0455153caec101ae731ed9b","observation_id":"461c3d0d-5ede-4795-afe0-f09434fc143f","resolution":{"observed_at":"2026-08-15T14:48:12.009027Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04195","last_updated":"2026-08-04T19:54:45Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-15T20:40:21.968309Z","submitted_at":"2026-08-04T19:54:45Z","title":"SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":28,"verified_exact":10,"verified_fuzzy":28},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2608.04195."}