{"as_of":"2026-08-09T13:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a2b34d987cae1ad4ac90f5aadba2d145539ae26291a11800a5e2685333c2c166","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:12:58.403172Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:11:49.105382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:11:49.510770Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"cited_work":{"arxiv_id":"2502.07611","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07611","snapshot_observed_at":"2026-08-07T14:11:49.510770Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","venue":"cs.SE","work_id":"79ee0834-026e-4367-b7ee-594b3ea3e2a4","year":2025},"citing_paper":{"arxiv_id":"2505.19757","last_updated":"2025-05-26T09:36:57Z","snapshot_observed_at":"2026-08-08T23:22:39.431136Z","submitted_at":"2025-05-26T09:36:57Z","title":"CIDRe: A Reference-Free Multi-Aspect Criterion for Code Comment Quality Measurement","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:11:49.105382Z"},"links":{"cited_paper":"/paper/2502.07611","citing_paper":"/paper/2505.19757"},"observation_digest":"sha256:02c22d900361127ae39833071e0bc053d3584173bf339f642d4c56ee686a0a3e","observation_id":"4440407d-bd18-4e99-adac-a0d286e3ce27","resolution":{"observed_at":"2026-08-07T14:11:49.551037Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07611","snapshot_observed_at":"2026-08-03T09:01:33.625541Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.15094","last_updated":"2026-06-07T18:11:26Z","snapshot_observed_at":"2026-08-07T06:50:26.695554Z","submitted_at":"2026-01-21T15:33:16Z","title":"Parameter-Efficient Multi-Task Fine-Tuning in Code-Related Tasks","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T09:01:33.625541Z"},"links":{"cited_paper":"/paper/2502.07611","citing_paper":"/paper/2601.15094"},"observation_digest":"sha256:438edfd4b5cd46686a39feb4820609892a9d94a6984a8a3444fcfc99658eaefb","observation_id":"55a61a2c-6df7-480c-adb9-a96e2ab09185","resolution":{"observed_at":"2026-08-03T09:01:33.625541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07611","snapshot_observed_at":"2026-08-03T07:34:22.017508Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?arXiv preprint arXiv:2502.07611 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20147","last_updated":"2026-07-17T10:12:37Z","snapshot_observed_at":"2026-08-06T05:52:15.832126Z","submitted_at":"2026-01-28T00:45:28Z","title":"Not All Tokens Matter: Data-Centric Optimization for Efficient Code Summarization","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T07:34:22.017508Z"},"links":{"cited_paper":"/paper/2502.07611","citing_paper":"/paper/2601.20147"},"observation_digest":"sha256:235b1d75b5d344b819908bec37b7a452a538a5a0d9aaafd6cbc5956a5802a041","observation_id":"ad62ff13-5679-47eb-ac0f-bd389918e4c3","resolution":{"observed_at":"2026-08-03T07:34:22.017508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07611/citation-record","integrity":"/paper/2502.07611/integrity","json":"/paper/2502.07611/citation-record.json","paper":"/paper/2502.07611"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.173973Z","title":"Do code and comments co- evolve? on the relation between source code and comment changes,","venue":null,"work_id":"3d58e19c-5c02-411a-bc52-206eba5737c9","year":2007},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.119383Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:ba7d8458dac933697cfb0004e2293d46a82ba4092ad52965ed9d8048bf617b58","observation_id":"ec0e6642-e2f8-414b-b581-67d11da4d0d2","resolution":{"observed_at":"2026-08-08T12:12:59.178075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.162939Z","title":"Analyzing the co- evolution of comments and source code,","venue":null,"work_id":"94f49f09-653f-4b06-97be-0f614bd68daf","year":2009},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.123879Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:a354b4c93d97b2072dccdc34cf6c6695a681eb7d0ba527f8a3fcd1c6b2bcf632","observation_id":"f70187d8-e02b-463c-98f7-23a86b02f39d","resolution":{"observed_at":"2026-08-08T12:12:59.166793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.150910Z","title":"How do developers document database usages in source code?(n),","venue":null,"work_id":"1848cd64-ce4c-41b2-8407-f12bfbbc2e27","year":2015},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.128233Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c92c14ae1afbd1442701303ac851c3a7452e2013254d7a3a2a7c61f21ae74936","observation_id":"fab69c86-37ee-4cb1-857c-ccdf78028962","resolution":{"observed_at":"2026-08-08T12:12:59.154703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.132270Z","title":"A large-scale empirical study on code-comment inconsistencies,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.132270Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:0d02e5a00914f56a38a30daf9117942d794a12248f7884a5eeea453ff0148694","observation_id":"e0de4f5a-d4ed-4f82-b342-8395544843e2","resolution":{"observed_at":"2026-08-08T12:12:58.132270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.133250Z","title":"A decade of code comment quality assessment: A systematic literature review,","venue":null,"work_id":"e4c46805-0c19-4196-872e-0e737c8dfa06","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.136096Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c9efc8fff248ec1122377aeda88fc0f5ada9edd125e85ab2ac27a580e8324781","observation_id":"17027371-c6af-46e9-8440-97d195a72e2a","resolution":{"observed_at":"2026-08-08T12:12:59.137392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.122047Z","title":"A study of the documentation essential to software maintenance,","venue":null,"work_id":"2fdec8ef-48ab-456e-bf5b-ebd3df9a8c74","year":2005},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.140554Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:75c7c7754b7eafe78b0b10495910044b279d7c76a35290829da4eb08d4394c2c","observation_id":"7171a061-552c-419e-a9e7-c5489cf37d5b","resolution":{"observed_at":"2026-08-08T12:12:59.125970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.110753Z","title":"Improved auto- matic summarization of subroutines via attention to file context,","venue":null,"work_id":"df85872a-3e58-42c5-885c-ea0152bc30c6","year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.144570Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:d391a4d4cf44c8955fa73e461e4a5f2746aa53c9b638cd5ae0e6e61134c7c8c3","observation_id":"efe7bf8a-0b17-47f9-b224-4ef122c499ee","resolution":{"observed_at":"2026-08-08T12:12:59.114496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.148490Z","title":"Deep code comment generation with hybrid lexical and syntactical information,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.148490Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:9bb5c0823b88ae8a6b40b53faf9d8ae77883e1d7aeddfde16c2a5c95d04ffe45","observation_id":"793a6bb0-9d7a-4d71-8cb3-eda7e584569e","resolution":{"observed_at":"2026-08-08T12:12:58.148490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.151928Z","title":"A neural model for gener- ating natural language summaries of program subroutines,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.151928Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:170104c225e41042e1aab434ddd95c75d4266097276721216f76a89146bec3ae","observation_id":"8de36cdb-61b7-4bc0-bd60-1c3593c50911","resolution":{"observed_at":"2026-08-08T12:12:58.151928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.086570Z","title":"Retrieval-based neural source code summarization,","venue":null,"work_id":"058a22ba-3184-49d0-b4a9-7e491652412d","year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.155706Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:8a05a107d7a92c8216af780607d86cfe1b99fc26641e2dee23f00075748eed65","observation_id":"e9c86c10-7d62-40fc-b7fe-4fd1455de907","resolution":{"observed_at":"2026-08-08T12:12:59.090933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.075664Z","title":"Studying the usage of text-to-text transfer transformer to support code-related tasks,","venue":null,"work_id":"157d74c5-6af4-433a-85e4-be7d55afb7d9","year":2021},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.159472Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:5bd723906d39d0fa6af76389ee3235ecb72069711e35ee9eb6ae38d0b4df78d3","observation_id":"97a07c59-8226-49d7-b301-0119a2298a6c","resolution":{"observed_at":"2026-08-08T12:12:59.079435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.064542Z","title":"Code structure–guided transformer for source code summarization,","venue":null,"work_id":"0e721f20-7c7e-4906-bccd-4a1b5f1dcdc8","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.164139Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:fa272d04a24b594380a9aad9e2b17f4855c291c22eb9327b8c5d566ff2fe3715","observation_id":"e78f9aca-a60d-40bf-8ad7-2590d3b8371f","resolution":{"observed_at":"2026-08-08T12:12:59.068607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.168794Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.168794Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:7c862113e46a884b46069f45092611f58a93c17ede464fd25939e83019602516","observation_id":"c39506bb-0f03-40e1-ae46-28c076c83f70","resolution":{"observed_at":"2026-08-08T12:12:58.168794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T12:12:58.172228Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.172228Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:657831f05e4ebc18ee35e19faed000ea26d203ac677d887e9de51e2a38d24887","observation_id":"4771e861-247d-41d3-8735-443e7fd7ef2a","resolution":{"observed_at":"2026-08-08T12:12:58.172228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.176255Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.176255Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:55f224573cd0d8c5bd7880518f53a4b045a5f88d0a1ab3a2b65d98d4b790be0b","observation_id":"241f10c1-6463-45e4-94a8-18cddeb29518","resolution":{"observed_at":"2026-08-08T12:12:58.176255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.039176Z","title":"Code generation as a dual task of code summarization,","venue":null,"work_id":"2191588c-184c-41c5-848f-a01b7936548b","year":2019},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.180079Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:3dafcc18f6027ac7f3ae15e1185248a1d43fc6bd6e76dc5702d23754c2f856e3","observation_id":"a4b1c104-37c9-4c92-8766-3830064fd3c3","resolution":{"observed_at":"2026-08-08T12:12:59.043299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.184088Z","title":"Intellicode compose: Code generation using transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.184088Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c32854cd71b9c33f0acf3a9b6c3fbdac70b85a38e7c80f71a21ff89bdec2f33f","observation_id":"3400904e-bdf5-49a6-8293-e7aee857a769","resolution":{"observed_at":"2026-08-08T12:12:58.184088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.020957Z","title":"Is your code generated by ChatGPT really correct? rigorous evaluation of large language models for code generation,","venue":null,"work_id":"4c505150-6598-4ac9-ac88-508aab5636c6","year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.187433Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:88b9cec6c3fa377b90b5c6f33c755bff3dd8f9303b36097928ac854170d3b331","observation_id":"aeaaec0c-76e4-4a11-855b-9e9799de8233","resolution":{"observed_at":"2026-08-08T12:12:59.025217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01632","last_updated":"2024-11-06T18:04:35Z","snapshot_observed_at":"2026-08-04T17:38:49.392434Z","submitted_at":"2024-03-03T22:38:35Z","title":"SynCode: LLM Generation with Grammar Augmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01632","snapshot_observed_at":"2026-08-08T12:12:58.190727Z","title":"Improv- ing llm code generation with grammar augmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.190727Z"},"links":{"cited_paper":"/paper/2403.01632","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c18ada31a0137ce6f25593733a00d8d2bfe561668be65b127fab4bb96ad98f16","observation_id":"6a55a61d-3d72-4470-b134-61d7493cb725","resolution":{"observed_at":"2026-08-08T12:12:58.190727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.194483Z","title":"Inferfix: End-to-end program repair with llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.194483Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:d362fb3939f5103fc0bbdacac9144b8e588b52958e2cc13e7cf8035320ef753d","observation_id":"9cbd31fb-fae7-4ebb-a943-19b04be26110","resolution":{"observed_at":"2026-08-08T12:12:58.194483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:59.003215Z","title":"Neural transfer learning for repairing security vulnerabilities in C code,","venue":null,"work_id":"9d775fb6-5255-4b0c-b75a-d0f3640d2ae7","year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.197548Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:55ec101ad30c9fc210fc1f3d766644550a569b4ceab2753a11c0957179e8ed3a","observation_id":"f2388f30-fb90-4458-929d-c04f4bc6bb7f","resolution":{"observed_at":"2026-08-08T12:12:59.007155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.991761Z","title":"Sequencer: Sequence-to-sequence learning for end- to-end program repair,","venue":null,"work_id":"251caa47-2468-44cd-b43e-ec33746924e7","year":1943},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.201173Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:a53fb8e66bbc986b2d61c4341fb0e814f3bb8d550c3b7e73048082fd5254445d","observation_id":"d31ef222-004d-4871-a48f-e24af1128aa4","resolution":{"observed_at":"2026-08-08T12:12:58.995918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.980749Z","title":"An empirical investigation into learning bug-fixing patches in the wild via neural machine translation,","venue":null,"work_id":"70376cae-02b7-432a-8e04-ffe79493a86e","year":2018},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.204511Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:b548d071efa81d71ca7f7a0a41d0f0f190f9cc70ff6e8a7dc167b4d0fd9011ef","observation_id":"3f3cd8b7-e492-4bf3-8e4d-90053edaaaf6","resolution":{"observed_at":"2026-08-08T12:12:58.984572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.968878Z","title":"Summarizing source code with transferred API knowledge,","venue":null,"work_id":"47152a80-6d1e-4e5e-b6b3-a0c3ed1e2a7a","year":2018},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.208496Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:e91aae5951af4f31ce1bf71610cf6a6dd7271247dfbd92ca4dbc4afad2b3265d","observation_id":"6152a493-5473-49ab-a9e4-57b3d3dd9468","resolution":{"observed_at":"2026-08-08T12:12:58.973432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.957700Z","title":"Deep code comment genera- tion,","venue":null,"work_id":"b65e13c7-6c30-4c55-a999-b9ac259d91ca","year":2010},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.212050Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:faeed362ae48bfd323df4dcc57de44a351aab6ae01cc5d765626902a0e1cef69","observation_id":"cfc35aea-7642-4f6b-b09b-c71916a34f20","resolution":{"observed_at":"2026-08-08T12:12:58.961201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.946508Z","title":"Improved code summarization via a graph neural network,","venue":null,"work_id":"81e0c026-142f-4829-b9f8-bb8366974b8a","year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.215219Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:451d170c9c6411a0ed4e25b90bf5e221be2339b96fff946f14ed772aca1764e1","observation_id":"e499ea84-e276-472a-b6f4-3202bb3e04d6","resolution":{"observed_at":"2026-08-08T12:12:58.950809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.933734Z","title":"Fair and balanced?: bias in bug-fix datasets,","venue":null,"work_id":"18d69732-415a-4381-b629-453bc33985fd","year":2009},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.218773Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:3cdfab4f0103fac53b5849a937ed73ec16666e975b75017e6bcd1e24bfbda934","observation_id":"764bcda6-cdcf-4956-8ee5-4ccef0861c32","resolution":{"observed_at":"2026-08-08T12:12:58.939004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.921645Z","title":"It’s not a bug, it’s a feature: how misclassification impacts bug prediction,","venue":null,"work_id":"2852f7b4-5117-474f-9e8a-70a2de619775","year":2013},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.222450Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:82b7a5ecad394342fc1a708f61cf05c8341e55a387da7f7b518bf78e8be51d33","observation_id":"71978b81-deca-4ece-a005-7f46cb9f60ab","resolution":{"observed_at":"2026-08-08T12:12:58.925763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.909143Z","title":"The missing links: bugs and bug-fix commits,","venue":null,"work_id":"d3b256fb-33e3-4d37-81b5-cd4dd20ff888","year":2010},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.225843Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:cceb7a8792cff6031ed4a3c6877e0c7bd1c2102e5521148540a18e6e85a57830","observation_id":"11132878-8ab7-42c4-b6f5-a9cfa919fcd2","resolution":{"observed_at":"2026-08-08T12:12:58.913416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.897439Z","title":"Are we building on the rock? on the importance of data preprocessing for code summarization,","venue":null,"work_id":"9c803a12-4a93-4a1d-8db3-68937d7dab73","year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.229482Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:3538cdd07c484439283765c790e710c3ba4d6fdbabaadffc3b132c527b93fde4","observation_id":"491f1c06-4745-4356-ba67-847c4697f991","resolution":{"observed_at":"2026-08-08T12:12:58.901309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07931","last_updated":"2022-04-17T05:15:24Z","snapshot_observed_at":"2026-07-06T13:01:00.912646Z","submitted_at":"2022-04-17T05:15:24Z","title":"On the Origin of Hallucinations in Conversational Models: Is it the Datasets or the Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07931","snapshot_observed_at":"2026-08-08T12:12:58.233229Z","title":"On the origin of hallucinations in conversational models: Is it the datasets or the models?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.233229Z"},"links":{"cited_paper":"/paper/2204.07931","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:293d2b77616c5d1e5c7ce10b68022020c8fb44bf1c94133cd03e3e4e891e3817","observation_id":"998c86ac-0802-4c1e-af74-82ee21ee75aa","resolution":{"observed_at":"2026-08-08T12:12:58.233229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.885849Z","title":"On the coherence between comments and implementations in source code,","venue":null,"work_id":"11b24632-6c13-4075-8afa-e2fd076550ee","year":2015},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.237031Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:8677d710f18e7dd7e779f17be65afcd75ba43926eadb46a10bca67ad83ecc7d1","observation_id":"19f0e6ba-4985-4b20-886e-5f1423187b32","resolution":{"observed_at":"2026-08-08T12:12:58.890150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.873172Z","title":"Evaluat- ing code summarization techniques: A new metric and an empirical characterization,","venue":null,"work_id":"fd39923a-f838-4dfc-9e6c-70ee75e57577","year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.240188Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:3374fb77e051450e67bb8746d2457cd289a1b326c2c8b7fd2978812f8ad6f5ca","observation_id":"803eae6e-d974-4902-838e-bca8f18e50e2","resolution":{"observed_at":"2026-08-08T12:12:58.878301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.244563Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.244563Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:6866e0c1a4d4ac60968058037f2a1e328ca518cf129791afe491db1467f22207","observation_id":"e94686ea-72b0-4ad8-87cf-6b94fb57c2dc","resolution":{"observed_at":"2026-08-08T12:12:58.244563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07922","last_updated":"2023-05-20T07:27:15Z","snapshot_observed_at":"2026-08-08T01:28:05.271964Z","submitted_at":"2023-05-13T14:23:07Z","title":"CodeT5+: Open Code Large Language Models for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07922","snapshot_observed_at":"2026-08-08T12:12:58.251792Z","title":"Codet5+: Open code large language models for code understanding and generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.251792Z"},"links":{"cited_paper":"/paper/2305.07922","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:42cf3b10f6050b75b427f6d7ffc6619848644e17f31dc37238acc1db802ba6dc","observation_id":"ec02d0d6-d0c7-4da0-8656-ea61d6d6be20","resolution":{"observed_at":"2026-08-08T12:12:58.251792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.255582Z","title":"Codereval: A benchmark of pragmatic code generation with generative pre-trained models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.255582Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:03359a11332c5fd92d2f95a3785f8b15f3204edd02c80b11d4e8f2f9e2bce00f","observation_id":"e7559514-4011-4d72-8685-0db73ea833c5","resolution":{"observed_at":"2026-08-08T12:12:58.255582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.840762Z","title":"On the robustness of code generation techniques: An empirical study on Github CoPilot,","venue":null,"work_id":"09500f8e-567c-4c76-aac5-c32db0314617","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.258773Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:ce07d404709137e46b66610f781ff633c067a865c87f22bec072a0c86dc59998","observation_id":"6793791a-e941-4735-ad04-df8128ebb379","resolution":{"observed_at":"2026-08-08T12:12:58.845328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.262282Z","title":"Rouge: A package for automatic evaluation of summaries,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.262282Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:7fe024d0157a6f5a41dbb0dd9abbb8debde5b93053f4b55d55bf759c243b4aed","observation_id":"e2279819-3a1c-4ddd-8d11-fa10af372498","resolution":{"observed_at":"2026-08-08T12:12:58.262282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.829486Z","title":"METEOR: An automatic metric for MT eval- uation with improved correlation with human judgments,","venue":null,"work_id":"c80f7cd7-62ba-4eed-b39a-eeaee29ba32a","year":2005},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.265345Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:6be5819d735cf5e4094e6761f13d3144b49a498de5b94d0f77369c99945b2309","observation_id":"fd7ae4d0-6466-4f95-9425-7b662e0fec20","resolution":{"observed_at":"2026-08-08T12:12:58.833423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09297","last_updated":"2020-11-02T06:54:52Z","snapshot_observed_at":"2026-08-07T07:19:41.700353Z","submitted_at":"2020-04-20T13:54:12Z","title":"MPNet: Masked and Permuted Pre-training for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09297","snapshot_observed_at":"2026-08-08T12:12:58.269499Z","title":"MPNet: masked and permuted pre-training for language understanding,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.269499Z"},"links":{"cited_paper":"/paper/2004.09297","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:be6290a4733c52a70da9b9e8f22d6de2316032789138ae2139e65966e07bfaf0","observation_id":"ae02c32c-43e2-445f-a8f8-6ee3d464711c","resolution":{"observed_at":"2026-08-08T12:12:58.269499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.274293Z","title":"Automatic semantic augmentation of language model prompts (for code summarization),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.274293Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:23385e919fc4687c399f1c032b0390b961c1773fdc3ca6d859d48953bb39b955","observation_id":"868fde40-11d6-476f-b620-1e602884ae63","resolution":{"observed_at":"2026-08-08T12:12:58.274293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06095","last_updated":"2024-08-14T16:15:31Z","snapshot_observed_at":"2026-07-06T17:42:08.056523Z","submitted_at":"2024-03-10T05:10:34Z","title":"RepoHyper: Search-Expand-Refine on Semantic Graphs for Repository-Level Code Completion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06095","snapshot_observed_at":"2026-08-08T12:12:58.277868Z","title":"Repohyper: Better context retrieval is all you need for repository-level code com- pletion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.277868Z"},"links":{"cited_paper":"/paper/2403.06095","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:f8be225f5c20732027c88487c60b5e50898446f80a39b6f0feb6228410e57247","observation_id":"963f6646-f342-46a2-bede-7952f4d336fd","resolution":{"observed_at":"2026-08-08T12:12:58.277868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.282288Z","title":"How important are good method names in neural code generation? a model robustness perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.282288Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:970ad1822ab45199c1a4ec46f1dfadffe0f63683809b09f2bdf1ec3783a9e114","observation_id":"bcd083a2-9203-4165-a1db-54e9814be7a1","resolution":{"observed_at":"2026-08-08T12:12:58.282288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01448","last_updated":"2022-08-03T12:42:52Z","snapshot_observed_at":"2026-08-07T10:18:54.878316Z","submitted_at":"2022-08-02T13:30:07Z","title":"AlexaTM 20B: Few-Shot Learning Using a Large-Scale Multilingual Seq2Seq Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01448","snapshot_observed_at":"2026-08-08T12:12:58.286398Z","title":"Alex- atm 20b: Few-shot learning using a large-scale multilingual seq2seq model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.286398Z"},"links":{"cited_paper":"/paper/2208.01448","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:2f698a6cb6ff30ddba80a24fc9e554f6ff42d878e8afee546d25e67105aaf714","observation_id":"60b53a27-2607-4ed9-ba7e-eea05b539578","resolution":{"observed_at":"2026-08-08T12:12:58.286398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05131","last_updated":"2023-02-28T17:20:36Z","snapshot_observed_at":"2026-08-08T23:22:00.655876Z","submitted_at":"2022-05-10T19:32:20Z","title":"UL2: Unifying Language Learning Paradigms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05131","snapshot_observed_at":"2026-08-08T12:12:58.290208Z","title":"Ul2: Unifying language learning paradigms,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.290208Z"},"links":{"cited_paper":"/paper/2205.05131","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:83a5247c4d9ed322a443ec2a242162400bce425f7369f82f495e9f4e53cf4d28","observation_id":"9b380f29-679d-44b8-a44f-d9d4e03af487","resolution":{"observed_at":"2026-08-08T12:12:58.290208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.804235Z","title":"Using transfer learning for code- related tasks,","venue":null,"work_id":"dfb82e57-8113-4682-9fe5-ba9b528c450a","year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.294304Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:b06804cd072b58ea91d45736d87eb075a43ab42e089547773e0aeb3492b8c546","observation_id":"4f4f06e3-04b8-40a7-8cc3-d4ecd60892ad","resolution":{"observed_at":"2026-08-08T12:12:58.808618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.792096Z","title":"Automatic source code summarization with graph attention networks,","venue":null,"work_id":"84fe79cb-e1ca-4530-adb3-48f12d851900","year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.298859Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:5206ca51cfa159db3d5b3de0d1cd4dc0add37d86a04e665025c10571963338bf","observation_id":"a7a8501f-1812-462c-ba64-a411c88cf11c","resolution":{"observed_at":"2026-08-08T12:12:58.796140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.780073Z","title":"Automating code-related tasks through transformers: The impact of pre-training,","venue":null,"work_id":"bf188862-a0fa-4a96-bc4e-5dd5c786ac35","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.302257Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c420882f57b66dfebe17df0700e67e2da2d7a6169857e37d84352bfe066fefa9","observation_id":"2e1aec11-86c6-4e36-a1fa-3da211be3059","resolution":{"observed_at":"2026-08-08T12:12:58.784133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T12:12:58.305897Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.305897Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:59354c24d8eab21029f4b642413b0ce738f6c5259abe4ec264dda2ff5c13930f","observation_id":"57607d18-b4e5-4286-b6bf-796ee67243b3","resolution":{"observed_at":"2026-08-08T12:12:58.305897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.769169Z","title":"Towards automatically addressing self-admitted technical debt: How far are we?","venue":null,"work_id":"55d11cda-1de4-479f-89e5-38e2add44327","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.309519Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c833981b9cbaeabbb4010340dfbc6f445e0b5aed4f58c04c5859d0252c3cae67","observation_id":"7a493f4f-f8b4-4891-9de2-8749fcb0f61b","resolution":{"observed_at":"2026-08-08T12:12:58.772963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.757880Z","title":"On the generalizability of deep learning-based code completion across programming language versions,","venue":null,"work_id":"9b1b4e3a-328f-4222-b6da-1f4b27455149","year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.314092Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:bf291d7715c9f13db4414d60ffa6ee9c029c3e0c658422f288ab880f7cf1bc8e","observation_id":"9a36fd4d-4818-4d6f-bc99-6580dbc08b01","resolution":{"observed_at":"2026-08-08T12:12:58.761884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.746745Z","title":"How the training procedure impacts the performance of deep learning-based vul- nerability patching,","venue":null,"work_id":"41c30c9f-da04-480c-876a-2190c8117fa1","year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.317422Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:9a379357f2f2c5ed88c44214969c33cdde0436670af920eb7af7b40b0cd788fc","observation_id":"7d420885-9d9c-400c-b1d7-7dc79d76d36a","resolution":{"observed_at":"2026-08-08T12:12:58.750668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.320941Z","title":"Early stopping-but when?","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.320941Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:86305ecbfb39723fb6a8ec929b6a876b86157b04f3bd22883e6f1c2ca3ce9137","observation_id":"43896d36-cca6-426b-a1c4-467e884bd7ad","resolution":{"observed_at":"2026-08-08T12:12:58.320941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.728098Z","title":"Individual comparisons by ranking methods,","venue":null,"work_id":"d0d2aaa0-3977-4944-82dc-8d7b5df0bb24","year":1992},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.324779Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c23a58ee6bb6da9dd5441b5a43046a73a3b1525cefc7eed33a2628e6d955b575","observation_id":"bc573f01-9874-406a-b28e-6953646832ed","resolution":{"observed_at":"2026-08-08T12:12:58.732320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.716790Z","title":null,"venue":null,"work_id":"a135507c-a4c5-4c45-b7f0-881dde27b40c","year":2005},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.328698Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:78fdc3dabc5757b0e38b383638c5ad832a24fcafed87c32593a2a8875c9a1abb","observation_id":"5427d107-219e-4d16-b8bb-98a3fab9867d","resolution":{"observed_at":"2026-08-08T12:12:58.720705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.332949Z","title":"A simple sequentially rejective multiple test procedure,","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.332949Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:59ad4402296bf856b18a1d6bd05721e3a290ec8dbe9daad45794d02bef6e35bd","observation_id":"9c0da60a-a041-4bcd-9392-a466679c35d4","resolution":{"observed_at":"2026-08-08T12:12:58.332949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02660","last_updated":"2019-04-04T16:56:01Z","snapshot_observed_at":"2026-08-05T21:03:45.740698Z","submitted_at":"2019-04-04T16:56:01Z","title":"Recommendations for Datasets for Source Code Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02660","snapshot_observed_at":"2026-08-08T12:12:58.337362Z","title":"Recommendations for datasets for source code summarization,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.337362Z"},"links":{"cited_paper":"/paper/1904.02660","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:c6b7169c90243be2c092a28375da93860d3e6e24ea1d65d164511325c1c6ccd0","observation_id":"af929842-7736-42fe-8ba6-4c422b999119","resolution":{"observed_at":"2026-08-08T12:12:58.337362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.14060451","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.433780Z","title":"Replication Package of","venue":null,"work_id":"002df09c-fd3e-4b07-b969-a7e5aa411a78","year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.342015Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:67f3e1b0b4663c45e78ad6ac32bece1825f86306ed8a41b0e0d833943958a969","observation_id":"0ea54cd6-dc3e-4ca0-a723-4e3aba73d69c","resolution":{"observed_at":"2026-08-08T12:12:58.439902Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09700","last_updated":"2019-11-04T20:37:33Z","snapshot_observed_at":"2026-07-06T08:31:12.309726Z","submitted_at":"2019-10-21T23:57:32Z","title":"Quantifying the Carbon Emissions of Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.09700","snapshot_observed_at":"2026-08-08T12:12:58.346665Z","title":"Quanti- fying the carbon emissions of machine learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.346665Z"},"links":{"cited_paper":"/paper/1910.09700","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:6a9fe18b8020f2d93aeed3b220907e5443b366af27f1a06a35643a317259e8ef","observation_id":"d646a487-9b54-48e7-a5f4-3b13f8208c9e","resolution":{"observed_at":"2026-08-08T12:12:58.346665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.351920Z","title":"On the evaluation of neural code summarization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.351920Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:ab8855419a76aee8c7a270aa9055e8b921665ab62655d0e805ed25cad881430d","observation_id":"dee03f67-a874-4f3f-9c65-b01ffba4eee2","resolution":{"observed_at":"2026-08-08T12:12:58.351920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.689355Z","title":"Code to comment","venue":null,"work_id":"89426ee9-c5af-431f-969f-9414908e9cc0","year":2020},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.356577Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:78084da4f49c6270678ee6e9e242848f4c9bc6f27d67528fcc2653e000ae3369","observation_id":"0af12a42-6cd0-4266-b3cd-0ad399c6b17f","resolution":{"observed_at":"2026-08-08T12:12:58.693375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.360774Z","title":"Findings of the 2019 conference on machine translation (wmt19)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.360774Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:97b5972b808979f8cc6273e7a1d1f99a2a18f083c960ea2669568c3a4968b3f5","observation_id":"b3981d22-266d-40fb-a3f9-860c21b35897","resolution":{"observed_at":"2026-08-08T12:12:58.360774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.670207Z","title":"On the importance of building high-quality training datasets for neural code search,","venue":null,"work_id":"03b83d41-7855-4cda-bd53-1f5fb06ede4a","year":2022},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.365100Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:484cdb18e9cf31d28af13adea04fd20ee1461d27ea12cf41e63d182b801e8ca1","observation_id":"04129be5-1db5-4b92-90bf-fe3b4868743f","resolution":{"observed_at":"2026-08-08T12:12:58.674365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.658493Z","title":"Commit message matters: Investigating impact and evolution of commit message quality,","venue":null,"work_id":"f5a6458f-01bb-41f1-9722-b7a6e083ec5e","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.369293Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:9789b639aae656dbd41c7cdf5ff6f0393f35884e44308ccd7e846338bfe8c279","observation_id":"571e476c-29fe-444c-ba30-424b2facf9f8","resolution":{"observed_at":"2026-08-08T12:12:58.662512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.645203Z","title":"Data quality matters: A case study of obsolete comment detection,","venue":null,"work_id":"7502322f-7325-490a-8cd1-9858d30cdd25","year":2023},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.373070Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:e113481a6ad2c7a2b28e0108b112c0ab2edaaf9d2c535d3398f64248ff43b44e","observation_id":"5510b4c2-bcf1-4d7b-9d86-466b2737811b","resolution":{"observed_at":"2026-08-08T12:12:58.650209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.376803Z","title":"Summarizing source code using a neural attention model,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.376803Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:a5733d19b19c4637281451bce6dda0b18f25d9a1b2da487dc4207b98f07796ad","observation_id":"1b94c9d6-c7a3-4f81-a538-d66fe48c3970","resolution":{"observed_at":"2026-08-08T12:12:58.376803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00653","last_updated":"2020-05-01T23:29:36Z","snapshot_observed_at":"2026-07-06T09:16:59.519524Z","submitted_at":"2020-05-01T23:29:36Z","title":"A Transformer-based Approach for Source Code Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00653","snapshot_observed_at":"2026-08-08T12:12:58.380338Z","title":"A transformer-based approach for source code summarization,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.380338Z"},"links":{"cited_paper":"/paper/2005.00653","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:85ba56bc7e4a167e9477a2bdb8f9d7230eda7815c2e0851b82e6b2860cfeaa6c","observation_id":"1ab42f2f-870a-4cea-891e-40db5f12e424","resolution":{"observed_at":"2026-08-08T12:12:58.380338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07959","last_updated":"2025-08-23T15:44:13Z","snapshot_observed_at":"2026-08-08T11:29:09.100755Z","submitted_at":"2024-07-09T05:48:42Z","title":"Source Code Summarization in the Era of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07959","snapshot_observed_at":"2026-08-08T12:12:58.384730Z","title":"Source code summarization in the era of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.384730Z"},"links":{"cited_paper":"/paper/2407.07959","citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:6c1947e545f848325ab4097b01502c4dbd07887a5be617f13c191530f01dc55b","observation_id":"dcabc76b-3807-4fd9-a472-235492b74568","resolution":{"observed_at":"2026-08-08T12:12:58.384730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.626300Z","title":"/* icomment: Bugs or bad comments?*,","venue":null,"work_id":"de268723-aeab-4eb8-9837-6bc42f660a38","year":2007},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.389477Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:35e8487e265fac19a9b447926b845686092e02720096f3e8590ed16c82bc8228","observation_id":"3469155b-81c3-48dc-a26a-3521c81b27fd","resolution":{"observed_at":"2026-08-08T12:12:58.630225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.612348Z","title":"Automatic detection of outdated comments during code changes,","venue":null,"work_id":"031810b6-6cf9-439c-8b3b-5336ef9982e1","year":2018},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.393966Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:2a38d2399b2007f2279dc507f0ac63cbd98fab28e2a6e2a36848b88eb6dbf42e","observation_id":"b79cb726-ed7d-43e5-8e3e-7b1b176a0353","resolution":{"observed_at":"2026-08-08T12:12:58.618155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.599790Z","title":"Deep code-comment understanding and assessment,","venue":null,"work_id":"0f5f0780-d836-40bf-b5d7-0f550f70b09f","year":2019},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.398931Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:fe58ea43b6bb284ed0fdbc55b6915d086e3bab96497633bd4f0fba1ba56b76b1","observation_id":"fe52219a-6159-4d26-9d7d-0ef69d5ecb51","resolution":{"observed_at":"2026-08-08T12:12:58.603878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:12:58.586783Z","title":"Code comment inconsistency detection based on confidence learning,","venue":null,"work_id":"d048b216-e66b-4c13-9dd5-bfda9b19bd03","year":2024},"citing_paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T12:12:58.403172Z"},"links":{"citing_paper":"/paper/2502.07611"},"observation_digest":"sha256:6659ec66875def0dc17597489ee6e2b40df834f5e4eea8cf2f5fe5f1ec4b1130","observation_id":"3de0df90-1a76-4afe-bdc6-852326be248e","resolution":{"observed_at":"2026-08-08T12:12:58.591386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07611","last_updated":"2025-02-11T15:02:19Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-08T23:23:16.056908Z","submitted_at":"2025-02-11T15:02:19Z","title":"Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 3 inbound Pith citation observations for arXiv:2502.07611."}