{"as_of":"2026-08-04T15:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4df9a6be8ba90c963ea86d8ac5152b0d5a92c735dde81788d2c170b06b5727a","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T04:45:46.785605Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.26492/citation-record","integrity":"/paper/2606.26492/integrity","json":"/paper/2606.26492/citation-record.json","paper":"/paper/2606.26492"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8906.333895","doi":"10.1145/3338906.3338952","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Phoenix: automated data-driven synthesis of repairs for static analysis violations","venue":null,"work_id":"6a7cd19a-faf9-4220-97aa-cad3117cc640","year":2019},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:5fa336bcc31238ff2b70db06a4341c03a088df254f2c290b8d4ee5f38834066a","observation_id":"6f6df191-1781-45e2-985b-938aac5df94f","resolution":{"observed_at":"2026-06-26T04:48:59.770093Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7811.33803","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:59:52.026594Z","title":"Misbehaviour prediction for autonomous driving sys- tems","venue":null,"work_id":"827dc9ac-16e3-4229-9dd5-bc9982243ca6","year":2020},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:da34a5595a1315ab3f9ab54b8698343dd1e99e806a11992d5a20782d1e53eca7","observation_id":"fcf6ef1f-8952-4a5c-a75c-1d005c3d3d7c","resolution":{"observed_at":"2026-07-04T13:59:52.028879Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Visualizing the loss landscape of neural nets,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:2c3573bbbb84afb227537d171c08c5bab9db12b395996c7247f36c962832cb8f","observation_id":"35c25b50-c7e7-4b1b-aede-fbf65a1a8432","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7811.338036","doi":"10.1145/3377811.3380362","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Ferreira, Rui Abreu, and Pedro Cruz","venue":null,"work_id":"58bd79fc-77ab-4ff4-9b41-96a137f3e4b7","year":2020},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:859840ae1aa4091ee0ec3d2208b2ac27ab1afbb036c968fc0cab80db9b6ed697","observation_id":"0c2cd43a-50b7-493d-b26e-976ed5f2c929","resolution":{"observed_at":"2026-06-26T04:48:59.721257Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7811.338037","doi":"10.1145/3377811.3380374","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Recognizing developers' emotions while programming , isbn =","venue":null,"work_id":"3835fcb8-21a4-4c72-a627-154fec1b15dc","year":2020},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:eeca6412b76bbaba4fd5c0d695a01fd66f0fbfd5cfbfa92ab2193b6ec32056f1","observation_id":"f7d13938-eb82-419e-940b-e99b07a67b4c","resolution":{"observed_at":"2026-06-26T04:48:59.729673Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0003.351007","doi":"10.1145/3510003.3510070","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Refty: refinement types for valid deep learning models,","venue":null,"work_id":"9e8a489c-f4ed-4921-8d59-dfac476cc15c","year":2022},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:d982271857fc1f9839476246a8d05bb7496928e17260b49dd9bfb17fcca5b13a","observation_id":"a25ea324-adc8-48ef-9634-d7610e4b1dd1","resolution":{"observed_at":"2026-06-26T04:48:59.703120Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0003.351009","doi":"10.1145/3510003.3510092","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"InProceedings of the 44th International Conference on Software Engineering (Pittsburgh, Pennsylvania)(ICSE ’22)","venue":null,"work_id":"2432ce6e-5b27-4287-a889-3c609040f892","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:cb0e162b6460ddc1bb3fb850c0737f035b06bcb4ec16951cb82b69aa865e71f3","observation_id":"43d718fd-eda6-407d-b264-97f38795c426","resolution":{"observed_at":"2026-06-26T04:48:59.726914Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5347.2025","doi":"10.1109/icse55347.2025","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"2025.IRFuzzer: Specialized Fuzzing for LLVM Backend Code Generation","venue":null,"work_id":"c383b7e9-bd1e-4268-b134-a4e43d7560a3","year":2025},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:b73315e8633defc4e66926e5cfa1f20943cede5a3e4586f4bb5b6312f9318117","observation_id":"a87a246e-87be-4f2b-9d06-4d8d60a5464c","resolution":{"observed_at":"2026-06-26T04:48:59.704696Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.107488","doi":"10.1016/j.infsof.2024.107488","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Coverage-enhanced fault diagnosis for deep learning programs: A learning-based approach with hybrid metrics,","venue":null,"work_id":"98885c4e-adac-40a2-8bd9-f338d79349dc","year":2024},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:6bdfade26b1db5fe432dea7275f0f785e27ce663fe29064992fe41775a9b6ecc","observation_id":"f8a84aae-6ff1-4ab7-9e7b-8a3bdb244971","resolution":{"observed_at":"2026-06-26T04:48:59.767240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s42256-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T22:18:59.201148Z","title":"From Local Explanations to Global Understanding with Explainable AI for Trees","venue":null,"work_id":"00aa5c2c-3b9b-4df7-a2e5-a6410288c014","year":2020},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:3deddd32badca577f9ba3eaf582eb906125fabd85f9bedb5cb2c25d9ecf2d9eb","observation_id":"ea96adc7-0eee-4ee2-ad87-a95cc843942c","resolution":{"observed_at":"2026-06-26T04:48:59.715538Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5696.159571","doi":"10.1145/1595696.1595713","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Cross-project defect prediction: A large scale experiment on data vs. domain vs. process,","venue":null,"work_id":"1d77be15-a4e6-452a-bff5-a68a067d408c","year":2009},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:681cf1741ca2de152031c698965f69747ac9953b0154d99b6b5ba909910c1f37","observation_id":"8740561e-9f84-4486-95b6-12bb4d23ddc7","resolution":{"observed_at":"2026-06-26T04:48:59.713323Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.258405","doi":"10.1109/tse.2016.2584050","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"IEEE Transactions on Software Engineering43(2), 185–204 (2017) https://doi.org/10.1109/TSE.2016.2584053 44","venue":null,"work_id":"61d829d5-994a-40df-aaed-85fe98a62da8","year":2017},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:b3064551fec79c1b940dcdb5fbb4b1029448aea29c17cc2e411737782ba7e516","observation_id":"ced5b12e-0b6c-4646-9097-d30a16cea592","resolution":{"observed_at":"2026-06-26T04:48:59.763991Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/ecog.02881","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:16:27.689533Z","title":"Roberts, V","venue":null,"work_id":"a464981c-a760-4bf7-889d-f2c99609eec3","year":2017},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:f2b770bdb0a6472f593026cb7fe6f49d2d784b62784fb270b2fb4e52e5bb38ac","observation_id":"d89bab5e-298d-48cc-9e84-47848e51517c","resolution":{"observed_at":"2026-06-26T04:48:59.709868Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3447876","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:48:59.693860Z","title":"An empirical study of the impact of data splitting decisions on the performance of AIOps solutions,","venue":null,"work_id":"3b6911a7-e0d5-4b7f-bd3c-3b608871e501","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:1e75721b6a8a9f1594ce390ac7180745061d9faeb9cb6ea43609bed96f86c2cf","observation_id":"1bda1503-9f50-4e5b-8a2d-c1b86f9d3692","resolution":{"observed_at":"2026-06-26T04:48:59.695268Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3902.2021","doi":"10.1109/icse43902.2021","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Traceability transformed: Generating more accurate links with pre-trained BERT models","venue":null,"work_id":"9c933547-1e3e-4ec1-8486-51935f93e440","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:417cb5e68b83dd12d25e4c9689e2431ecd8c9e7fe27c0b2e2878d9ca84b950dc","observation_id":"d9251d02-65e6-4c26-b5ee-70df683a4d46","resolution":{"observed_at":"2026-06-26T04:48:59.735451Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:49:23.235888+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:49:23.235888+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1764.344553","doi":"10.1145/3411764.3445538","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"UMLAUT: Debugging deep learning programs using program structure and model behavior,","venue":null,"work_id":"8e5ab502-6977-452f-b43f-570122b74e6b","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:ce59f14cd0be45fa1aab352e302924a8c730abf88d532179c1f71738e392d205","observation_id":"156c739a-6612-48d9-88b3-f8ebc27ade28","resolution":{"observed_at":"2026-06-26T04:48:59.707704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Jahan,Replication Package for the Evaluation Strategy Gap Study, https : / / github","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:7451059581186db5b27fe39587717d4940b2735c56cda0a3ea466388c69ed32f","observation_id":"64fa014c-609f-4f94-8fe2-bb7284692b80","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.infsof","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:05:35.383339Z","title":"Chembakottu, H","venue":null,"work_id":"43f02cfa-1b35-4da0-866c-658bb4a5a639","year":2026},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:ebfca7e0f3eb04a991f0dfbb64a29e3bfef0d94d895c15293e7759c60e0b0b53","observation_id":"773e3656-70ec-41f6-9f7e-d4cdb687751a","resolution":{"observed_at":"2026-06-26T04:48:59.758374Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0319.346482","doi":"10.1145/3460319.3464821","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"title =","venue":null,"work_id":"148a194e-17ff-4fe3-8a7b-1c5767f80a13","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:f740fcc4fcb6f3a9d4f32aeacd0d1155ab0d2624f5f77fe88b84458ead57899a","observation_id":"e8e978c3-cc40-4001-91c8-142143a56ed6","resolution":{"observed_at":"2026-06-26T04:48:59.701765Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Generalized linear models,","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:f2215fef3ca7ff4339dc0c98e1436417eca3005e088b4d7a9b7f8859e9220616","observation_id":"5b57162b-5c53-4a4b-8844-dbbc967af0e9","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"An investigation into neural net optimization via hessian eigenvalue density,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:02afd5643216325c705ecddf93a4e12b063eefad1468124fddc6fd06b8cfefba","observation_id":"994ea424-a6cd-4f1c-b28b-4b0bc22a4f25","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6630.372852","doi":"10.1145/3696630.3728522","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"2025.Compiler Optimization Testing Based on Optimization-Guided Equivalence Transformations","venue":null,"work_id":"976c1a75-3be6-4db9-80c8-90da45043893","year":2025},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:d3f1e60a0aea978b9244a1ed3812261e7a8e0d70b500c1d1f384cdd96d599d45","observation_id":"93698bcd-ead2-4385-b7f1-4090a1ec03d9","resolution":{"observed_at":"2026-06-26T04:48:59.718421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/neco","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T05:16:47.867627Z","title":"2011, Neural Comput., 23, 1661, 10.1162/NECO\\_a\\_00142","venue":null,"work_id":"bbc72d42-3b9b-46b0-b850-9593f3bffbf1","year":1995},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:5cc851691f6c9c3f4db96e34fd68ce9005906078aa411c606c7b080b9810ff79","observation_id":"dfc8da54-3402-47f0-9240-fbbabd33556b","resolution":{"observed_at":"2026-06-26T04:48:59.723230Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Deep learning via hessian-free optimization,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:f1c2b3f5eb1bf6e3d7437c5c3ec71c41dc012db54998f647b9c50615ab039fcd","observation_id":"1c5ac612-a9e2-42d2-8d4c-c91023020a56","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00065","last_updated":"2022-11-23T18:09:57Z","snapshot_observed_at":"2026-07-06T10:45:06.227629Z","submitted_at":"2021-02-26T22:08:19Z","title":"Gradient Descent on Neural Networks Typically Occurs at the Edge of Stability","version":3},"cited_work":{"arxiv_id":"2103.00065","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.00065","snapshot_observed_at":"2026-07-04T13:59:52.014628Z","title":"org/abs/2103.00065","venue":null,"work_id":"aac67922-3bad-4699-b070-cac34775f0c2","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"cited_paper":"/paper/2103.00065","citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:cafcb975682ce07049e2d41cafc555cbc3d3afd417d1f463c02df2c8d172b71d","observation_id":"3cdaa2a7-dee8-4957-810a-7b8432c70ef2","resolution":{"observed_at":"2026-07-04T13:59:52.016229Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Understanding gradient descent on the edge of stability in deep learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:f103a074f1fda66d7d66543f35fe5a31111ae7bacb76fd6cea4b28726b2f2bba","observation_id":"b7a64cbf-31af-4c16-8f7b-6f304081e348","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04369","last_updated":"2021-10-08T20:25:48Z","snapshot_observed_at":"2026-07-06T11:56:00.533330Z","submitted_at":"2021-10-08T20:25:48Z","title":"A Loss Curvature Perspective on Training Instability in Deep Learning","version":1},"cited_work":{"arxiv_id":"2110.04369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.04369","snapshot_observed_at":"2026-07-04T13:59:52.030379Z","title":"A loss curvature perspective on training instability in deep learning,","venue":null,"work_id":"fb096c52-6fe0-4123-9820-9253c2d03633","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"cited_paper":"/paper/2110.04369","citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:296fec6136d9ca814582b3d4c89d1749c1cd56878de80f6d8e4399aa9ef8511a","observation_id":"c75d0a5c-6bb6-4895-a9e2-7e63564ac2df","resolution":{"observed_at":"2026-07-04T13:59:52.032131Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Cockpit: A practical debugging tool for the training of deep neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:f04f8261b536b1897358db2a322c669e0a3b49ee8317b3d17c9de357e38b271a","observation_id":"f9a9126c-25d7-4936-adcd-54ad18b82318","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/rest.90.3.414","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:37:31.013338Z","title":"Ruishi Chen, Victor R Lee, Annie Camey Kuo, Denise Clark Pope, and Sarah Miles","venue":null,"work_id":"ad60ef74-ebe8-4b60-8634-996ddc3bf516","year":2008},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:105daa74a212c12e5f1d4c22ed07373dfed5ce36997a6b3e291e163640a2ec0c","observation_id":"6f96cfde-236e-4f0a-96ee-6bf6b7e6ca00","resolution":{"observed_at":"2026-06-26T04:48:59.688225Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:08:06.76042+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:08:06.76042+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"A kernel two-sample test,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:73b4228e7eef7d36623e2722a8d33ae4073bfb2fbab0e778c705752326f6bf90","observation_id":"a1531fee-371a-4f22-a6df-6977348e0687","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Hidden technical debt in machine learning systems,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:3b87e94a78095dc5432cbc993e53968a0d46bdb26824d33d7ce7f7e93e7c793e","observation_id":"05e6fb99-82cc-4a5a-83c5-6b43122474e1","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3846.321386","doi":"10.1145/3213846.3213862","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Automatically translating bug reports into test cases for mobile apps","venue":null,"work_id":"f4ad434e-fe9b-4b97-8e10-90c7e47cc1f6","year":2018},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:8d232877170507cf4ac20049a0dd54da570bf329cb0b7daaba0d0329761df8b2","observation_id":"6246e4a3-92a2-4fdd-b749-707130c4846f","resolution":{"observed_at":"2026-06-26T04:48:59.755519Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3902.2021","doi":"10.1109/icse43902.2021","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Traceability transformed: Generating more accurate links with pre-trained BERT models","venue":null,"work_id":"9c933547-1e3e-4ec1-8486-51935f93e440","year":2021},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:ae32cd9f0cf734d4f68d080b93d1c85ce2397073e462ccf03890e8a37c43c9e3","observation_id":"cad5aed3-d9a2-43b5-a9e4-2a1f0eb82225","resolution":{"observed_at":"2026-06-26T04:48:59.761204Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:49:23.235888+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:49:23.235888+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:45:46.785605Z","title":"Detecting numerical bugs in neural network architectures,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:e47fa5cbc1a3616821f8166e608cda819d1dc72979ebc3c7f31fb973a12e862f","observation_id":"9325fdd7-7e55-4fb6-bd9c-9c84fdada9f4","resolution":{"observed_at":"2026-06-26T04:45:46.785605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1643.361624","doi":"10.1145/3611643.3616243","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"In: Chandra, S., Blincoe, K., Tonella, P","venue":null,"work_id":"4f3d1b5a-a5c0-4ade-bfd1-74209d85a9f2","year":2023},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:602f4729a99ebdb1cbebd867f72551cf6cf6de1c1d1b43b511bda5f1c50e792f","observation_id":"a7619762-d39a-4e9b-bf09-aa60130923df","resolution":{"observed_at":"2026-06-26T04:48:59.717594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T04:48:54.420554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T04:48:54.420554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.00021","doi":"10.1109/fg.2018.00021","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"https://doi.org/10.1109/fg.2018.00021","venue":null,"work_id":"3fb71a86-7485-4a0b-b883-54d77a0b2481","year":2018},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:339b0dc4b56d9140793870d704887f32d2c0c3cc3c7ded992a40962c2e43988b","observation_id":"8d8ecaa3-c1ce-4e6d-8489-48e8e14a7563","resolution":{"observed_at":"2026-07-04T13:59:52.024212Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16741","doi":"10.48550/arxiv.2512.16741","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"An empirical study of the realism of mutants in deep learning,","venue":null,"work_id":"38d405aa-d9b5-4da6-b9ee-770aed0b1f5a","year":2025},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:d363f7787096509daa7ed30d68b18f4ad6444acee2a0159a7a16b07d7dc00692","observation_id":"cb7c5a8c-4e26-4d5d-9299-4206e202723f","resolution":{"observed_at":"2026-07-04T13:59:52.021424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.272453","doi":"10.1109/tse.2017.2724538","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A comparative study to benchmark cross-project defect prediction approaches,","venue":null,"work_id":"ccdda532-253a-47be-856d-c4f50cace9e2","year":2018},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:7ee1f477c58ce2fffb4798fbd41a52141a705a164c4769d0b59b4631bab6448b","observation_id":"28966e13-1b08-45cb-b5e4-d638e3a46bb4","resolution":{"observed_at":"2026-06-26T04:48:59.710389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.00042","doi":"10.1109/icse.2019.00042","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Parashar et al","venue":null,"work_id":"e8392e37-33f7-4f79-8462-a23b964b8537","year":2019},"citing_paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T04:45:46.785605Z"},"links":{"citing_paper":"/paper/2606.26492"},"observation_digest":"sha256:075c5b390fd823d9f8a7bf5ebb780c35e0b00d50bb1b6616262775323a506c4f","observation_id":"44ecb89d-f8e3-4d3d-89df-bab8e2a205f4","resolution":{"observed_at":"2026-06-26T04:48:59.732470Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.26492","last_updated":"2026-06-25T00:52:22Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-01T17:14:05.311850Z","submitted_at":"2026-06-25T00:52:22Z","title":"Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":5,"metadata_mismatch":16,"parse_uncertain":0,"unresolved":10,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2606.26492."}