{"as_of":"2026-08-04T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0296fff0fd15441aa65b72bf2a1fdff6478017de82bcb55ddc80521e00ad207d","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T03:36:19.324055Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T22:06:55.065652Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T22:15:39.377383Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"cited_work":{"arxiv_id":"2604.24001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24001","snapshot_observed_at":"2026-07-08T22:15:39.377383Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","venue":"cs.AI","work_id":"11d85088-ad4d-49a9-a938-b099cff14391","year":2026},"citing_paper":{"arxiv_id":"2607.05880","last_updated":"2026-07-07T06:23:08Z","snapshot_observed_at":"2026-08-02T21:48:04.145448Z","submitted_at":"2026-07-07T06:23:08Z","title":"Harrison.Rad 1.5 Technical Report: A radiology foundation model that can draft reports from images, priors and clinical context","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-08T22:06:55.065652Z"},"links":{"cited_paper":"/paper/2604.24001","citing_paper":"/paper/2607.05880"},"observation_digest":"sha256:efdf511170444637c95e2c75b02d37114f5b956e78842f189137a0b58ce88dff","observation_id":"bf4a4430-b9b0-49e2-8636-0f67762f4306","resolution":{"observed_at":"2026-07-08T22:15:39.379540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.24001/citation-record","integrity":"/paper/2604.24001/integrity","json":"/paper/2604.24001/citation-record.json","paper":"/paper/2604.24001"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:5c433599acf91c1238765715753762287631abf00a2e808d4e1e432fda3570d9","observation_id":"f16a8841-3237-4e42-82e8-6510f1a80485","resolution":{"observed_at":"2026-05-11T22:01:12.365300Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09167","last_updated":"2020-10-18T20:30:22Z","snapshot_observed_at":"2026-07-06T09:13:37.575194Z","submitted_at":"2020-04-20T09:46:40Z","title":"CheXbert: Combining Automatic Labelers and Expert Annotations for Accurate Radiology Report Labeling Using BERT","version":3},"cited_work":{"arxiv_id":"2004.09167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.09167","snapshot_observed_at":"2026-07-04T06:29:37.809700Z","title":"Y.; and Lungren, M","venue":null,"work_id":"ff4666e1-5c9c-41fe-833e-9937430114e5","year":2004},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"cited_paper":"/paper/2004.09167","citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:f07b2e4ecd7d89274f3baede356c1ce547b942cc6ab8d33e4691678f3b14fd2f","observation_id":"423a13e7-1f9b-4f8d-bf48-a47319d3975f","resolution":{"observed_at":"2026-05-11T22:01:12.374531Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.20047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T09:47:59.383975Z","title":"arXiv preprint arXiv:2503.20047 , year=","venue":null,"work_id":"37701fc1-8a18-430d-8eb9-b5ce452f1af8","year":2025},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:767a77638e571b5b4e7357232875920a85bddc212e22df80a9e5ca9a6a73123e","observation_id":"67ea59d1-cbe7-46e6-9957-56fd41b5e48a","resolution":{"observed_at":"2026-05-11T22:01:12.381065Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:30bbfb6510949f5dd720e10a90853b88381fc89e0c24c7dc82526e7e40a40005","observation_id":"8a056e19-126e-45fc-ae5b-0aeb14d38039","resolution":{"observed_at":"2026-05-11T22:01:12.355204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cb1d7004-ea8e-44ff-bc1b-ad96d5991ccf","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:83ac6322c666280f14a568c8fbbf8007826e6f5f76bda43b1a192750f3e50548","observation_id":"8cf3f65d-b32f-4c28-a338-4dd1d60ebf8e","resolution":{"observed_at":"2026-05-26T21:48:23.254337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"B Prompts in Experiment This appendix presents the specific prompts used during the experimental evaluation, as described in Section 3.3 and Section 5.2","venue":null,"work_id":"ab8f5450-956e-4b32-a419-46e9b2ca4d4f","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:7675da924578bf526273eb95105d1a5a5a9047588f44cd0d9d274e752a4e4211","observation_id":"07dadac1-28bf-4938-832a-d9e4646e3008","resolution":{"observed_at":"2026-05-26T21:48:23.278556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"C Evaluation Cost on Open-Source Models This section details the computational efficiency of our evaluation framework","venue":null,"work_id":"b1564232-7b49-4661-baab-5fd0fbed353d","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:9c8a6e6bbccb59ac0c7e7b992ad563a4f82147cc7cb353b72dda24b21247fd78","observation_id":"9d91e907-403e-47c1-a2ea-95c5030c8aaf","resolution":{"observed_at":"2026-05-26T21:48:23.299428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If an original sentence involves multiple findings or diseases, convert it into multiple sub-clauses, each corresponding to a different finding or disease","venue":null,"work_id":"ca2eb9ac-e635-4309-969b-ef242520d5f7","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:40d81b3dbcbded56a75e17d4a70c4f90fc671a98dc553acbb1e8acc89784e1ac","observation_id":"3d1ce8f1-549f-413a-ac9f-a8d38a243e8d","resolution":{"observed_at":"2026-05-26T21:48:23.287659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5bb35824-3eea-43a5-bb6a-fe84ca3a968c","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:cd56814bbfa31bab6e586f47af6677c95c4ce156a7db33880145f07e0b952b07","observation_id":"0c5bf883-588a-4463-a24d-9f0e74206071","resolution":{"observed_at":"2026-05-26T21:48:23.265901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Use <step1> and </step1> as tags to enclose the output","venue":null,"work_id":"9e030e51-3173-43e8-bf34-f33ade933730","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:15f5e8bfb4b1e042e61efbde4e148d53a25c4dcfd45ceebc3fd4fa3d8cb61e0c","observation_id":"8e597d12-53c1-4149-ac90-88ab6fbed4aa","resolution":{"observed_at":"2026-05-26T21:48:23.260002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a55128c5-7ee5-4eca-a387-03fe69b1e877","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:cb7111472eeed4beaae84de10117a3892a671c71ce009c340ae6fa46f7384b86","observation_id":"d014343e-91a3-42fe-af65-497fb900f909","resolution":{"observed_at":"2026-05-26T21:48:23.302309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Record all corresponding sentences in a list","venue":null,"work_id":"19ad6bd1-ec0d-434d-b977-3b13931863a5","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:c875c005c353b9c9fc2c45e136cd053ae290b85b20acf0d98ad8ff8025cb635f","observation_id":"ca91e9da-e454-4fa9-971d-5dc27b4c84f6","resolution":{"observed_at":"2026-05-26T21:48:23.271216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"44f2750f-6a29-4258-bb34-a1189a0bf4a9","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:6cc369f35d4325acc3df0e52f60ac3aa3515bdf875175ac9245793e9f23833a6","observation_id":"a921c2d9-1c15-4af5-98b4-7cdf91da499d","resolution":{"observed_at":"2026-05-26T21:48:23.284122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"fibrotic lesions in both lower lungs","venue":null,"work_id":"fbcbf495-2799-4ee7-93ac-9a1ff3f5e771","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:6cfc61c7f52c840c411c4d3ce5091cd71a47ed313c08f2c35534efa8ecfb6aed","observation_id":"6000dcf3-7391-4ac3-9067-955fe3b75f8b","resolution":{"observed_at":"2026-05-26T21:48:23.242602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b544930a-9ced-4979-bd5f-ed3be4bf3ee0","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:0569f03f7e51df991d2252da5d5fa4b925a85121f2f7588356707a1e80a31441","observation_id":"55a11482-51e3-4617-aefb-6c5d67d0074f","resolution":{"observed_at":"2026-05-26T21:48:23.290271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Step 2:If the CT report describes the <attribute> for the <disease>, refer to the attribute explanation and attribute examples, and extract the corresponding attribute content","venue":null,"work_id":"8ab9fd26-e14c-46d8-809e-c01245d2c866","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:55abda999588e22bd8e8ace26d538c2d0af425380b096ec5d3dec3c3db518c33","observation_id":"3b677cc8-ff79-4a91-b68b-712c4b1d89c8","resolution":{"observed_at":"2026-05-26T21:48:23.274827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3a0b762d-4292-41cb-a7a3-3092d628f07d","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:0235620c080d98a1489c23930e8bf0595e4834ce19d86257e2bb112771a69098","observation_id":"8e7de497-3544-4888-9361-71c9c0435be6","resolution":{"observed_at":"2026-05-26T21:48:23.262993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"location","venue":null,"work_id":"95ae6ef9-7d48-42d8-8554-f496be55fd6c","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:892d24c49e9a738fa336627b06bb56137ee301033d13f8954ce55e34890fb6a7","observation_id":"1805ef04-c780-49af-96b7-9cfc907e3b24","resolution":{"observed_at":"2026-05-26T21:48:23.281465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Note that the attribute examples do not represent all possible options for the attribute content; they are only representative examples","venue":null,"work_id":"08269f4c-6151-486d-8f1f-b93c398581ab","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:10952ea4749d6c96966902a744a7df432be774f5c55cb80b1dfaafa894e99530","observation_id":"85f69deb-6f35-4abe-950c-e8bd7fae5e14","resolution":{"observed_at":"2026-05-26T21:48:23.248775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Step 3:Based on the disease, the attribute, and the extracted content from Step 2, transform them into a question-answer pair","venue":null,"work_id":"739b5a68-c5f9-446b-82a7-76c98dc85b03","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:36f10d96e610a32a0653709cc7dc794aa347d3f569d567f7a370ed34f80e27bb","observation_id":"e8c378c5-403e-4c73-9e98-7ee7116a3390","resolution":{"observed_at":"2026-05-26T21:48:23.293160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"30f5c3de-d1ee-4a10-8570-8bbd598a7c5d","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:8a564bbbb1fbb8e06539546077d330d0acfacc8530651003363f2dbfb4a9ea6d","observation_id":"edb825b8-a649-4820-9593-58b66868d9d1","resolution":{"observed_at":"2026-05-26T21:48:23.249375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where is the location of lung opacity?","venue":null,"work_id":"25813b4b-be88-4cb5-b31c-9b69661ea14d","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:9d97a742e6ac2df42a15807045dd9f4b688284e8cd801926509e4032dca1c59a","observation_id":"78af1787-53df-4775-b0c9-2b7fe469246e","resolution":{"observed_at":"2026-05-26T21:48:23.296098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The question should use general terminology and avoid directly quoting specific words from the report","venue":null,"work_id":"f7320919-895c-4782-9eeb-b2d132c7559d","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:083090560d3beb02e9c349686d5bd1a4cd8c85e26fd228986e047af0f2637da4","observation_id":"26d34b35-78e7-472b-976e-f64c60cedc9f","resolution":{"observed_at":"2026-05-26T21:48:23.246421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Thoracic esophagus calibration was normal","venue":null,"work_id":"2db634dc-831d-42f1-bf18-c6ffbf9b5224","year":null},"citing_paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T03:36:19.324055Z"},"links":{"citing_paper":"/paper/2604.24001"},"observation_digest":"sha256:0e34304d8b193820f7767b991e8c7b106315af88f41cb395fa4f98cf517dfdbe","observation_id":"4e980ea4-dc5c-40ab-aa58-4d6e47e95ef5","resolution":{"observed_at":"2026-05-26T21:48:23.253681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.24001","last_updated":"2026-04-27T03:32:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:32:46Z","title":"CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2604.24001."}