{"as_of":"2026-08-10T05:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a682b41f8986692e9b2f65aa11f8b681b3cabc418c79d9890fad12819d5071e0","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:35:02.200196Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18725/citation-record","integrity":"/paper/2607.18725/integrity","json":"/paper/2607.18725/citation-record.json","paper":"/paper/2607.18725"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.311156Z","title":"Hallucinat- ing law: Legal mistakes with large language models are per- vasive","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.311156Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:42d18ca9ce06ad457ff3a4f35c1e996badf3be061ced4dd85d4413ed5abfcf76","observation_id":"cfb5f5cf-c373-4328-9452-5f56b60a118f","resolution":{"observed_at":"2026-08-01T14:35:00.311156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.388262Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.388262Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:f02b670ea894d7d33014908b3b72173aae1759746ca04ced7fba624c87e786f6","observation_id":"d27b908a-7e51-4369-a1c2-cd2c7a223d8a","resolution":{"observed_at":"2026-08-01T14:35:00.388262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.444639Z","title":"Cyberbench: A multi-task benchmark for evaluating large language models in cybersecurity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.444639Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:1b6b437ab22916a4fe6ed1b38def30fa02975cff5185a395f4499b61d9e737a0","observation_id":"528513e8-7f59-4a70-bcbc-d5b1f037c789","resolution":{"observed_at":"2026-08-01T14:35:00.444639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.522426Z","title":"Securebert: A domain- specific language model for cybersecurity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.522426Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:4b0d506afa184f90c67baaaa4139e5ca3db1e29f3a869190191d8d4869b16536","observation_id":"d7eaa887-da97-4f81-8840-be6d82f6ef63","resolution":{"observed_at":"2026-08-01T14:35:00.522426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.598937Z","title":"Generating fake cyber threat intelligence using transformer-based models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.598937Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:be1f7c8f7ea7b4d30c6becea4464f8a07d828e9f200f8b2b28bd3a0882f993bc","observation_id":"049a326f-44cd-4447-b444-daffeb01b8bf","resolution":{"observed_at":"2026-08-01T14:35:00.598937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.677755Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.677755Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:a8e5c0678b00d7773c34e6de2f07e3ec469381616a012b2d659d2aca0db2f655","observation_id":"39e9822c-417a-4411-886d-9fc1b5ab2ab0","resolution":{"observed_at":"2026-08-01T14:35:00.677755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.732172Z","title":"Recent advances in natural language processing via large pre-trained language models: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.732172Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:6bc3a056c8c82c3a853ebd2002995645be5065c5716d7af7371b320c7ec2aec6","observation_id":"71da1d47-b433-4e85-abbe-acd25b8e4c71","resolution":{"observed_at":"2026-08-01T14:35:00.732172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07521","last_updated":"2023-12-16T12:47:19Z","snapshot_observed_at":"2026-07-06T16:31:16.784700Z","submitted_at":"2023-10-11T14:18:03Z","title":"Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07521","snapshot_observed_at":"2026-08-01T14:35:00.801116Z","title":"Survey on factuality in large language models: Knowledge, retrieval and domain-specificity,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.801116Z"},"links":{"cited_paper":"/paper/2310.07521","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:d37d204aaa6c788ea3075beae3392d370672282e8da3e5f7afe4f116524cddb2","observation_id":"1c8a5979-8c70-4903-a903-7848aa3c303a","resolution":{"observed_at":"2026-08-01T14:35:00.801116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.884725Z","title":"Overcoming catastrophic forgetting in neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.884725Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:a575089418fec991aecd7f94189e14ee1263bd83fc8f0fcdecd4fca46936c709","observation_id":"4f1ac647-7197-4849-be75-f28d03a75a3d","resolution":{"observed_at":"2026-08-01T14:35:00.884725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:00.965739Z","title":"Parameter-efficient transfer learning for nlp,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:00.965739Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:8abacd0ff826c43bc29ff7b336a2af469743659e23cd746a26b415dbbda3f8f7","observation_id":"4d1ce60d-857a-46a3-bd84-0513eb3b3285","resolution":{"observed_at":"2026-08-01T14:35:00.965739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-01T14:35:01.019338Z","title":"The power of scale for parameter-efficient prompt tuning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.019338Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:62108595300b4755b91fbb69345291eddf1be9054d6cb03ed6f98c665f27284e","observation_id":"cda35a49-7669-409b-80dd-382ddd51d52e","resolution":{"observed_at":"2026-08-01T14:35:01.019338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07558","last_updated":"2023-04-19T04:28:24Z","snapshot_observed_at":"2026-08-09T23:49:57.663991Z","submitted_at":"2022-10-14T06:29:22Z","title":"DyLoRA: Parameter Efficient Tuning of Pre-trained Models using Dynamic Search-Free Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07558","snapshot_observed_at":"2026-08-01T14:35:01.076091Z","title":"Dylora: Parameter efficient tuning of pre-trained models using dynamic search- free low-rank adaptation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.076091Z"},"links":{"cited_paper":"/paper/2210.07558","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:41f7f53630b64e152237b5bfc7d952159924ccff70456b4b4d15da4bbf89ca2f","observation_id":"b40bfedf-0a4f-44bf-93aa-8ac8c80181cf","resolution":{"observed_at":"2026-08-01T14:35:01.076091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.159339Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.159339Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:91a6d52d3a64b49cadf2b603e7d5c8b1f0b739d983f05dbe940e6b5bedf5603a","observation_id":"d4023785-71b2-47e5-b0b1-a381bf59f755","resolution":{"observed_at":"2026-08-01T14:35:01.159339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07577","last_updated":"2022-09-04T23:31:05Z","snapshot_observed_at":"2026-08-01T19:07:06.818808Z","submitted_at":"2021-10-14T17:40:08Z","title":"UniPELT: A Unified Framework for Parameter-Efficient Language Model Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07577","snapshot_observed_at":"2026-08-01T14:35:01.221242Z","title":"Unipelt: A unified framework for parameter-efficient language model tuning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.221242Z"},"links":{"cited_paper":"/paper/2110.07577","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:f0d9073ec3d3ab3e82aa2c04e4a6f7947c1fa7cab755ea8033c6309526a3df2d","observation_id":"e424728d-fb7b-4f2d-bd4d-7448dcc057be","resolution":{"observed_at":"2026-08-01T14:35:01.221242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08073","last_updated":"2023-05-22T11:55:52Z","snapshot_observed_at":"2026-07-06T14:18:30.314936Z","submitted_at":"2022-11-15T11:53:55Z","title":"GLUE-X: Evaluating Natural Language Understanding Models from an Out-of-distribution Generalization Perspective","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.08073","snapshot_observed_at":"2026-08-01T14:35:01.293131Z","title":"Glue-x: Evaluating natural language understanding models from an out-of-distribution generalization perspective,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.293131Z"},"links":{"cited_paper":"/paper/2211.08073","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:279b472a67ad6d8dd256a7f65f575becda40ee829f64fad7891abbce93f088a2","observation_id":"7e54df66-2f73-4d7d-9f79-2f3b4f9176eb","resolution":{"observed_at":"2026-08-01T14:35:01.293131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04528","last_updated":"2024-07-16T07:29:49Z","snapshot_observed_at":"2026-08-07T20:45:44.253504Z","submitted_at":"2023-06-07T15:37:00Z","title":"PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04528","snapshot_observed_at":"2026-08-01T14:35:01.351523Z","title":"Promptbench: Towards evaluating the robustness of large language models on adversarial prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.351523Z"},"links":{"cited_paper":"/paper/2306.04528","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:d211c0f5dc533431c4b3c3389f9bc7a2f664eceeec07b6cb7fe7ecf7b315d31a","observation_id":"0fb91a91-a8a6-4c45-b562-b96172b8ce3a","resolution":{"observed_at":"2026-08-01T14:35:01.351523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09296","last_updated":"2024-07-01T03:38:57Z","snapshot_observed_at":"2026-07-06T15:43:03.878575Z","submitted_at":"2023-06-15T17:20:46Z","title":"KoLA: Carefully Benchmarking World Knowledge of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09296","snapshot_observed_at":"2026-08-01T14:35:01.430251Z","title":"Kola: Carefully benchmarking world knowledge of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.430251Z"},"links":{"cited_paper":"/paper/2306.09296","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:e7634e9d421d4dac6e03e4efb33d31de269391a17abda8e8771cb54794a46b20","observation_id":"e2827bf8-4a69-4e39-acec-6618a57bc6a0","resolution":{"observed_at":"2026-08-01T14:35:01.430251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.507429Z","title":"Large language models encode clinical knowledge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.507429Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:93f22994c30c9e42225fc6c488dad9d1b671f92bb1201e991d6a6c44518f4307","observation_id":"df108092-bbb4-4936-905b-299eb6f3d64a","resolution":{"observed_at":"2026-08-01T14:35:01.507429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.565978Z","title":"Not what you’ve signed up for: Compromising real-world llm- integrated applications with indirect prompt injection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.565978Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:6402cef91e22213abe85ad6b8837088ecc80d402779fc938b44b0bc1e016fec3","observation_id":"bbbb7d39-0ec8-479b-acea-2a09be3511ca","resolution":{"observed_at":"2026-08-01T14:35:01.565978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.640402Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.640402Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:c3303b1ec8397fbc082142ba3dea62a68f753c8fb37cbe8a6fcd1954189771fb","observation_id":"5bc5417d-2eae-46ab-af28-78783838ff2e","resolution":{"observed_at":"2026-08-01T14:35:01.640402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.691984Z","title":"National vulnerability database","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.691984Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:835c6a5ab0c9e60b9281bd896c74ace4ebe00acaf45133ed561b08b6b1b7f5e4","observation_id":"fe1c1159-6130-4254-adda-95ec373ab23b","resolution":{"observed_at":"2026-08-01T14:35:01.691984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.751210Z","title":"National vulnerability database","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.751210Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:e1491514c03c8861771f5444e7004f5c6397a0b907e92a4deffc8aa4aeffeb45","observation_id":"4c036bf6-f014-490f-aecc-a38a99499d37","resolution":{"observed_at":"2026-08-01T14:35:01.751210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15217","last_updated":"2025-04-28T05:09:12Z","snapshot_observed_at":"2026-08-05T02:02:34.574070Z","submitted_at":"2023-09-26T19:23:54Z","title":"Ragas: Automated Evaluation of Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15217","snapshot_observed_at":"2026-08-01T14:35:01.819091Z","title":"Ragas: Au- tomated evaluation of retrieval augmented generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.819091Z"},"links":{"cited_paper":"/paper/2309.15217","citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:b3a56ba27e4bdf7205fe6131974e944701f4d43e6564d044312803c0908e6b45","observation_id":"f2843a41-a870-43a5-942b-e3593e82962f","resolution":{"observed_at":"2026-08-01T14:35:01.819091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.885020Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.885020Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:fc26ac4501f48a72a7c438687f764805cdc320944fd4cac801d4afb1bb0515a9","observation_id":"63383686-bdc8-4891-a45b-12cd39abce7c","resolution":{"observed_at":"2026-08-01T14:35:01.885020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.946066Z","title":"A package for automatic evaluation of summaries,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.946066Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:fc1bb9bae904af16d27fd8cd79f6927b45d613b4585d41ec784a79c80c5fadec","observation_id":"e9900dfd-ce74-4bfe-989e-b5d14fdba33b","resolution":{"observed_at":"2026-08-01T14:35:01.946066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:01.999340Z","title":"Likert scales and data analyses,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:01.999340Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:3a935db470194fda5dd4c8da9720e5afec0fae315a9fbebc5d0e6a542d08f272","observation_id":"55e8b1df-9e2c-4e9b-81d0-6c22739466cd","resolution":{"observed_at":"2026-08-01T14:35:01.999340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:02.061431Z","title":"Interrater reliability: the kappa statistic,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:02.061431Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:d79cc95e819ba94de26246b4034bc8b73c34a2ced91c66230da5fb4fec2874dc","observation_id":"847d23bb-0eea-42e3-95de-ccc3492c329f","resolution":{"observed_at":"2026-08-01T14:35:02.061431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:02.120474Z","title":"Parameter-efficient fine-tuning of large- scale pre-trained language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:02.120474Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:e5f6f038932226d2823bb4bc9b809233ca8b9e71b1390b57991a8ed569990ce4","observation_id":"60d99845-446b-4ceb-b671-9b3e1fc7d460","resolution":{"observed_at":"2026-08-01T14:35:02.120474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:02.200196Z","title":"The art of abstention: Selective prediction and error regularization for natural language processing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:02.200196Z"},"links":{"citing_paper":"/paper/2607.18725"},"observation_digest":"sha256:a5acabe4eaf5c6e5bb86a7c6d4b64f13fcfda8c269997232e2a4b90bfbc707a2","observation_id":"6f7c16b2-a6f2-45b0-8e2e-6b72337a906c","resolution":{"observed_at":"2026-08-01T14:35:02.200196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18725","last_updated":"2026-07-21T05:32:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:46:20.302049Z","submitted_at":"2026-07-21T05:32:40Z","title":"Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2607.18725."}