{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:983f867a939f790f03553d4367fe8b1bfcba6f4aba9a2c479d3d917d30ae0851","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:36:46.250318Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02364/citation-record","integrity":"/paper/2507.02364/integrity","json":"/paper/2507.02364/citation-record.json","paper":"/paper/2507.02364"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:51.467555Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":"5b86cdf1-63da-4bba-9030-85eee1b06510","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.182782Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:de1a1187260a75b868d59a19a85e53567b405932f32c8346c6ff719fefc6fdff","observation_id":"528bf655-b90c-4e02-ae4d-54b15ee00b05","resolution":{"observed_at":"2026-08-06T20:36:51.642929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:51.193289Z","title":"Improving Language Understanding by Generative Pre-Training,","venue":null,"work_id":"b93bcb9f-e3a9-4d17-9851-8fef2abe1a84","year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.292122Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:27aa4dc35a6afdb556625b842bf46380a182583401ef18287889556be43e50e4","observation_id":"4f160cb9-00ed-457f-8950-27e28a5f1b3b","resolution":{"observed_at":"2026-08-06T20:36:51.310952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.951085Z","title":"Attention is All You Need,","venue":null,"work_id":"b6a5acbe-b6b7-4be9-a955-4a9e09f2fb70","year":2017},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.401565Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:40728815a0e91df8d7d0f56e717c7655dad7c99887ded53eea38d3028ee26452","observation_id":"958781e6-f138-4089-887e-48726cb51d96","resolution":{"observed_at":"2026-08-06T20:36:51.061094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.811151Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations,","venue":null,"work_id":"eb7c99aa-2067-4af9-8137-1bc41ff0923d","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.543988Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:becc979e4471b8b0dcb190bb3269db160f1a829f90856e0fa0d98f8ae70fa6dd","observation_id":"e6783fe1-78b3-4af7-ab5f-5771a3a58bbf","resolution":{"observed_at":"2026-08-06T20:36:50.882920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.647015Z","title":"Q-BERT: Hessian Based Ultra Low Precision Quan- tization of BERT,","venue":null,"work_id":"e58cbcf2-4183-46db-8c3a-4a1a4d0acf6a","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.671062Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:451c43d342c92268f606c38ede6a67fb6872ab5a0fe824c584937e97af913560","observation_id":"fd1b8fc8-5505-4cfb-80f7-1279085b2f40","resolution":{"observed_at":"2026-08-06T20:36:50.735229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.525503Z","title":"DistilBERT, a Distilled Version of BERT: Smaller, Faster, Cheaper and Lighter,","venue":null,"work_id":"6609ecb5-3b4d-4368-b3f5-c6d795550515","year":null},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.809652Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:2cf2d1213d77c68f4c9890cfd1a42675c98b5cb36ca935cd4684b80b4e3bc4b1","observation_id":"aa13fc0a-4b9f-4526-99da-16ad114c65f9","resolution":{"observed_at":"2026-08-06T20:36:50.609746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.400525Z","title":"Patient Knowledge Distillation for BERT Model Compression,","venue":null,"work_id":"c4d627c7-fde6-4d34-95d6-da1a968e3799","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.062501Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:44552bc9a19260469d7452ec6fa24b069f9b2a71c4d610d28658b4fdc3fc43f9","observation_id":"34c71715-fa41-4b04-9cb1-3f4b3f4f0efa","resolution":{"observed_at":"2026-08-06T20:36:50.446369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.250194Z","title":"MiniLM: Deep Self-Attention Distillation for Task-Agnostic Compression of Pre-Trained Transformers,","venue":null,"work_id":"ed4a0477-1200-489c-bd75-92e056fde34c","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.183916Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:26dcab0813a0ee7e23eea496d587fe6a6dd2d91640d7d485ba7b0c144cc59b66","observation_id":"0e1deae1-a96a-42ee-b3c4-dce0a40d210d","resolution":{"observed_at":"2026-08-06T20:36:50.340957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T20:36:44.310787Z","title":"LoRA: Low-Rank Adaptation of Large Language Models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.310787Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:2159222c2ec03915ca4842ea6fc929becc32180fae85871e1b96ae8d21b110fa","observation_id":"92e4d209-8be5-4e16-8aa9-37d73a018f13","resolution":{"observed_at":"2026-08-06T20:36:44.310787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:50.107817Z","title":"Parameter-Efficient Transfer Learning for NLP,","venue":null,"work_id":"37709099-c7db-49ab-a470-8cfe91a0fa89","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.435987Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:00ee9b170763b723b1f1220a0001c54c081c9bcad3a0f21ace174f14de0afbd6","observation_id":"ef3919a1-d378-48e7-b722-693e948ecb00","resolution":{"observed_at":"2026-08-06T20:36:50.193791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.958639Z","title":"A Variational Eigenvalue Solver on a Photonic Quantum Processor,","venue":null,"work_id":"5dae6358-53d9-4beb-9cdf-b098442baf76","year":2014},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.561514Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:8e0435cba7e6348f3f23ff30a3ffb62e62a9e6722f9605c62c918a87c1833dd0","observation_id":"06493a5e-1b0d-450b-8f4b-c03744043b78","resolution":{"observed_at":"2026-08-06T20:36:50.032201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.839610Z","title":"Quantum Self-Attention Neural Networks for Text Classification,","venue":null,"work_id":"44594a98-c0f4-4dff-afc7-740976d0597a","year":2024},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.638580Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:d2c3264fe1c762c1ad9ae3d3d5158cc7965c3dafdd86cb741a8d244487effef8","observation_id":"f4cfb8b4-1357-4fdd-8c2d-71e4cc7615b8","resolution":{"observed_at":"2026-08-06T20:36:49.877280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:44.699678Z","title":"Quantum Vision Transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.699678Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:2c0132ecc896cfbb94455b27ce5fe7e1d426a577686bf96ad39f0d4151af1ce6","observation_id":"9a7f843c-3a56-4f7b-87bb-ebaa3afa7257","resolution":{"observed_at":"2026-08-06T20:36:44.699678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.691129Z","title":"Quantum Computing with Qiskit,","venue":null,"work_id":"79050321-008b-41ab-8d34-c7ea545d9dd0","year":null},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.777681Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:f3a5a02372618fb22f1ea351a704f3dfe1b9d452de3edbb629437e6a57da12dd","observation_id":"948f5b19-9feb-4a43-8a99-10131c07788b","resolution":{"observed_at":"2026-08-06T20:36:49.749108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.525890Z","title":"PyTorch: An Imperative Style, High- Performance Deep Learning Library,","venue":null,"work_id":"8bbf042a-e013-413d-9f3a-48bd92f5b4f7","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.952038Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:9f15d3ce340c15cc2ff78fd850f9ec0b414cb2c248866b0d95f256fbfa08aebe","observation_id":"e1a472c4-344f-4beb-a891-a2e0f5ff9457","resolution":{"observed_at":"2026-08-06T20:36:49.599691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.376055Z","title":"Quantum Computing in the NISQ Era and Beyond,","venue":null,"work_id":"3d43b969-f938-4af0-b772-c06fcf941ea4","year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.046415Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:5f5e000c8a8ec4a58158e5c96db5397f3f8118fb0f05e09937253148826e790e","observation_id":"9b6ae8b5-9001-4e7b-b4ba-dfbe7b7c34ef","resolution":{"observed_at":"2026-08-06T20:36:49.457641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:49.153900Z","title":"MobileBERT: a Compact Task-Agnostic BERT for Resource-Limited Devices,","venue":null,"work_id":"7ac50e74-4357-400b-846e-d355c0a986be","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.109753Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:dd7bfa774c3d52be8bb647006eeb2b793e4e7f84cbfc84d2a42718a14e30e495","observation_id":"c90040c0-c9fb-46ce-acdb-f7f1f2b65ba0","resolution":{"observed_at":"2026-08-06T20:36:49.233491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.982679Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding,","venue":null,"work_id":"7456045f-eb5c-4a7d-a9ba-e77e509a5a50","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.188487Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:02e6fcaa6a1dc19500cf11d5f22f747b551fc1d15903bffc01002824d35abd3a","observation_id":"85aadf26-5214-4c2a-b112-532feaf9e1a6","resolution":{"observed_at":"2026-08-06T20:36:49.066402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.790214Z","title":"Supervised Learning with Quantum- enhanced Feature Spaces,","venue":null,"work_id":"3ff13d58-5e34-481e-88d7-f222762c2a06","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.242937Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:3ae8cdb086db335fd689512405c697e7474e55af2d7b464504615344771526e7","observation_id":"e1110df6-8703-4185-8f11-d6e8d8292ddf","resolution":{"observed_at":"2026-08-06T20:36:48.870150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06002","last_updated":"2018-08-30T20:23:02Z","snapshot_observed_at":"2026-08-04T12:41:10.101872Z","submitted_at":"2018-02-16T16:09:34Z","title":"Classification with Quantum Neural Networks on Near Term Processors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06002","snapshot_observed_at":"2026-08-06T20:36:45.286794Z","title":"Classification with Quantum Neural Networks on Near Term Processors,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.286794Z"},"links":{"cited_paper":"/paper/1802.06002","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:b828ce2b1e23d94d950c9fb58c15ea47a8556775079f25e8eb08e316e7f93715","observation_id":"678d4324-a866-449f-bea6-2ef7d7359d09","resolution":{"observed_at":"2026-08-06T20:36:45.286794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.553539Z","title":"Quanvolutional Neural Networks: Powering Image Recognition with Quantum Circuits,","venue":null,"work_id":"e041da59-c6ee-43a4-bfc9-43a01bf0ba14","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.344647Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:11441fdc898ffcb09c1fc6a7960b5e545232c8b6c4a320d2107ee1ada9497da3","observation_id":"bdbde046-40e8-4aee-9ace-cea59b5326c7","resolution":{"observed_at":"2026-08-06T20:36:48.624041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03755","last_updated":"2020-12-07T14:49:33Z","snapshot_observed_at":"2026-07-31T19:22:55.319435Z","submitted_at":"2020-12-07T14:49:33Z","title":"Foundations for Near-Term Quantum Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.03755","snapshot_observed_at":"2026-08-06T20:36:45.375653Z","title":"Foundations for Near-Term Quantum Natural Language Processing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.375653Z"},"links":{"cited_paper":"/paper/2012.03755","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:843f8998b56e9d1180f1911367c8f9aedea5dadeabf42c46613476f0af100d06","observation_id":"057dcb9b-8b08-4834-b1c1-e117b3e2f4dc","resolution":{"observed_at":"2026-08-06T20:36:45.375653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.376558Z","title":"The Dawn of Quantum Natural Language Processing,","venue":null,"work_id":"026702a3-5ae8-4a6a-a796-a4fbbf169f50","year":2022},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.467188Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:619e2e9017d2655750975a2b7d25966a9b7eb3c47bdb2333f7a61295764b3480","observation_id":"70f0e1e9-d2be-46da-8d90-627d33d660c5","resolution":{"observed_at":"2026-08-06T20:36:48.479911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:48.221861Z","title":"Cost Function Dependent Barren Plateaus in Shallow Parametrized Quantum Circuits,","venue":null,"work_id":"e5468b70-b2e2-406d-b858-f86a7a7533d4","year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.561062Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:d51ddebe3c167d5b91e13cac7c27da23fa536b8bf15fde42d28da46dd2805edf","observation_id":"0b3a4898-ade5-40a4-9849-7df8f9e68882","resolution":{"observed_at":"2026-08-06T20:36:48.280009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.963582Z","title":"Absence of Barren Plateaus in Quantum Convolutional Neural Networks,","venue":null,"work_id":"5fa24ec4-55dc-4610-925b-95da1b0260ce","year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.612769Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:82e0816fd031959d5bc97f80210e130fce0480d39beabd271d0a7e07269d0430","observation_id":"27590df4-685e-4efd-afa7-a5ea59e143ac","resolution":{"observed_at":"2026-08-06T20:36:48.102139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.742995Z","title":"Recursive Deep Models for Semantic Compositionality Over a Sentiment Treebank,","venue":null,"work_id":"ec5bba0e-c3bb-4bb6-b406-06c8d5d87a6d","year":2013},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.648112Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:2a0f187815cbd5e275e06b9d4bbf1368627d089a38b36e83f35ed96641eb1e8f","observation_id":"be257a53-c18a-4060-9156-35a0b5cd3973","resolution":{"observed_at":"2026-08-06T20:36:47.867875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.509798Z","title":"DBpedia-Entity V2: A Test Collection for Entity Search,","venue":null,"work_id":"77c93636-55e5-4fe1-a02f-f0358d6ae5dd","year":2017},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.699472Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:16300e36da61b161d65e50d5dc24222bca5b96e72bc50967a665f409f7d2e722","observation_id":"343d9f91-8f88-4a3f-9350-8b0c8bc1db61","resolution":{"observed_at":"2026-08-06T20:36:47.665509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07316","last_updated":"2023-03-19T13:37:01Z","snapshot_observed_at":"2026-07-06T14:04:58.943383Z","submitted_at":"2022-10-13T19:42:08Z","title":"MTEB: Massive Text Embedding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07316","snapshot_observed_at":"2026-08-06T20:36:45.741141Z","title":"MTEB: Massive Text Embedding Benchmark,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.741141Z"},"links":{"cited_paper":"/paper/2210.07316","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:a283080afed90b51f167d36e0db36fd171fa6643b92fefedc059140be407dbdf","observation_id":"4b032687-7e12-42f5-aa60-6fc2f7f1174d","resolution":{"observed_at":"2026-08-06T20:36:45.741141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08962","last_updated":"2019-09-25T22:55:20Z","snapshot_observed_at":"2026-08-01T21:55:51.630328Z","submitted_at":"2019-08-23T18:02:05Z","title":"Well-Read Students Learn Better: On the Importance of Pre-training Compact Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08962","snapshot_observed_at":"2026-08-06T20:36:45.789946Z","title":"Well-Read Students Learn Better: The Impact of Student Initialization on Knowledge Distillation,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.789946Z"},"links":{"cited_paper":"/paper/1908.08962","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:37202dc0997f87601026eb1688c8504fe7384905e50e01ae9a0bfefd17d5c274","observation_id":"2275fc31-732d-48c8-8c54-46dc8e0b0da4","resolution":{"observed_at":"2026-08-06T20:36:45.789946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.315627Z","title":"Generalization in NLI: Ways (Not) To Go Beyond Simple Heuristics,","venue":null,"work_id":"42b2351d-42bd-4c6b-9319-b63e62ff3f94","year":2021},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.893080Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:198c5d169d1612f4c2fc4d2e95d63ee43830d82ccf848d9a64e7cb248ab537a8","observation_id":"1debd108-568f-426f-a84c-8fe4d9ad088e","resolution":{"observed_at":"2026-08-06T20:36:47.411669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:47.135043Z","title":"Transformers: State- of-the-Art Natural Language Processing,","venue":null,"work_id":"aa16e524-ab37-4268-ba49-9f1a6730e734","year":2020},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:45.997529Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:49c862b9ecfc50ac7a50b5e90487b646afb64245629023aacceaa2edb3c29f31","observation_id":"e2aef60b-0553-4fb3-8aad-e9a7e97cb8f9","resolution":{"observed_at":"2026-08-06T20:36:47.217751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.906810Z","title":"Expressibility and Entangling Capability of Parameterized Quantum Circuits for Hy- brid Quantum-Classical Algorithms,","venue":null,"work_id":"24cfb6ab-53e9-4413-a08e-7e6a661ec23d","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.066654Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:c9c330d371600e1ef26cad84f6d01235e60628b57c04d5b60101e7ded3a0c21e","observation_id":"027b3bbe-ce98-4a42-97b2-01615bf988f9","resolution":{"observed_at":"2026-08-06T20:36:47.005156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.764605Z","title":"Barren Plateaus in Quantum Neural Network Training Landscapes,","venue":null,"work_id":"72322189-6b74-430d-b5a2-a3e3b981af61","year":2018},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.131673Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:b7acbd1515f160a02c08fcfe93fe7fc9615acb09a43892f661ef35105456362f","observation_id":"c59ea58f-ac8e-4653-9853-88a2d8dccfdb","resolution":{"observed_at":"2026-08-06T20:36:46.802689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.629580Z","title":"An Initializa- tion Strategy for Addressing Barren Plateaus in Parametrized Quantum Circuits,","venue":null,"work_id":"8522edee-684a-4e8c-a4af-7a4df5caf867","year":2019},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.197571Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:4811e9b33cb9bff8f1720bc36b9fdf0ba793b5eb1ea0516ffa8a6a9f4ddd394c","observation_id":"e7c51b2f-0d97-4fbf-812f-5465c3f5a13c","resolution":{"observed_at":"2026-08-06T20:36:46.675709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:46.447953Z","title":"cuQuantum SDK: A High-Performance Library for Accelerating Quantum Science,","venue":null,"work_id":"b0a1931e-fd00-495f-9abd-c8639731a827","year":2023},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:46.250318Z"},"links":{"citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:9ec6ec6b9f88a94573820d8fe88f27beb40a808323250f5b6d4fdf3d2e3d70f8","observation_id":"5b0c8982-e16d-4e24-ab1f-10c8a2949970","resolution":{"observed_at":"2026-08-06T20:36:46.528651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-06T20:36:43.932706Z","title":"Available: https://arxiv.org/abs/1910.01108","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:43.932706Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:8bb9a926b97e89396e2d0eec9a74a35a3489fe57c7b2fff042e53207d57c54f1","observation_id":"48682448-2915-4465-918f-ea75a90f3168","resolution":{"observed_at":"2026-08-06T20:36:43.932706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08810","last_updated":"2024-06-19T01:39:44Z","snapshot_observed_at":"2026-07-06T18:14:20.889736Z","submitted_at":"2024-05-14T17:55:32Z","title":"Quantum computing with Qiskit","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08810","snapshot_observed_at":"2026-08-06T20:36:44.834762Z","title":"Available: https://arxiv.org/abs/2405.08810","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T20:36:44.834762Z"},"links":{"cited_paper":"/paper/2405.08810","citing_paper":"/paper/2507.02364"},"observation_digest":"sha256:367734e12b3bb358587b42fa5961a933d570bbbf5e5e9aa4729074292aaba345","observation_id":"71f625f6-2591-4515-a751-81f927bf9537","resolution":{"observed_at":"2026-08-06T20:36:44.834762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02364","last_updated":"2025-07-03T06:52:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:47:16.628644Z","submitted_at":"2025-07-03T06:52:44Z","title":"QFFN-BERT: An Empirical Study of Depth, Performance, and Data Efficiency in Hybrid Quantum-Classical Transformers"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2507.02364."}