{"as_of":"2026-08-20T13:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54298d2723ad4631f8f5fc4bd82543e0bd194d0ed5b66772868bc1f9a32883c1","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:07:13.928037Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10806/citation-record","integrity":"/paper/2608.10806/integrity","json":"/paper/2608.10806/citation-record.json","paper":"/paper/2608.10806"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ipm.2018.06.005","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:13.973562Z","title":"A deep network model for paraphrase detection in short text 29 messages.Information Processing & Management, 54(6):922–937, 2018","venue":null,"work_id":"1449acf2-678a-4e56-a140-1557735825a9","year":2018},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.796233Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:a55d074061e7acd9852c823f2546050cbfb28561d49df3177e0663b128840aa8","observation_id":"1a1be73d-317c-4a57-98c0-fb99681b7f07","resolution":{"observed_at":"2026-08-12T17:07:13.981666Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07592","last_updated":"2023-12-11T08:49:18Z","snapshot_observed_at":"2026-08-16T14:35:58.311456Z","submitted_at":"2023-12-11T08:49:18Z","title":"Evaluating ChatGPT as a Question Answering System: A Comprehensive Analysis and Comparison with Existing Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07592","snapshot_observed_at":"2026-08-12T17:07:13.802210Z","title":"Evalu- ating ChatGPT as a question answering system: A comprehensive analysis and comparison with existing models.arXiv preprint arXiv:2312.07592, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.802210Z"},"links":{"cited_paper":"/paper/2312.07592","citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:e2b91dd4a63e99f30b99b861f8dbbf37276fb0c9f7c90fef5a98fa873e90fd79","observation_id":"c0d6c6af-989f-4cad-9eb2-fd5b364f1c3a","resolution":{"observed_at":"2026-08-12T17:07:13.802210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.382771Z","title":"Understanding dropout.Advances in neural information processing systems, 26, 2013","venue":null,"work_id":"25ae8222-979a-4319-8124-302cb99a1948","year":2013},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.807297Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:78a35c97327ae5d28c79df8ce002b19f48188c800c5cfc2279cd61ff3cebe5da","observation_id":"809d3d01-6bef-4d9c-bd9e-9eae6d8a8114","resolution":{"observed_at":"2026-08-12T17:07:14.387198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:13.811516Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.811516Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:d4cc2524013cfd3625836c3eb60b784149b4d804edccebb0a61afdf56c3c994a","observation_id":"fef1ec1e-a644-4c25-954c-594549ec1180","resolution":{"observed_at":"2026-08-12T17:07:13.811516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.362403Z","title":"QuAC: Question answering in context","venue":null,"work_id":"620c13a0-84f0-4369-9614-a39e753dd3ec","year":2018},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.815803Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:5a6a86433dbc63f07aab2873ec2db3ee9db170f3c7fbaec48fb6bdc3e500b1b3","observation_id":"61c26466-de22-4f5c-b7be-709bbd1b0260","resolution":{"observed_at":"2026-08-12T17:07:14.367584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.348498Z","title":"BERT: Pre-training of deep bidirectional transformers for language un- derstanding","venue":null,"work_id":"9cafe6d3-54cf-4df9-afe3-551d0f4f5acd","year":2019},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.820693Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:3f5f1761dddc9916c97801cfa0a0250c1689f8d6ae76b401346416c3c2075d33","observation_id":"ace65953-b12c-4f6a-91f8-cd1ec0e1ac54","resolution":{"observed_at":"2026-08-12T17:07:14.353272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.336920Z","title":"A review on different methods of paraphras- ing","venue":null,"work_id":"62f3d082-3c0c-414d-9dcf-983fbce51316","year":2016},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.825247Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:1b0c522504e69797c70cf37ad2a0f10d5564254eba1e2d2c0ea02261be4593c5","observation_id":"db6180b0-1349-45fd-8a43-e49130a750d6","resolution":{"observed_at":"2026-08-12T17:07:14.340648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.325168Z","title":"Natural language based analysis of SQuAD: An analytical approach for BERT.Expert Systems with Applications, 195:116592, 2022","venue":null,"work_id":"4f69e4d5-6bcb-4e29-a04e-fd95e6c86005","year":2022},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.829444Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:9a2465806155e0a3f7a62e4fde59e6ccc7a8cbd7205f091dd7af151c0742c089","observation_id":"f1a20b2e-63dd-4963-b858-61a04f68f717","resolution":{"observed_at":"2026-08-12T17:07:14.329348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.312853Z","title":"A survey on hallucination in large language models: Principles, tax- onomy, challenges, and open questions.ACM Transactions on Information Systems, 43(2):1–55, 2025","venue":null,"work_id":"42877bd0-a31a-437d-81a5-c965a4d77a1d","year":2025},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.833219Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:673f7b05eef5038d637d59218c47a21610edbb7150948588f92f8a8efca29aa0","observation_id":"1c6a893d-71ea-4184-b24e-4d76ec5f1ca1","resolution":{"observed_at":"2026-08-12T17:07:14.317049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.299742Z","title":"AlBERT: A lite BERT for self-supervised learning of language representations.International Conference on Learning Representations., 2020","venue":null,"work_id":"c489e11f-5c32-4024-b0d7-c964d1943061","year":2020},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.837113Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:fa01ebabad5e71d3a38b89fd1bcb5ef16dee3c27c1642f1bf28d07ac1c887626","observation_id":"bbbac51a-40b2-4f7e-a93b-09afb0ad4b3a","resolution":{"observed_at":"2026-08-12T17:07:14.303939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.287275Z","title":"The measurement of observer agree- ment for categorical data.biometrics, pages 159–174, 1977","venue":null,"work_id":"8796f654-7156-4fd5-a713-fdcec5d23d50","year":1977},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.840547Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:cacc812a0b872b2a3ac57af8ba928beb2fcc42f290f89bb072da835e7b4d701d","observation_id":"6f110daa-c66d-4820-813e-d57af02c7443","resolution":{"observed_at":"2026-08-12T17:07:14.291640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.09665","last_updated":"2021-10-19T00:15:19Z","snapshot_observed_at":"2026-08-16T17:48:18.149645Z","submitted_at":"2021-10-19T00:15:19Z","title":"Ensemble ALBERT on SQuAD 2.0","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.09665","snapshot_observed_at":"2026-08-12T17:07:13.844836Z","title":"Ensemble AlBERT on SQuAD 2.0","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.844836Z"},"links":{"cited_paper":"/paper/2110.09665","citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:dab5a7568c8188e20d280009648d10a0547cfa906a533cf7c41179b67f848142","observation_id":"44efd00f-0caf-4c1e-bc4d-24bbcd777ece","resolution":{"observed_at":"2026-08-12T17:07:13.844836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.276061Z","title":"How can rec- ommender systems benefit from large language models: A survey.ACM Transactions on Information Systems, 43(2):1–47, 2025","venue":null,"work_id":"54a77807-e1f8-4c5d-8719-df92a9eb619e","year":2025},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.849240Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:9ea542f1e42eac6c53ebc2c9089dfa311a39b938f11cd66156cfbe9d1d5c7120","observation_id":"6431219a-9d4f-499a-bc88-067e32f36e0e","resolution":{"observed_at":"2026-08-12T17:07:14.280073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-12T17:07:13.853253Z","title":"RoBERTa: A robustly optimized BERT pretraining approach.arXiv preprint arXiv:1907.11692, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.853253Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:17a731d0d7cf3ddb59e15515fc978274501e63edb465f34032f6b92c6da58dbf","observation_id":"e7313363-cee6-4234-85c5-b501c2b4225c","resolution":{"observed_at":"2026-08-12T17:07:13.853253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.262989Z","title":"Le- dlcm: Decoupled learner and course modeling with large language mod- els for enhanced course recommendation.Knowledge-Based Systems, page 115135, 2025","venue":null,"work_id":"8387f314-2fc9-443a-b0ba-5dc6c27bb3e7","year":2025},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.857645Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:9cb2d3877b1634d12063c6e794781e3d3fc18d08f423d00d80e9d5a21d78bf0c","observation_id":"256fdb18-4bbf-4da5-afd8-a82554963bba","resolution":{"observed_at":"2026-08-12T17:07:14.267735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.250417Z","title":"Prediction uncertainty estimation for hate speech classi- fication","venue":null,"work_id":"ce91851c-b4a4-4cdc-bde1-7908b8d4c605","year":2019},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.861205Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:86900847f1c9f1953171858ce193dc9014a99383c1271ee9c80a4d13808233ce","observation_id":"cb0c8fec-297e-4c44-9b74-4d9a180f41b1","resolution":{"observed_at":"2026-08-12T17:07:14.254860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.233908Z","title":"To BAN or not to BAN: Bayesian attention networks for reliable hate speech detection.Cognitive Computation, 14(1):353–371, 2022","venue":null,"work_id":"61cb6081-c735-4d02-867a-a11b9a96bd1b","year":2022},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.864818Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:07c5fcb86e90dabdbc8cf274e774da960505e630c7acb1f3aff742d635bf9b88","observation_id":"bfd236f4-cd8f-4427-9e37-2d7407aea040","resolution":{"observed_at":"2026-08-12T17:07:14.239856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.218436Z","title":"Extractive text summarization.International Journal of Current Engineering and Technology, 4(2), 2014","venue":null,"work_id":"66efed9e-d544-47bb-9813-5ad955e57c2c","year":2014},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.868822Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:e927374ea617c4c26178a20c38f3cbb020cd2cf32e46cb8b9baa912f0cb04793","observation_id":"4f963bdd-a472-4ff5-8847-e890ca0386b9","resolution":{"observed_at":"2026-08-12T17:07:14.222950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.200781Z","title":"Transformer models used for text- based question answering systems.Applied Intelligence, 53(9):10602–10635, 2023","venue":null,"work_id":"7a210af2-c975-4cff-9c79-343d7fbed105","year":2023},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.872173Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:c1457ffe91ee685ed701a0449ef626806a1b320310ff98e2f1ee690f29f85fa2","observation_id":"3d77e757-ddd7-4a69-87f7-00f970367124","resolution":{"observed_at":"2026-08-12T17:07:14.207782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.185376Z","title":"Comparative analysis of state-of-the-art Q&A models: BERT, RoBERTa, DistilBERT, and ALBERT on SQuAD v2 dataset","venue":null,"work_id":"d549825a-f876-425e-bcca-f3d44dd165ca","year":2024},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.876174Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:c76c98369a0c83c63412ea1b8d26866ddc6b953a78de90592853b7aeb949d72b","observation_id":"70b058c0-b6d8-4991-b803-5ca724cee30b","resolution":{"observed_at":"2026-08-12T17:07:14.191199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03142","last_updated":"2021-10-07T02:23:19Z","snapshot_observed_at":"2026-08-19T08:46:11.762402Z","submitted_at":"2021-10-07T02:23:19Z","title":"A Comparative Study of Transformer-Based Language Models on Extractive Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03142","snapshot_observed_at":"2026-08-12T17:07:13.879930Z","title":"A com- parative study of transformer-based language models on extractive question answering.CoRR, abs/2110.03142, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.879930Z"},"links":{"cited_paper":"/paper/2110.03142","citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:95a68099a8b4ff7fbcb5361379ed4f1183160c152aad46e520c467a1e4d305b5","observation_id":"df9fb125-105e-4acb-912d-60417516aef7","resolution":{"observed_at":"2026-08-12T17:07:13.879930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05853","last_updated":"2023-04-11T18:53:23Z","snapshot_observed_at":"2026-08-18T10:43:05.658555Z","submitted_at":"2022-11-10T20:21:07Z","title":"Measuring Reliability of Large Language Models through Semantic Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05853","snapshot_observed_at":"2026-08-12T17:07:13.884589Z","title":"Measuring relia- bility of large language models through semantic consistency.arXiv preprint arXiv:2211.05853, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.884589Z"},"links":{"cited_paper":"/paper/2211.05853","citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:ec0c2b9c63ec75a376ecc05f86f67a28d4b77580a36eb39122e11605c2bfb3f1","observation_id":"1464a2e5-5be2-4b48-8107-a2b35a8a81b6","resolution":{"observed_at":"2026-08-12T17:07:13.884589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09138","last_updated":"2025-04-29T03:03:10Z","snapshot_observed_at":"2026-08-19T12:54:53.032956Z","submitted_at":"2023-08-17T18:11:33Z","title":"Semantic Consistency for Assuring Reliability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09138","snapshot_observed_at":"2026-08-12T17:07:13.888804Z","title":"Semantic consistency for assuring reliability of large language models.arXiv preprint arXiv:2308.09138, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.888804Z"},"links":{"cited_paper":"/paper/2308.09138","citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:58f02f94fa38588f0293b22c9daaa075a21061e51313e0c8c7f43b5ed4f64b6b","observation_id":"19cf3f82-9002-42f9-acce-68aa7cca06f3","resolution":{"observed_at":"2026-08-12T17:07:13.888804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:13.893018Z","title":"SQuAD: 100,000+ questions for machine comprehension of text","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.893018Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:985ea4a901c705e6cef24781cceadc75cbd82e8f3234e26b908d3a8a5082478b","observation_id":"031251a5-ce00-49fd-942d-adc4b08a7d4a","resolution":{"observed_at":"2026-08-12T17:07:13.893018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.167338Z","title":"Comparative analysis of transformer based models for question answering","venue":null,"work_id":"f3ad5ea1-23d9-4cd0-9eef-1979dc54adf3","year":2022},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.896988Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:87fd8295100f72f0c330babe83888e8cea46fc922bb70f4b23b7ea1424fd85df","observation_id":"38b4b519-2685-4ac9-8a9c-b66c043b5284","resolution":{"observed_at":"2026-08-12T17:07:14.171760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.152201Z","title":"Llm4rec: a comprehensive sur- vey on the integration of large language models in recommender sys- tems—approaches, applications and challenges.Future Internet, 17(6):252, 2025","venue":null,"work_id":"40454960-357b-4b55-bc50-fc87ca6db6a6","year":2025},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.900875Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:4a9b4aadbe94124bba5b74a322db2db55a091419e3ce165056220d30007702b3","observation_id":"6d96e53a-adc5-4eea-9b88-941fcc0de66f","resolution":{"observed_at":"2026-08-12T17:07:14.157317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.136866Z","title":"How does BERT answer questions? A layer-wise analysis of transformer representations","venue":null,"work_id":"45dc59aa-635f-4ba0-98d0-47dea26ef974","year":2019},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.905068Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:bcd81db1b43f91ef681479b853170779a25ca3bdef6f0e76b9e1ad274d61ea36","observation_id":"8e758bb8-2414-493b-9e79-6fb320c7ac7c","resolution":{"observed_at":"2026-08-12T17:07:14.141090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.123682Z","title":"Attention is all you need.Advances in Neural Information Processing Systems, 2017","venue":null,"work_id":"242cffc5-80b6-45ba-9952-3bbcaade028c","year":2017},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.909022Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:b3a20987d71a26940db6baccd67d68e74d2669653dc6006ab9fd4a47e5dd403c","observation_id":"c8df97b6-44f9-4f9f-a6e3-fc43e0bd5e64","resolution":{"observed_at":"2026-08-12T17:07:14.127832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.111346Z","title":"Assessing factual reliability of large language model knowledge","venue":null,"work_id":"c45704a2-dda2-4a98-9b6c-ddc1944a1791","year":2024},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.913391Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:10d70b83779b8e29cb4ab0b1816c5f94b4639748ab692c7cb59a3b5caca3cada","observation_id":"6347be6f-55f6-4047-b467-32c692df14b7","resolution":{"observed_at":"2026-08-12T17:07:14.115356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:13.916977Z","title":"A survey on large language models for recommendation.World Wide Web, 27(5):60, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.916977Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:d54b8d49103d1693595c559463893e25f385b8bd0f6113dcfe77528f587130ab","observation_id":"d5a1f25d-9ccd-4c88-a047-9ac803115b01","resolution":{"observed_at":"2026-08-12T17:07:13.916977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.092767Z","title":"Paraphrasing for style","venue":null,"work_id":"d0aa37ec-e46d-4ec7-8a94-8bb9c7c489e4","year":2012},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.920638Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:6b5d394cbd46a7e3068bb7e872cd3a3d64ffb1c31c7d3c24e40b74ab00357719","observation_id":"45d470b3-ae63-4002-befa-9877fe02bbe9","resolution":{"observed_at":"2026-08-12T17:07:14.096741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:07:14.080689Z","title":"Pegasus: Pre- training with extracted gap-sentences for abstractive summarization","venue":null,"work_id":"2aba0408-7144-42b6-bd1d-1ae2622d702e","year":2020},"citing_paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T17:07:13.928037Z"},"links":{"citing_paper":"/paper/2608.10806"},"observation_digest":"sha256:47a2942b3b266edde6bc7000e4759fad3384b7f96ea19e895893ed87c9382918","observation_id":"f08d81ca-eb04-4ba1-8a8f-e35d39b4b52d","resolution":{"observed_at":"2026-08-12T17:07:14.085150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10806","last_updated":"2026-08-11T11:24:07Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T16:14:50.640359Z","submitted_at":"2026-08-11T11:24:07Z","title":"Assessing Reliability of BERT-Based Models on Question Answering Tasks"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2608.10806."}