{"as_of":"2026-08-23T19:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f4dd9a8f525d95ea64619cac82a5ac039a5c865dabd802dadf23b50b9943ea70","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:40:20.119983Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12893/citation-record","integrity":"/paper/2412.12893/integrity","json":"/paper/2412.12893/citation-record.json","paper":"/paper/2412.12893"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.510957Z","title":"Evaluating chatgpt as a question answering system: A comprehensive analysis and comparison with existing models, 2023","venue":null,"work_id":"02a45fd8-8eed-42e7-b51d-90a2f4320f2f","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:19.981804Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:ae847b3a664fad4b6366f77521bb2edfc092164b40f095bee4853a438738014a","observation_id":"6fa456a7-8ed5-4745-ac16-cb51cc04249e","resolution":{"observed_at":"2026-08-11T13:40:20.515158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:19.986193Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:19.986193Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:6337e5e7809749726544eaf3b7a0c3489516fdaaee6c6bd18e5af597517ff060","observation_id":"3cb23c34-3daf-44f3-8f2e-b2845a451133","resolution":{"observed_at":"2026-08-11T13:40:19.986193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.493715Z","title":"W., Hou, L., Longpre, S., Zoph, B., Tay, Y., Fedus, W., Li, Y., W ang, X., Dehghani, M., Brahma, S., Webson, A., Gu, S","venue":null,"work_id":"1b52cf0f-abe6-47e9-871a-b75715588f49","year":2022},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:19.990051Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:e53ce54b2c35c8a41ba5cb8490ec2423d5c4deb5c95e3a525368fad851336c23","observation_id":"896969bc-0fcb-40ef-9e76-b5e0641d14a3","resolution":{"observed_at":"2026-08-11T13:40:20.497505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T13:40:19.994019Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:19.994019Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:dedd23c706bc179a7fd733035dc1f2e05ab9683cf72ca9b35c3ed5d25a40f063","observation_id":"172273a3-e5c7-4cff-9612-d9904d0ed1f1","resolution":{"observed_at":"2026-08-11T13:40:19.994019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.483500Z","title":"F., Wold, A","venue":null,"work_id":"808f677e-ba29-4eb0-83ba-57f310c07ceb","year":1961},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:19.998823Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:ff88ae90c6135b2e925b6a6167ad7f9e4011d1d4ac4b3b8c257233430ebd96a6","observation_id":"17aeab3c-d940-475c-bc4f-e6be3610e47f","resolution":{"observed_at":"2026-08-11T13:40:20.487090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.472779Z","title":"Edg-based question decomposition for complex question answering over knowledge bases","venue":null,"work_id":"8ba6ce4e-8f8d-447f-a642-c117d30cde9e","year":2021},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.003185Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:cc5dd1f01db485285fb0557e616978b77930ad9d28e0805698a3e4beb27ff668","observation_id":"f1f5bb32-ddac-40c7-8c51-ce26de3d75e8","resolution":{"observed_at":"2026-08-11T13:40:20.476792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01728","last_updated":"2024-01-29T06:27:53Z","snapshot_observed_at":"2026-08-16T11:06:17.042878Z","submitted_at":"2023-10-03T01:31:25Z","title":"Time-LLM: Time Series Forecasting by Reprogramming Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01728","snapshot_observed_at":"2026-08-11T13:40:20.007395Z","title":"Y., Shi, X., Chen, P.-Y., Liang, Y., Li, Y.-F., Pan, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.007395Z"},"links":{"cited_paper":"/paper/2310.01728","citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:a0c6bce68e8c5d835bb9e5c9bf60c40e148b3cbbf407cece43dfea2d77102dcd","observation_id":"33ab6fc8-e7a2-439c-b43c-d270e6a13808","resolution":{"observed_at":"2026-08-11T13:40:20.007395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.462204Z","title":"P., and Ba, J","venue":null,"work_id":"bfe652e7-6423-44e8-b68c-17a0a7919ef6","year":2017},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.011455Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:887156fa1d2a23e55dfc3cb9098de81e6ff0a9fcc539273c7c50e76e9721f3fd","observation_id":"ef190d38-c436-4ad9-8995-055453950476","resolution":{"observed_at":"2026-08-11T13:40:20.466024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.451925Z","title":"ChatGPT: Jack of all trades, master of none","venue":null,"work_id":"a4e1f569-eb15-47b5-83d1-04284ec39cbe","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.015204Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:a2480790c7593f433b453392a94b38fc95690cbf7137d9051ac3b49389251b49","observation_id":"201c2639-8b2e-492a-8a0a-8ce97a541ca2","resolution":{"observed_at":"2026-08-11T13:40:20.455457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-21T01:37:45.112714Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-11T13:40:20.018899Z","title":"S., Reid, M., Matsuo, Y., and Iwasawa, Y.Large Language Models are Zero-Shot Reasoners, Jan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.018899Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:102a4a9f0f97ceb6025b31e1cfdcd618ba7d1deab037674b1e554e575db82a52","observation_id":"6ddf6d1b-9350-4072-883d-807d4fea18c0","resolution":{"observed_at":"2026-08-11T13:40:20.018899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.441650Z","title":"Roberta: A robustly optimized bert pretraining approach, 2019","venue":null,"work_id":"0ab4ae0f-2f57-4733-8ca1-2a2413ec980d","year":2019},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.022920Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:bcde95c1bab1866f3b6fcad8f1e47d6a57c41448703320b78605b6b11786e941","observation_id":"0196fda0-915d-4bb2-a305-23895fb4fd51","resolution":{"observed_at":"2026-08-11T13:40:20.445377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.431372Z","title":"A universal question- answering platform for knowledge graphs, 2023","venue":null,"work_id":"66693525-6692-42e1-97de-094bfaa20bd3","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.026577Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:5553be0497b1a56aaee0f05e0c8788ab33c487e80d273ccf3cc240ef992b9a12","observation_id":"c8d05247-3b57-4e69-bf69-87eaeb6a2378","resolution":{"observed_at":"2026-08-11T13:40:20.435186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.420801Z","title":"Chatgpt versus traditional question answering for knowledge graphs: Current status and future directions towards knowledge graph chatbots, 2023","venue":null,"work_id":"a2e6b0e0-7330-43bc-a9a3-471181ceeebb","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.030503Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:d7fe368f9e76bc01d859f9f11580a8a4b57b31e86db3fec387aab47f564fae0a","observation_id":"6a2afddd-7c05-41b7-b68c-caa5b672be91","resolution":{"observed_at":"2026-08-11T13:40:20.424808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.409388Z","title":"A comparative study of transformer-based language models on extractive question answering, 2021","venue":null,"work_id":"29bd0e53-7190-410b-8e2a-f0ecc06af7f3","year":2021},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.034034Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:be5f9f5f1c136403032ddc44fa3ccb0d283d2f15c9b23b7828a1b93e8f88aa34","observation_id":"a22cf086-b7c3-4d67-a83e-c52aef970dc9","resolution":{"observed_at":"2026-08-11T13:40:20.413242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.397753Z","title":"Is ChatGPT a General-Purpose Natural Language Processing Task Solver?, Nov","venue":null,"work_id":"b0625db1-02b4-4d76-8d95-5715ee195eb9","year":null},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.037614Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:de940e189f5dae807de48680eeb8efc3f10ecc8ce25dc6736eb3ec4316529527","observation_id":"c759a87e-ba0d-4ba1-887f-14894a23585c","resolution":{"observed_at":"2026-08-11T13:40:20.401865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.387379Z","title":"Know what you don’t know: Unanswer- able questions for squad, 2018","venue":null,"work_id":"5fe453e8-110b-4bf2-ab37-919189f09436","year":2018},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.045517Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:65f2dff0f4139153ea6bcfbcf9ac3cf52ac0736a0248d044e4cc10f565721bcc","observation_id":"4cf9cc01-70d8-4ce3-811f-fa65e0081056","resolution":{"observed_at":"2026-08-11T13:40:20.390984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03822","last_updated":"2018-06-11T06:10:11Z","snapshot_observed_at":"2026-08-14T19:05:25.482398Z","submitted_at":"2018-06-11T06:10:11Z","title":"Know What You Don't Know: Unanswerable Questions for SQuAD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03822","snapshot_observed_at":"2026-08-11T13:40:20.048987Z","title":"Know What You Don’t Know: Unan- swerable Questions for SQuAD, June 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.048987Z"},"links":{"cited_paper":"/paper/1806.03822","citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:45ee0a62d39132b8be7891b7000d587797dc0501e9d52ac5cdf7ff0c55cd5452","observation_id":"553fed6a-c834-408f-95b5-2f5e43cb5100","resolution":{"observed_at":"2026-08-11T13:40:20.048987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.376131Z","title":"Squad: 100,000+ questions for machine comprehension of text, 2016","venue":null,"work_id":"bea96b87-fe4d-4255-98bc-f8f990aa5dbc","year":2016},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.053127Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:ca91ed67c3386fd4b53d07ee23b02980ac4c512b0e2728c947717bd6bd1398b3","observation_id":"2d6f1c80-f94e-4cd7-8bf0-5d1c3cce44cf","resolution":{"observed_at":"2026-08-11T13:40:20.380614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.364999Z","title":"S.Comparative analysis of transformer based models for question answering","venue":null,"work_id":"ef95d366-5982-40e7-ae5b-9d167fc9b676","year":2022},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.056953Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:0a3f695d3459bb0cca1e3a44b93ef6911d8e3bc0674f036916e9356343b5d50d","observation_id":"dee8eab7-8596-4a7b-be34-cb3d3aea51cf","resolution":{"observed_at":"2026-08-11T13:40:20.369055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.353461Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter, 2020","venue":null,"work_id":"b07b5a1a-dcae-47e3-9628-b2b016427154","year":2020},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.060936Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:9edaaee93d67ef64d43c8a7c8ad8cbee80aac07d10bfcefed7388abe3b82fff9","observation_id":"96c80d0e-13e3-46d4-88a4-f7410f42d542","resolution":{"observed_at":"2026-08-11T13:40:20.357326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.341739Z","title":"Can chatgpt replace traditional kbqa models? an in-depth analysis of the question answering performance of the gpt llm family, 2023","venue":null,"work_id":"9315bcbc-a172-4f0f-9173-7cbf79561f31","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.064800Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:a42bf73d9c5bb9819ea3d34261e55d789ac129fb4b0a9a65294ea9404ce3b70a","observation_id":"22554f3a-1f6e-49df-bd0f-de277a67f705","resolution":{"observed_at":"2026-08-11T13:40:20.346153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.331387Z","title":null,"venue":null,"work_id":"4cdcecb3-799a-4f33-968d-28cbefa83264","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.068863Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:ec5a0d1be5b88d3b3f1dab255b51475b599af98539e654b1275eb0ea1a7abd2b","observation_id":"454532cb-2a72-4818-9520-2d3ae869c139","resolution":{"observed_at":"2026-08-11T13:40:20.334945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10428","last_updated":"2023-10-07T14:25:28Z","snapshot_observed_at":"2026-08-19T13:02:29.957732Z","submitted_at":"2023-04-20T16:17:26Z","title":"GPT-NER: Named Entity Recognition via Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10428","snapshot_observed_at":"2026-08-11T13:40:20.072965Z","title":"Gpt-ner: Named entity recognition via large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.072965Z"},"links":{"cited_paper":"/paper/2304.10428","citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:f480d13e97229ee1b6ec9d1cb35bb90dc3a7aa2bb9285eb66bc217e054dd27c6","observation_id":"2e87863e-2b8d-498f-8bf0-c63d7f46f122","resolution":{"observed_at":"2026-08-11T13:40:20.072965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.320483Z","title":null,"venue":null,"work_id":"a79719f4-02c6-47fe-a067-0403b8ea60ab","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.077702Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:b7719fb42a0269cf7d3fa6185721106a4b140d91529359459d9f2be1f2ef6ad9","observation_id":"f31358aa-5b92-4d91-b003-0eecc04a1d94","resolution":{"observed_at":"2026-08-11T13:40:20.324449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.308412Z","title":null,"venue":null,"work_id":"db70ed32-0366-4e84-9e58-178b8245eb32","year":1973},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.081794Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:46ce2d0e46a2400abcf291068d6908be8d3be95a42d827f522a3153d5e716089","observation_id":"0a144aee-a300-495f-b119-2c5e5262e9d0","resolution":{"observed_at":"2026-08-11T13:40:20.312790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.296933Z","title":"Instruction Tuning for Large Language Models: A Survey, Oct","venue":null,"work_id":"68b0f910-2432-45c4-a461-93df2ae237f8","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.085329Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:1646b238e0d33a06764124b989145b5843384515bc2d00a2cafe19ba3dba6402","observation_id":"160ce08c-fcb2-4fb8-9eac-c51695daca2e","resolution":{"observed_at":"2026-08-11T13:40:20.301419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.286703Z","title":null,"venue":null,"work_id":"79a0a1e6-4939-4296-bfbb-277083c74ec6","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.089564Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:2799fdb2e3c62df3cf62ec41f1e55dac87a24ad9b146cb5a330a2a88886eb391","observation_id":"40f1c0c3-4f61-47c2-b8f1-95b09bb1aae6","resolution":{"observed_at":"2026-08-11T13:40:20.290208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.275101Z","title":"E., and Stoica, I","venue":null,"work_id":"3a683d9f-1803-4aad-bd17-9346a48daa7c","year":2023},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.093558Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:b1acdcb5bb8bc3a96d39f6e6a2aa325d5bd76b4ed9dc9cf82daf506a49bbcccd","observation_id":"31e37ca1-2431-4328-a08f-fb698b99e112","resolution":{"observed_at":"2026-08-11T13:40:20.278997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.262802Z","title":"Comparative analysis of state-of-the-art q&a models: Bert, roberta, distilbert, and albert on squad v2 dataset, 2024","venue":null,"work_id":"10d323ae-0e6b-43d7-97ea-4e1718f3dacc","year":2024},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.097194Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:4479533f4bbebbce6692d645efab7ba87d12b591055d433e1a9d010ce616bbae","observation_id":"9990b3cc-7a35-4c52-8aaf-7b995315df22","resolution":{"observed_at":"2026-08-11T13:40:20.266697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.227764Z","title":"The ideal response should be a exact repetition of the answer as it appears in the context, without any additions, modifications, or interpretations","venue":null,"work_id":"e7825c03-5069-478e-9e78-4a0a1191e80e","year":null},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.108647Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:85da8d20e95035502cf2ae0dd5c1f3eccf6ad651e3f8d4ba7a309e533663bd08","observation_id":"e2ebbbfa-569e-41cb-b7a0-32cff9f453d8","resolution":{"observed_at":"2026-08-11T13:40:20.232356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.251399Z","title":"unanswerable","venue":null,"work_id":"8dd3315b-1e73-4c88-8a8a-472f7a12e4c3","year":null},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.112516Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:f78a07ed3aadea420963b03c3cef5d4f4a45b6179a8e1114944adeb31a862d75","observation_id":"02e408b0-a69e-4339-9f2f-923e1c76655a","resolution":{"observed_at":"2026-08-11T13:40:20.255324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.240189Z","title":null,"venue":null,"work_id":"9e8990bc-d7cb-4f5b-a4a9-a71d43980198","year":null},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.116488Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:deca54178b0c00808bc5b183f47b6db6c494e268219aef83e21938c08521ed2d","observation_id":"eefc3e6b-ea2e-466b-bf24-6253fb998297","resolution":{"observed_at":"2026-08-11T13:40:20.243669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:40:20.213686Z","title":"The ideal response should be a exact repetition of the answer as it appears in the context, without any additions, modifications, or interpretations","venue":null,"work_id":"962ddbfb-af40-4b85-9ff9-742c0688f4e5","year":null},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.119983Z"},"links":{"citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:da9ff45320765b543279b90ac0629ee09e5262c34836a56228c60d73ef0769a3","observation_id":"106bae45-206d-4811-a57d-a8b4a4490246","resolution":{"observed_at":"2026-08-11T13:40:20.219898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06476","last_updated":"2023-11-19T15:43:58Z","snapshot_observed_at":"2026-08-19T22:26:56.125157Z","submitted_at":"2023-02-08T09:44:51Z","title":"Is ChatGPT a General-Purpose Natural Language Processing Task Solver?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06476","snapshot_observed_at":"2026-08-11T13:40:20.041517Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T13:40:20.041517Z"},"links":{"cited_paper":"/paper/2302.06476","citing_paper":"/paper/2412.12893"},"observation_digest":"sha256:085d5801f29803996d32f977388652dc18769ff38868204e536e6a9930cfd963","observation_id":"56937f97-7ed9-44c4-a7cb-0820a2002fec","resolution":{"observed_at":"2026-08-11T13:40:20.041517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12893","last_updated":"2024-12-17T13:19:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T12:43:03.971709Z","submitted_at":"2024-12-17T13:19:38Z","title":"Question: How do Large Language Models perform on the Question Answering tasks? Answer:"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2412.12893."}