{"as_of":"2026-08-13T11:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:631c192e35a4369daf25edc1815e4ab08fe74f16a699d114673b1b2b2f9945e0","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:34:11.996390Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.10483/citation-record","integrity":"/paper/2501.10483/integrity","json":"/paper/2501.10483/citation-record.json","paper":"/paper/2501.10483"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.521294Z","title":"A comprehensive overview of large language models, 2024","venue":null,"work_id":"cfbe195c-362b-4916-a4ad-c55bdd98d88c","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.834245Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:f3b230becd14a9472b3c5ca73b8a3bf9f15b29a929bffe132d777733859864f4","observation_id":"a4a77ec5-e684-4d9d-ad16-e0203cb28225","resolution":{"observed_at":"2026-08-10T19:34:12.524851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.838763Z","title":"Large language models: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.838763Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:d28ee1625b5155c7b650a646df7d41c1ade7b7d28c153cdb8eb6bb6163b88ec5","observation_id":"f2aafdf8-aeff-49fd-b3ed-0c5a94e0aae9","resolution":{"observed_at":"2026-08-10T19:34:11.838763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.842938Z","title":"Evaluating large language models: A comprehensive survey, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.842938Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:a04b87f7ad5669033626b1d298f1f168d819a0234fbdb359aa2f91bc5cc600e1","observation_id":"1d6fb573-c9cd-4527-b44f-32eba559fcc3","resolution":{"observed_at":"2026-08-10T19:34:11.842938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.491018Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":null,"work_id":"71baab75-5487-4d8a-978b-9dd52c381651","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.847028Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:206b8ed2f2adfbcf6528649c0b7f450d152fbf069b26807144e98adb6b0108f2","observation_id":"1a4f1447-243a-4eed-aa3c-3f3362ab64af","resolution":{"observed_at":"2026-08-10T19:34:12.495602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.851675Z","title":"A comprehensive survey of hallucination in large language, image, video and audio foundation models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.851675Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:d03e880c7ac8a51d7d89091221bc633c863f13245c0404c1de536dca9eb88dab","observation_id":"8d22eb19-92dc-4447-961c-7fc3bbb1a3a9","resolution":{"observed_at":"2026-08-10T19:34:11.851675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.855440Z","title":"M Towhidul Islam Tonmoy, S M Mehedi Zaman, Vinija Jain, Anku Rani, Vipula Rawte, Aman Chadha, and Amitava Das","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.855440Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:af35aa205bbebaa689cb82f2423f15067ea16a297a3528cea3bea73db17a0f74","observation_id":"54303880-7a9e-41a2-a162-774a893a5ad9","resolution":{"observed_at":"2026-08-10T19:34:11.855440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.455854Z","title":"The troubling emergence of hallucination in large language models - an extensive definition, quantification, and prescriptive remediations","venue":null,"work_id":"bdb55c59-dc2a-4658-8647-08b4dcf0da45","year":2023},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.859683Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:6816b72a9ff8515d2a32917fe8ce20c8b75e51267e28fc3343a17628a9131e50","observation_id":"0b5d55d4-85c1-458a-87eb-0a9679430a3d","resolution":{"observed_at":"2026-08-10T19:34:12.461233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.437922Z","title":"hallucination","venue":null,"work_id":"f4480397-d31e-45e4-bf3e-0dfa141f036e","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.863195Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:5b37fe2999334449a4951542fd48943512c269b58ae36be7a38439fcf0448774","observation_id":"73c54408-0e57-4e7d-bb0f-5044a810966f","resolution":{"observed_at":"2026-08-10T19:34:12.446120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-10T19:34:11.867103Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.867103Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:0e5a1a61207a05f87e2f410073d5db469591edcb6f67e06ade955bc72f45f532","observation_id":"09d12b2d-fa03-4d18-9c19-4dfd060c2b9e","resolution":{"observed_at":"2026-08-10T19:34:11.867103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.425855Z","title":null,"venue":null,"work_id":"19f3df96-aeee-4820-90c5-843506c0c97a","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.871240Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:4b75163835e1df5ecad3a659644f352dfd18bc04fcedc25e5d294cb235a2c34e","observation_id":"bc3dbefa-f62e-4a08-823f-7b388b6e2ba5","resolution":{"observed_at":"2026-08-10T19:34:12.429238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.412731Z","title":null,"venue":null,"work_id":"7c5b51bc-0d2b-45a0-a9db-a7417b1aafb3","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.874978Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:d90932d93576f46a7db086d130ad8587e33b55ef79e3836f0ad829a9882ea36a","observation_id":"c74c3ab7-b762-403c-9b75-73d1595b5217","resolution":{"observed_at":"2026-08-10T19:34:12.417076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.879205Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.879205Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:51e5632e42f2d8ea0cc69ab37e7e64783185022b1235382bfd867ad9ff647fda","observation_id":"654667c3-72a7-4e72-84f0-da5ed98ceab2","resolution":{"observed_at":"2026-08-10T19:34:11.879205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.882964Z","title":"Orca 2: Teaching small language models how to reason, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.882964Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:0728c59f795846624e28b8b9f3629aa483ee790492c920ec5f42dcc71b8d5b27","observation_id":"8c4b07f6-ae12-4a3a-977c-6e4311f9f443","resolution":{"observed_at":"2026-08-10T19:34:11.882964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.380442Z","title":"mistralai/mistral-7b-instruct-v0.3 · hugging face, December 2024","venue":null,"work_id":"4db3ee20-5822-47ba-aaff-95522f7f7b55","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.886391Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:2ab73198394ef7de9c1b4f92a1c712f81b4503db2264081fe873702b77a4a2df","observation_id":"35de053c-8efd-407b-ab26-99569aa10c26","resolution":{"observed_at":"2026-08-10T19:34:12.384816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.367127Z","title":null,"venue":null,"work_id":"30bf0b65-1eb0-4cb8-81c1-35676375475e","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.889549Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:c2380d5911aa9483b2ee49a74fe279737872a7463d7910bde2254b55331f9c2c","observation_id":"01a922ea-8eff-4bbb-be41-308111856075","resolution":{"observed_at":"2026-08-10T19:34:12.371850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.352143Z","title":null,"venue":null,"work_id":"617f9337-4af4-4930-952f-6e18ed6d25ad","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.893092Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:e06fdcead17f922ce2f2c8e0e4a83420af49f8c598e5311ed091cf02ab5b9f6a","observation_id":"99c298ce-ed15-4d7c-9f19-e100e8fbbbd0","resolution":{"observed_at":"2026-08-10T19:34:12.356901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.336952Z","title":"mistralai/mistral-nemo-instruct-2407 · hugging face","venue":null,"work_id":"cdc1758b-4984-4133-820f-d680c8dda3e7","year":2025},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.896284Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:215164e27282c7d55937fd6556633882305f3137c6e2c1c69505497e86a89954","observation_id":"0ed8246f-e327-4917-87a9-f0f8ba9393b1","resolution":{"observed_at":"2026-08-10T19:34:12.341653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01981","last_updated":"2024-12-02T21:20:02Z","snapshot_observed_at":"2026-08-11T23:55:34.185936Z","submitted_at":"2024-12-02T21:20:02Z","title":"Free Process Rewards without Process Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01981","snapshot_observed_at":"2026-08-10T19:34:11.899747Z","title":"Free process rewards without process labels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.899747Z"},"links":{"cited_paper":"/paper/2412.01981","citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:362c04d2baafd1f79d0e882b1d1df496b160da442fa7848a28d9fca313d7cf44","observation_id":"5e8fc1ce-bd59-4f77-942b-2c476bde6d40","resolution":{"observed_at":"2026-08-10T19:34:11.899747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.322366Z","title":"upstage/solar-pro-preview-instruct · hugging face, 11 2024","venue":null,"work_id":"051c06f4-a5bb-4d30-95c6-f669560f8045","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.903881Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:92de1f3d90590c886434435be4c0285610acf18dd6abb266add213fe13d8fad0","observation_id":"5bcf2161-26a9-4e92-8297-c1cad82958ee","resolution":{"observed_at":"2026-08-10T19:34:12.326954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.907485Z","title":"Clement, Matthew Bierbaum, Kevin P","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.907485Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:e9efb4e2dba2fab6cf50c1ee4821da9ac44ef99d1cd208a00b232a5549fabaf7","observation_id":"f3f79e1a-6a93-497f-8cfd-dcd8a2fe25fe","resolution":{"observed_at":"2026-08-10T19:34:11.907485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20009","last_updated":"2024-10-28T05:57:03Z","snapshot_observed_at":"2026-08-13T09:37:55.968185Z","submitted_at":"2024-03-29T06:48:30Z","title":"On Large Language Models' Hallucination with Regard to Known Facts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20009","snapshot_observed_at":"2026-08-10T19:34:11.911330Z","title":"On large language models’ hallucination with regard to known facts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.911330Z"},"links":{"cited_paper":"/paper/2403.20009","citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:9a0e17ec38705906d36deef2dd8c857d186ee1a45c864307fd5b4b7b3a72303a","observation_id":"1d6a9380-4ca0-4347-9427-90d4c3f404db","resolution":{"observed_at":"2026-08-10T19:34:11.911330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05746","last_updated":"2024-09-09T16:01:58Z","snapshot_observed_at":"2026-08-12T22:48:29.636760Z","submitted_at":"2024-09-09T16:01:58Z","title":"LLMs Will Always Hallucinate, and We Need to Live With This","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05746","snapshot_observed_at":"2026-08-10T19:34:11.916176Z","title":"Llms will always hallucinate, and we need to live with this","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.916176Z"},"links":{"cited_paper":"/paper/2409.05746","citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:59280660934b5c6749996aef1fabe9736f95a57efa437eec49227e403c751ca1","observation_id":"d03cb26f-1156-4e3a-bab6-17e5685a66d0","resolution":{"observed_at":"2026-08-10T19:34:11.916176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.301904Z","title":null,"venue":null,"work_id":"a0dd2a3c-f4db-4af1-ac1d-e5b8c81f6bcb","year":2022},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.920268Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:6b1b46a15481aeaafe7f5be02fa711e5c6b82036e68b4392df6dee38c43c2b7c","observation_id":"ef4e6250-0d66-4397-b11d-985a83b81f6f","resolution":{"observed_at":"2026-08-10T19:34:12.305379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04175","last_updated":"2024-06-25T18:37:19Z","snapshot_observed_at":"2026-08-12T23:48:39.191890Z","submitted_at":"2024-06-06T15:32:29Z","title":"Confabulation: The Surprising Value of Large Language Model Hallucinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04175","snapshot_observed_at":"2026-08-10T19:34:11.923569Z","title":"Confabulation: The surprising value of large language model hallucinations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.923569Z"},"links":{"cited_paper":"/paper/2406.04175","citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:ba57b735ab0a7276dfa8d1d121d46f91bca67e2023e4cecc818b14e9b7eece07","observation_id":"701c2d0a-fdb9-48c3-a753-e1786fe90209","resolution":{"observed_at":"2026-08-10T19:34:11.923569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.290125Z","title":"Delucionqa: Detecting hallucinations in domain-specific question answering, 2023","venue":null,"work_id":"4bbcffed-f380-403e-ae67-3fefddb7bd14","year":2023},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.927134Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:572d666129fa3d4e49bd5e9037aa7be7c3902181970653ce3b25882db04721a9","observation_id":"9e320484-1497-403e-a48c-371ffb253377","resolution":{"observed_at":"2026-08-10T19:34:12.294142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.278146Z","title":"Dahl: Domain-specific automated hallucination evaluation of long-form text through a benchmark dataset in biomedicine, 2024","venue":null,"work_id":"02f5a3e0-31b6-4ccd-a008-98466d1890e4","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.930278Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:9c3f1601017c89337da61a04db584b2e7da4e02e0dd891de2cb44e8c0d4a84df","observation_id":"bf1d8f1e-6817-4b88-8c80-e67a9c316c55","resolution":{"observed_at":"2026-08-10T19:34:12.282110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.263820Z","title":"Hallucina- tion of multimodal large language models: A survey, 2024","venue":null,"work_id":"d3704fc9-01eb-425c-9162-a8155a6c8192","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.934402Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:d3340a8eab2404c190801d2658dd80c92479557ca9a3267ff9fe7411304696ae","observation_id":"b5c1ea24-c98a-4ef9-ac58-9aa7d7d63533","resolution":{"observed_at":"2026-08-10T19:34:12.268675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.248792Z","title":"Vidhalluc: Evaluating temporal hallucinations in multimodal large language models for video understanding, 2024","venue":null,"work_id":"29386110-a8d3-4d84-8a3d-52666db155e5","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.938870Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:d27104592ac4ee2649ec6ed4134f55cb4dbb434944939af397d5aab3c5e3a608","observation_id":"12255071-dc12-47f5-af96-fcdfe615323a","resolution":{"observed_at":"2026-08-10T19:34:12.254739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.234059Z","title":"Unified hallucination detection for multimodal large language models","venue":null,"work_id":"8399fe4d-d336-49e6-9249-3899738630f5","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.942781Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:dea342a2c64034b2f7ad6f507b62a9285f7a15397304a29c3449cc4881071e06","observation_id":"4393093d-0094-4f94-a0f6-494859bccfbd","resolution":{"observed_at":"2026-08-10T19:34:12.238717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.220964Z","title":"Survey of hallucination in natural language generation","venue":null,"work_id":"0749b688-cad8-4168-9dca-7d7556321ac8","year":2023},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.947830Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:52b92a284b36ca19acc4f2183c76dd9552dc8b3a8986c3d5e775facaf9d19cec","observation_id":"d34fe357-1709-4d45-aadf-8e4e92febf61","resolution":{"observed_at":"2026-08-10T19:34:12.225267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.208550Z","title":null,"venue":null,"work_id":"fa0457cc-d2d4-48b3-bb6e-e95043ac1c6e","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.952352Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:f5dbe950f1026be741dcd1a9bb6c489017da6e037e93702df6b8444daf70465d","observation_id":"3ec4da6e-e08d-4004-b2e2-cb788f088e79","resolution":{"observed_at":"2026-08-10T19:34:12.212522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.196201Z","title":"Flesch–kincaid readability tests - wikipedia, 7 2004","venue":null,"work_id":"6b093b4e-91b8-4cb8-af0c-4fdf4cc77024","year":2004},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.957170Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:59f24f297d8f424b919fb061f0353f5f9a350b2fe9fbab3d8a3189bb6c60c06d","observation_id":"4560c9f8-1755-4b81-863e-eb110645bf4b","resolution":{"observed_at":"2026-08-10T19:34:12.200378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.183082Z","title":"Gunning fog index - wikipedia, 10 2004","venue":null,"work_id":"5b0b6423-7154-42df-b586-83233ef00b54","year":2004},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.964319Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:0708f1680b5f109d34e510f412380ff43cda34be40db69519e38862ef2de8a2d","observation_id":"a122311a-5bb9-4253-abc6-7b791bbe5f56","resolution":{"observed_at":"2026-08-10T19:34:12.187600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.968505Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.968505Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:860672febaa886a589241c1d595fc43e5ff603be9e56ba368ef8b440f6bf02cc","observation_id":"e2802655-6a1d-439f-a000-e082318eee13","resolution":{"observed_at":"2026-08-10T19:34:11.968505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.974301Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.974301Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:c246c4c890f917c47440db8e33fc0e81b51ce749a17f6cf33433f8578cdfac86","observation_id":"8a766d27-5ead-4f08-9a83-bf0a0d52125e","resolution":{"observed_at":"2026-08-10T19:34:11.974301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.978557Z","title":"Pytorch: An imperative style, high-performance deep learning library, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.978557Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:f47cd41bbe8f97c0677ee9789ca79b63b46668691410aac4f968534c5a312d45","observation_id":"1f691dab-9199-4874-a2ea-9ae2ee0105a2","resolution":{"observed_at":"2026-08-10T19:34:11.978557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.983579Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.983579Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:80825e0399e4a1debeeea9e6f2c586f904f926f9a8031e6e3604d6b79f6dff6f","observation_id":"f432b119-585d-4495-9bae-b4379851f540","resolution":{"observed_at":"2026-08-10T19:34:11.983579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.129686Z","title":"bitsandbytes-foundation/bitsandbytes: Accessible large language models via k-bit quantization for pytorch., Decemeber 2024","venue":null,"work_id":"bd69e5a7-ea6a-496c-9776-f2dabea8e4a9","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.988177Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:b5284c9abc037a3edb447bc423301c9569aa2254cf31e02415a0957eed8247dd","observation_id":"2ae45416-3a14-4071-8b24-738ee5e360a6","resolution":{"observed_at":"2026-08-10T19:34:12.134275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:11.992788Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.992788Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:e511f174fb87c1cb80770ec43df45cadbe8aadba245c3368dbb7466f39a7a91d","observation_id":"179fe5a4-1494-42de-a317-6f9be99f792c","resolution":{"observed_at":"2026-08-10T19:34:11.992788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:34:12.103968Z","title":"A comprehensive evaluation of quantization strategies for large language models, 2024","venue":null,"work_id":"d5e3e6eb-bae3-4556-ab87-a6497e8f3a80","year":2024},"citing_paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:11.996390Z"},"links":{"citing_paper":"/paper/2501.10483"},"observation_digest":"sha256:39908044137598ebef1ad97710bf8e766ab194967a95f58d3d661bcdc7e9d5c4","observation_id":"bc91d7cb-f543-4d27-bcdc-8c16397ee7a6","resolution":{"observed_at":"2026-08-10T19:34:12.111401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.10483","last_updated":"2025-01-22T04:17:21Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T09:44:02.138611Z","submitted_at":"2025-01-17T05:19:24Z","title":"ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2501.10483."}