{"as_of":"2026-08-08T12:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:975b0d8e0b126762641d644699192514000927012c1a2fe6834617a17d0be84f","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:47:18.089814Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.13790/citation-record","integrity":"/paper/2506.13790/integrity","json":"/paper/2506.13790/citation-record.json","paper":"/paper/2506.13790"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-07T04:47:17.997316Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:17.997316Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:1b7a30af9662b7c45e43cedf4839fcf73806c5b051af7e5a11e4a5b014986da7","observation_id":"515b9af0-e0cb-483d-a53b-8e470be481d7","resolution":{"observed_at":"2026-08-07T04:47:17.997316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06823","last_updated":"2024-11-11T09:31:46Z","snapshot_observed_at":"2026-07-06T19:48:19.654325Z","submitted_at":"2024-11-11T09:31:46Z","title":"Large Language Model in Medical Informatics: Direct Classification and Enhanced Text Representations for Automatic ICD Coding","version":1},"cited_work":{"arxiv_id":"2411.06823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.06823","snapshot_observed_at":"2026-08-07T04:47:18.371209Z","title":"Large Language Model in Medical Informatics: Direct Classification and Enhanced Text Representations for Automatic ICD Coding","venue":"cs.LG","work_id":"34893e09-7ae9-46e6-a0a0-72444a8fd85d","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.001490Z"},"links":{"cited_paper":"/paper/2411.06823","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:9e35d55d948f36e02b7d56f345302fc761a290ea983361eeac68ba72cfc1b4f6","observation_id":"c94917ea-8bb7-453c-8480-42d323205069","resolution":{"observed_at":"2026-08-07T04:47:18.380851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06552","last_updated":"2023-11-13T12:38:00Z","snapshot_observed_at":"2026-07-06T16:30:29.783501Z","submitted_at":"2023-10-10T11:56:48Z","title":"Automated clinical coding using off-the-shelf large language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06552","snapshot_observed_at":"2026-08-07T04:47:18.004914Z","title":"S., Kascenas, A., Lok, P., Liakata, M., and O'Neil, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.004914Z"},"links":{"cited_paper":"/paper/2310.06552","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:fd4c84267db5e7de64017e4aacb08ae3f759d533fbf0c0472a62d419eac3b185","observation_id":"25ca01e7-cd56-4f69-b036-04bc8ee9c5b0","resolution":{"observed_at":"2026-08-07T04:47:18.004914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.008910Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.008910Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:25fdeed56f3436f60b34b055665ab273541513d5e3578fb02306a14b650eb31d","observation_id":"98ff3bf9-d929-4ca1-b338-843240bfabd2","resolution":{"observed_at":"2026-08-07T04:47:18.008910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04226","last_updated":"2023-03-07T20:36:13Z","snapshot_observed_at":"2026-07-06T14:59:53.901528Z","submitted_at":"2023-03-07T20:36:13Z","title":"A Comprehensive Survey of AI-Generated Content (AIGC): A History of Generative AI from GAN to ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04226","snapshot_observed_at":"2026-08-07T04:47:18.011925Z","title":"S., and Sun, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.011925Z"},"links":{"cited_paper":"/paper/2303.04226","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:bfc89422e3cfccb7c676a52ff2ce90fb51bd0b97449e7a3d0dc661bb4041360b","observation_id":"f0a069d9-389c-4f9c-bfc5-ef28c79e0ca8","resolution":{"observed_at":"2026-08-07T04:47:18.011925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T04:47:18.015342Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.015342Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:d6325f74eedf16c86db6bac608300d404a9d6b1f7ba45f3b6a2898ca8d596565","observation_id":"5c20ff77-eb65-4dfd-8876-1ceb460c72b2","resolution":{"observed_at":"2026-08-07T04:47:18.015342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.531303Z","title":null,"venue":null,"work_id":"fe098edf-c28a-4012-824d-6b072a734fd5","year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.018921Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:115501bf759c124f57854e8dd04713042d38a08695277662189bddeff93009bd","observation_id":"76a817a4-4fc0-49a5-8343-ddf76abd9208","resolution":{"observed_at":"2026-08-07T04:47:18.534353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T04:47:18.021758Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.021758Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:5b9b0705668f4262347b51eb3043a7721034e8be8f7b6053696c6af962040ed4","observation_id":"8181321a-3273-4a7e-9703-6124463aac58","resolution":{"observed_at":"2026-08-07T04:47:18.021758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.521526Z","title":null,"venue":null,"work_id":"7271df1c-3710-40b3-92fb-224ebeb54394","year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.024777Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:43f7c5b4e2e0427d6417985b8a76d98b786b44237e6d1b914cee07cf34dc1ca6","observation_id":"706dadd2-271f-4412-b247-894223f4cb74","resolution":{"observed_at":"2026-08-07T04:47:18.525022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03970","last_updated":"2022-10-08T08:37:44Z","snapshot_observed_at":"2026-07-06T14:02:32.637793Z","submitted_at":"2022-10-08T08:37:44Z","title":"KG-MTT-BERT: Knowledge Graph Enhanced BERT for Multi-Type Medical Text Classification","version":1},"cited_work":{"arxiv_id":"2210.03970","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.03970","snapshot_observed_at":"2026-08-07T04:47:18.315864Z","title":"KG-MTT-BERT: Knowledge Graph Enhanced BERT for Multi-Type Medical Text Classification","venue":"cs.CL","work_id":"83883221-abe3-4a75-aa9e-cf1f73a479cb","year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.027497Z"},"links":{"cited_paper":"/paper/2210.03970","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:4c282db6980655bc70e2023c513af2ceff7b2452c771c7ff82820976ac45e4bc","observation_id":"ad01dd9b-1a8b-4236-9ad1-15515ca6102e","resolution":{"observed_at":"2026-08-07T04:47:18.320567Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T04:47:18.030278Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.030278Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:7e14eaf902599b4a266b2da44cf963340a7acab23f139edb7004c48678d3e502","observation_id":"d7ec89bf-6c0b-43a8-989c-31ea1e04be74","resolution":{"observed_at":"2026-08-07T04:47:18.030278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T04:47:18.034739Z","title":"N., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.034739Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:51fa1152690176c700817bbb1dbd8e84d590abfbea2dafeb1638ab1521e47676","observation_id":"a593e703-acda-4513-8cde-781110510a29","resolution":{"observed_at":"2026-08-07T04:47:18.034739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.511669Z","title":null,"venue":null,"work_id":"68bd7ef3-66f5-41ae-8ff8-f01eb4b4feb1","year":2025},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.037464Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:1d2d881a1fbdf799b93d3643afe593ce9c9e0ab773a3fc725570ef690f129e6e","observation_id":"724d74b9-b986-4d39-93fd-1e761a2c6918","resolution":{"observed_at":"2026-08-07T04:47:18.514570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12849","last_updated":"2024-07-06T06:58:51Z","snapshot_observed_at":"2026-07-06T18:48:00.070861Z","submitted_at":"2024-07-06T06:58:51Z","title":"Large language models are good medical coders, if provided with tools","version":1},"cited_work":{"arxiv_id":"2407.12849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.12849","snapshot_observed_at":"2026-08-07T04:47:18.283747Z","title":"Large language models are good medical coders, if provided with tools","venue":"cs.IR","work_id":"b87a6ecd-ad0e-435e-957a-61fb7f80b1bc","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.040148Z"},"links":{"cited_paper":"/paper/2407.12849","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:3931d7279d79948e15271a1209f39a77297dd7984208d7735de79260d513db2d","observation_id":"858e0aec-dfe5-44d8-95dc-a5b9fd582e3f","resolution":{"observed_at":"2026-08-07T04:47:18.287099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-07T04:47:18.042981Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.042981Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:7a73bc580e322ad3843eee509c561e7fa35229c3ba6f902afe28683aa8eb1259","observation_id":"51ec63c1-4f0b-4b96-94f9-a00835c174b3","resolution":{"observed_at":"2026-08-07T04:47:18.042981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-07T04:47:18.045941Z","title":"U., Qiu, S., Saqib, M., Anwar, S., Usman, M., Akhtar, N., Barnes, N., and Mian, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.045941Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:e3e56fcb56e3418c871eeece58e7650ed80d4de42a06acdf6fee88c55e273707","observation_id":"64835f72-9593-43a5-ac45-635a35268ecc","resolution":{"observed_at":"2026-08-07T04:47:18.045941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.502758Z","title":"Norddrg specification, url: https://nordcase.org/","venue":null,"work_id":"4536c797-348a-4a64-8fb6-f65403a4935a","year":2025},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.048743Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:1a8b3ccd2bc9389c19126f08e26409eb1304114404b4c9ac7e299985a4a4f355","observation_id":"eca5baa8-3d39-4a87-85bc-9a48fb5e34e0","resolution":{"observed_at":"2026-08-07T04:47:18.505630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.493835Z","title":"E., Rossi, M., Hui, W., Virtanen, V., and Bragge, J","venue":null,"work_id":"1a5c47fc-6b23-436b-9391-eac759f09b38","year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.051398Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:94a56c835bae9e119d8c367be267e338a990646662b2e3034f3922191d0eea3b","observation_id":"93518a54-1235-4272-b398-3379e7673b57","resolution":{"observed_at":"2026-08-07T04:47:18.496622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.484787Z","title":null,"venue":null,"work_id":"49111d6c-ce25-422a-a3a1-b22383e9dc18","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.054163Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:47667381cc4195b2aa0769540cf3e210d38b45c28a31eb3c73b17be5ef64ea0f","observation_id":"3f2a5257-e0c2-4c52-b1a6-cbdaa92f45c8","resolution":{"observed_at":"2026-08-07T04:47:18.487933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.476235Z","title":null,"venue":null,"work_id":"821cae8d-3f89-4b45-9ff9-96582f147e59","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.056970Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:336637e7d6bd339d008eeabf8e004815db0cca0e8c6b35e498b6aba001e488ad","observation_id":"8a0ecc40-b408-465a-8fad-a03c444d4215","resolution":{"observed_at":"2026-08-07T04:47:18.478964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.059547Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.059547Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:a9dc69f921c4742477d4d501c198cbbfb3729a5f91b0b64e62baf88a8413d841","observation_id":"f54c6b6f-d567-46ce-9f93-6d0cca99cd40","resolution":{"observed_at":"2026-08-07T04:47:18.059547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21124","last_updated":"2024-07-30T18:33:05Z","snapshot_observed_at":"2026-07-06T18:54:41.705593Z","submitted_at":"2024-07-30T18:33:05Z","title":"Zero Shot Health Trajectory Prediction Using Transformer","version":1},"cited_work":{"arxiv_id":"2407.21124","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.21124","snapshot_observed_at":"2026-08-07T04:47:18.249464Z","title":"Zero Shot Health Trajectory Prediction Using Transformer","venue":"cs.LG","work_id":"4e08feff-1892-425a-b7ef-758e2283a9ab","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.062146Z"},"links":{"cited_paper":"/paper/2407.21124","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:efac2e8edb7b43dd117827b0aa968cc41bfebe8e82489a07a6c4179e07a16d1e","observation_id":"2084bc1f-c49c-426d-9219-66f44dad12ec","resolution":{"observed_at":"2026-08-07T04:47:18.254806Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T04:47:18.064980Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.064980Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:34ff956a19131e64ed4d99f243608588d9a694929c23785cc1db748c85ead2f1","observation_id":"de4be81f-1f9a-4f3c-b049-72aff053aa76","resolution":{"observed_at":"2026-08-07T04:47:18.064980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.067520Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.067520Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:94c2cd73bac218b6269855316abd4b519ded974d2408c08eb8cee083913ed0a5","observation_id":"80c47429-3c67-45f5-bb50-1609f0c6ebfd","resolution":{"observed_at":"2026-08-07T04:47:18.067520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.455257Z","title":null,"venue":null,"work_id":"68e1504d-761c-4108-825a-da1facf4eaf9","year":2019},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.070258Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:342470ea525b1ff201504c9b95ef05d4e543de688f79051a3b191d6d6328696e","observation_id":"1b1fcbd5-2791-42c1-9d97-b10dae9525fe","resolution":{"observed_at":"2026-08-07T04:47:18.458299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.438560Z","title":null,"venue":null,"work_id":"0409d291-e050-4843-b2eb-84b49a34746f","year":2018},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.072883Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:f327acadac09ea72ca6397523fb297ba39634b55a1220b57f211b492620d04be","observation_id":"a9ad48ce-647e-4790-8e7e-9617b7c9b383","resolution":{"observed_at":"2026-08-07T04:47:18.446912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.075336Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.075336Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:ad594cf7a498b711b8da2e8093e0e3b61b497b1ccd9c80a3c514d01ce045535b","observation_id":"1016ed56-20b4-42e5-9443-c65c4dd29ce4","resolution":{"observed_at":"2026-08-07T04:47:18.075336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01234","last_updated":"2023-10-18T13:40:12Z","snapshot_observed_at":"2026-08-05T00:17:41.596395Z","submitted_at":"2023-10-02T14:23:50Z","title":"Back-Propagation Optimization and Multi-Valued Artificial Neural Networks for Highly Vivid Structural Color Filter Metasurfaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01234","snapshot_observed_at":"2026-08-07T04:47:18.078257Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.078257Z"},"links":{"cited_paper":"/paper/2310.01234","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:2dc8fb04a5353dc882e88cb16aeb4959b92f70517c9945d032f596550f50e462","observation_id":"a633e670-b955-464e-bba5-9e2ba0737daf","resolution":{"observed_at":"2026-08-07T04:47:18.078257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.421089Z","title":null,"venue":null,"work_id":"0522e14b-aaa8-49f3-ab47-debd0ec6dc13","year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.081450Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:dab50fd9fde3e118dfae36ef63f2ce744432cacd753c308ab7ab7d10d528f507","observation_id":"9cd76605-2022-42e1-9752-dd2cd1669153","resolution":{"observed_at":"2026-08-07T04:47:18.427000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.404526Z","title":null,"venue":null,"work_id":"9072f3aa-4f30-4e72-9531-d1f8c848ad51","year":1999},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.084183Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:550a42507ea4e5416be34933e6033430b5252fba4b76d6d60a2c4fc4efde5d41","observation_id":"aaaadb01-e9f4-4254-8684-2c78d9e7e90f","resolution":{"observed_at":"2026-08-07T04:47:18.412518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T04:47:18.087129Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.087129Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:a50a00e2735118618a3bd4ec7aff954df0797e9cf5efd2dc63f66f62843a94eb","observation_id":"313537b3-6259-43e4-a80b-c68f4cbabfe5","resolution":{"observed_at":"2026-08-07T04:47:18.087129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-07T04:47:18.089814Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.089814Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:dd13c88030e0db8b4b27d2f86382d87d57f702db80844924afcbb65daa7e8ab5","observation_id":"54b5d437-ff84-44ff-b5d4-724fb0e255d3","resolution":{"observed_at":"2026-08-07T04:47:18.089814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T04:41:02.794886Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":26,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2506.13790."}