{"as_of":"2026-08-09T18:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7edb6132c4eecbc1fdd26d3a062feb029ea5e781f0e774bfb2a5f07e9033b9c","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:56:34.350227Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:40:18.133637Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T10:06:01.278099Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"cited_work":{"arxiv_id":"2506.02058","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02058","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hui Lin and Jeff Bilmes","venue":null,"work_id":"0859602c-7286-44ce-9112-323289a693ca","year":2011},"citing_paper":{"arxiv_id":"2604.12015","last_updated":"2026-04-13T20:00:41Z","snapshot_observed_at":"2026-07-06T23:00:17.634307Z","submitted_at":"2026-04-13T20:00:41Z","title":"UCS: Estimating Unseen Coverage for Improved In-Context Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:40:18.133637Z"},"links":{"cited_paper":"/paper/2506.02058","citing_paper":"/paper/2604.12015"},"observation_digest":"sha256:024f770d1d77ad3ce454ba97adb276646add7fa1090bd3e1ee3379ded9fe903b","observation_id":"4f39711d-05df-4367-bdf0-2987ca8ae6db","resolution":{"observed_at":"2026-05-11T10:06:01.283344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02058/citation-record","integrity":"/paper/2506.02058/integrity","json":"/paper/2506.02058/citation-record.json","paper":"/paper/2506.02058"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:56:29.406168Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.406168Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:5e1e26dcdc0ff5acd8c563a42f603086e7d0382c81114d0fdae3a77839f0e70c","observation_id":"72ab1322-29cf-4754-a082-ab21a584d42e","resolution":{"observed_at":"2026-08-07T11:56:29.406168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T11:56:29.482658Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.482658Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:feed9db94f0ebadb7b1b34428dfa22bcaa9c822d4713478a50e8205f80cc9114","observation_id":"6856b69a-28b4-4b10-85a5-ef242ebea546","resolution":{"observed_at":"2026-08-07T11:56:29.482658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.142945Z","title":"Claude3.7 Sonnetsystemcard","venue":null,"work_id":"4986b376-3270-40ff-8e56-ed50d3981cce","year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.576094Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:51c8d7c9b893d281568b20e7728a47ed46f71c0d28704d6ad1b428132885a4f0","observation_id":"483df34c-5857-4588-a5f8-e33033e45f75","resolution":{"observed_at":"2026-08-07T11:56:35.145924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T11:56:29.637691Z","title":"On the opportunities and risks of foundation models.arXiv preprint arXiv:2108.07258, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.637691Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:9da0ef3a35498ca5c4f74b7c2773f428513cb6de653ad4f5d97573ccbfc69ecc","observation_id":"310dca0d-c683-4f36-8c64-c3e4099af996","resolution":{"observed_at":"2026-08-07T11:56:29.637691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:29.701569Z","title":"Eight things to know about large language models.Critical AI, 2(2), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.701569Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:6e1c5864d5657666ce92ffe0f9c6d74dce4bf99ffdc1874823d126da4646012f","observation_id":"688d1427-ca52-42e9-8eeb-76a76e84da90","resolution":{"observed_at":"2026-08-07T11:56:29.701569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:29.768209Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.768209Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:9635c3290d56488d5791c5a69d29ee65aeb79fb30078a8ffdaa5e8e6837f38cc","observation_id":"52c15b9c-a07c-4c0d-8f30-eec444771e7d","resolution":{"observed_at":"2026-08-07T11:56:29.768209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-07T11:56:29.866099Z","title":"Sparks of artificial general intelligence: Early experiments with GPT-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.866099Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:74992a15a8ad4fcc05b4ff8e58c6602edfa8db01089149a77888016594f04557","observation_id":"eb8c60f9-0d8a-4f75-b3b3-1ac1710b9d85","resolution":{"observed_at":"2026-08-07T11:56:29.866099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.121150Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":"0859d098-3013-42e6-8e1f-16d8b846b595","year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.927015Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:8672c8073c5aa0a081ec24e7c1afa90bca39e73db4115908bc63c0b830d20f56","observation_id":"c7bf8963-f614-4700-8a85-8fd0267fb6ab","resolution":{"observed_at":"2026-08-07T11:56:35.124339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.111193Z","title":"How do large language models acquire factual knowledge during pretraining? In Neural Information Processing Systems, 2024","venue":null,"work_id":"d2642c17-ee77-4726-a42c-b5bc3a9aaa04","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.009946Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:74458be56c111f7f7e2cd167af8c2977fb24202e5fd6a7c387834a3f2b395ff2","observation_id":"acbe91c0-5b91-48fb-a285-504003286703","resolution":{"observed_at":"2026-08-07T11:56:35.114386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:30.089145Z","title":"A survey on evaluation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.089145Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:0860ba65aa085bd4957101b5d902880bd53e7c3cbdab15eea6f9b1127c701d12","observation_id":"3dcb6d7e-dcd2-4478-b92e-73d7c8488979","resolution":{"observed_at":"2026-08-07T11:56:30.089145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.096235Z","title":"Estimating the number of species in a stochastic abundance model","venue":null,"work_id":"05029abf-5057-4159-a4f5-b83d00710194","year":2002},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.173634Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f96a96b1311efcb5062299add5a33bd759d3aafab5b953d6f983a760c916a2e7","observation_id":"c6a89fa4-efc2-4f5e-abc6-b7a8f00ec216","resolution":{"observed_at":"2026-08-07T11:56:35.099450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.087516Z","title":"A new statistical approach for assessing similarity of species composition with incidence and abundance data","venue":null,"work_id":"eb1e70c7-bb04-4f46-b1e6-8a38196e46d9","year":2005},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.264147Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f415f46b59a7751c07d8db2e9518475c60864f8c2956f3fac182748ef33749be","observation_id":"c10ddbc8-4a61-4e07-a370-281b9cbf1b2d","resolution":{"observed_at":"2026-08-07T11:56:35.090536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.078815Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"a65a46ad-b6d4-4500-9363-e3e8eb536ed2","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.373879Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:7cf341334568dce82b295c324196215d9b4b291bb2f19da811cf1cbcd96e43ce","observation_id":"f6da8e46-f8f9-4d7d-9a97-54c0cf7f2fed","resolution":{"observed_at":"2026-08-07T11:56:35.081757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T11:56:30.466711Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.466711Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f3d82d914214a56f5fa9290e76b62f09b42cd46459f1d08307444d8fb23ff45f","observation_id":"b03eeb4f-30c9-42f9-96c8-d6df7e737740","resolution":{"observed_at":"2026-08-07T11:56:30.466711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:30.563192Z","title":"Forgetwhat you know about LLMs evaluations—LLMs are like a chameleon.arXiv preprint arXiv:2502.07445, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.563192Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:e395036b512ae6833b5654580249c64ad0dd778404a1e2038332a79ea7bde5f9","observation_id":"378f9079-eb0f-42d9-8c91-8c2c76031828","resolution":{"observed_at":"2026-08-07T11:56:30.563192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:30.691748Z","title":"Springer US, Boston, MA, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.691748Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:342c8a79b1e38e55acb12d8578a45b368cfd7e1b2643e1db75ad20dd86dde850","observation_id":"48ea9d4c-b2af-4788-8e7a-be70489ca6f4","resolution":{"observed_at":"2026-08-07T11:56:30.691748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.069730Z","title":"CURIE: Evaluating LLMs on multitask scientific long-context understanding and reasoning","venue":null,"work_id":"575507b8-5b96-4c80-8d07-f1127dfc53bc","year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.800214Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:3a86ac93befec95fc3fc29cf6f1534d8109516b4dd8e27f4f23ff2661f29c279","observation_id":"1127a67f-eacf-47b3-8e4f-5f31f4a9b94c","resolution":{"observed_at":"2026-08-07T11:56:35.072802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:30.902979Z","title":"Data science at the singularity.Harvard Data Science Review, 6(1), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.902979Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:d8dd7ab8975cd05dfe2868b48a84020446e20cc81388e95e6060807077c142ad","observation_id":"3dd36863-3d46-41a1-b651-f92f6d11ca24","resolution":{"observed_at":"2026-08-07T11:56:30.902979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.054297Z","title":"Estimating the number of unseen species: How many words did Shakespeare know?Biometrika, 63(3):435–447, 1976","venue":null,"work_id":"5fe45319-3409-4a21-b0f0-69ecb9371303","year":1976},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:30.995955Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:858737e9a36b5b223f6fe8312957f6f0325a5ce4c63b5155eb580e5e3de44ee2","observation_id":"b88b454a-e470-4841-8662-022324c9d8d5","resolution":{"observed_at":"2026-08-07T11:56:35.057578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.044264Z","title":"Near-optimal estimation of the unseen under regularly varying tail populations.Bernoulli, 29(4):3423–3442, 2023","venue":null,"work_id":"a359c372-e884-4183-b0f8-7b4d60ea6732","year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.108281Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:e781dbbbf6cc75090652dff6308282307759ab25af05265021ed9d31f45262a4","observation_id":"fec3978d-2ff7-424c-a75c-b4eb4fbd38ac","resolution":{"observed_at":"2026-08-07T11:56:35.047540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:31.201554Z","title":"Good-turing frequency estimation without tears.Journal of quantitative linguistics, 2(3):217–237, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.201554Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f23d92885cb33891750ed7193713d739e46be03e7957bce3a57884dbc7cf8fdb","observation_id":"ca5772c1-a696-4352-a239-2cbaa2b9bfed","resolution":{"observed_at":"2026-08-07T11:56:31.201554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.027942Z","title":"The population frequencies of species and the estimation of population parameters","venue":null,"work_id":"894c9f78-0683-42fc-ab0e-c7417f91c73c","year":1953},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.316125Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:4d29e3e7e0072b77f0da46e0b27c7ee2865a51a6afda8f303f2f043e8e74cb5c","observation_id":"2f94198c-03f9-46b7-83f1-1ac2be5258f3","resolution":{"observed_at":"2026-08-07T11:56:35.031401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.018086Z","title":"Estimating knowledge in large language models without generating a single token","venue":null,"work_id":"4d7b8168-7167-480e-9ca9-ece28385c62b","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.399782Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:04d07cc32a8d333efdb092b20620f235457bbee7e8cd7af596b4c79255ff5e74","observation_id":"f11c90b2-fe19-45a4-9762-1131b0048e9b","resolution":{"observed_at":"2026-08-07T11:56:35.021476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T11:56:31.486703Z","title":"The Llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.486703Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:770ad358e14da09e5dfea8e5bda686040ea6ea87ffb48f3ac0f9de7738bfbb3d","observation_id":"f17a9559-781b-4bc9-8727-ba3f6e3ed67c","resolution":{"observed_at":"2026-08-07T11:56:31.486703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:35.007663Z","title":"Optimal prediction of the number of unseen species with multiplicity","venue":null,"work_id":"7244dee8-7e01-4fbd-af8a-104e9ff0944a","year":2020},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.589683Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f5227207b9585120434dc7a9ae325c9742992c677a4a66b7e528a053d6a8e9db","observation_id":"aae552b3-fbaa-4cbf-9c85-4b0dfad527ba","resolution":{"observed_at":"2026-08-07T11:56:35.011026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:31.701733Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.701733Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:50ee484be592bd326beb454a155fbac77835ce3a4a9dcf8202224787de2e8770","observation_id":"e1b4f6e4-a378-4ed5-83a4-01e165bbcbb1","resolution":{"observed_at":"2026-08-07T11:56:31.701733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:31.806850Z","title":"The curious case of neural text degeneration","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.806850Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:3c0a6bdecd33ab5a05cbbc063276ed6882643d5c9b1a6b5efc1d06d05d2872ec","observation_id":"2d78d870-0ef7-45a6-8018-4b91dc929097","resolution":{"observed_at":"2026-08-07T11:56:31.806850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:56:31.905024Z","title":"GPT-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:31.905024Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:eb72e6a61567ed7bafb3de04bc2ac779a8ec6e6f025605e71d450bfeeaba4494","observation_id":"3369593b-ec38-4dc2-93f2-35b1cbc63d97","resolution":{"observed_at":"2026-08-07T11:56:31.905024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T11:56:32.057825Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.057825Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:fbbe3f116bf4c13636e9e3fe0bf450daf00096e1338191143a12aedf3481b473","observation_id":"8b7ece32-5645-4610-a2fb-3ebc3a7c75dc","resolution":{"observed_at":"2026-08-07T11:56:32.057825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.985228Z","title":"Calibrated language models must hallucinate","venue":null,"work_id":"06dbedf8-c8a7-4777-9773-a0be618fdbd5","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.156600Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:0d3c1fad5399bbde13e58860b29ca0c9131e902d729191d7f8af7bba970d140f","observation_id":"e6655ea8-530c-4da3-ae41-b5589d52714f","resolution":{"observed_at":"2026-08-07T11:56:34.989799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.11256","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.649439Z","title":"Line of duty: Evaluating LLM self-knowledge via consistency in feasibility boundaries.arXiv preprint arXiv:2503.11256, 2025","venue":null,"work_id":"125431ef-f3b6-4637-b37a-a9759d993a91","year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.274696Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:6abb76327f5d64a78c4068b8d3f426918264baf6c3b87794710baffffcf99058","observation_id":"b677d7cb-2225-45af-b630-69fe5edaf29d","resolution":{"observed_at":"2026-08-07T11:56:34.654800Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.975963Z","title":"Too many AIs.https://dev.to/leeaao/too-many-ais-24nb, 2025","venue":null,"work_id":"e9ab2ae4-5461-415b-9ef3-563dde05c64a","year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.398334Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:028d97ea931eff55ab47e6eaf89198f09705cb29dc9f76283936379e6663d99d","observation_id":"aec70103-f245-46c7-a6cd-500493c24cc3","resolution":{"observed_at":"2026-08-07T11:56:34.979147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.966892Z","title":"BioASQ-QA: A manually curated corpus for biomedical question answering.Scientific Data, 10 (1):170, 2023","venue":null,"work_id":"e1d3bf7f-4484-47ba-92ba-bebd02a6c4e6","year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.490401Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:38e99672c5a44f449d416684d5872794d57f87c9dd290e4d7b20236a7cfa171b","observation_id":"57c732cf-9d26-4733-8cec-29c15d6a59d4","resolution":{"observed_at":"2026-08-07T11:56:34.969869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.957284Z","title":"How pre-trained language models capture factual knowledge? A causal-inspired analysis","venue":null,"work_id":"33798cfe-7523-4d95-b49d-b47b18659c48","year":2022},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.562356Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f053074122a984f15f62925ac536efc90fcdce101badfb6ee1577a87c148e9f9","observation_id":"1fa5d269-dc34-47e8-bc34-dcdc8e918390","resolution":{"observed_at":"2026-08-07T11:56:34.960897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.948560Z","title":"ROUGE: A package for automatic evaluation of summaries","venue":null,"work_id":"bafe8b6d-015d-4f0f-9ac3-535d244dffd1","year":2004},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.665033Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:7391035e4d376a69513d25dc71a877ffbd6e4f67c83be31da54bbfb731453048","observation_id":"95f36e0b-4d3d-4373-b917-47032910befc","resolution":{"observed_at":"2026-08-07T11:56:34.951469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T11:56:32.742702Z","title":"Deepseek-V3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.742702Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:36c14c494db93aa732cdf719ec95ddf228696d0b18faed2ede3d6d79e072400e","observation_id":"a9b5a12a-3641-4fcb-9030-656528f8c9ac","resolution":{"observed_at":"2026-08-07T11:56:32.742702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.939704Z","title":"Feder Cooper, Daphne Ippolito, Christopher A","venue":null,"work_id":"9f6a97fa-8277-4052-84e6-860e04f4aea5","year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.831463Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:703d423935e8111307e7abe83d727db1c4cae4665ae99331e8aa7a5afb17f0fb","observation_id":"0ab7b408-c554-4834-8f88-2094453ab49a","resolution":{"observed_at":"2026-08-07T11:56:34.942557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.931128Z","title":"ChatGPT-3.5-turbo","venue":null,"work_id":"1dd93daa-203c-4bb3-b17c-1f4d5b0f8759","year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:32.939632Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:a369491e5850ceee0a4ce02006fb5aca37d616d263d4a3854cbf1bcc04b3be5f","observation_id":"9bdadb55-1361-4762-aa38-54a9fcac97a8","resolution":{"observed_at":"2026-08-07T11:56:34.933728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.922523Z","title":"Competitive distribution estimation: Why is Good-Turing good","venue":null,"work_id":"2bdb1e6c-208a-4979-a79b-1f50d7f9255a","year":2015},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.057660Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:6f3b5d3c22dfd11c021c89fccdcdd4a37892d9c56b6b5bf2da3a37b4bd0991b1","observation_id":"85ce83e6-eff3-4976-9842-f6f8c64f84f4","resolution":{"observed_at":"2026-08-07T11:56:34.925398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.913965Z","title":"Always Good Turing: Asymptotically optimal probability estimation.Science, 302(5644):427–431, 2003","venue":null,"work_id":"fe13aecf-eaa6-48ca-8575-2a5a6adf4d11","year":2003},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.170593Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:d6a89d3f888eae9c3c2f461a97702501c1b1a9e3a2a411e7c74d663b84d6766a","observation_id":"f17f5189-d0c5-46f6-8727-8bcb583d3a86","resolution":{"observed_at":"2026-08-07T11:56:34.916852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.904251Z","title":"Optimal prediction of the number of unseen species","venue":null,"work_id":"cc077b99-1101-4bc5-8944-a83f176dc0e1","year":2016},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.261347Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:d9cf66cd46649ded5f0d73e70f32a0861eda2d8cab0af4102354bf21a4c4c83d","observation_id":"f2c6e254-e81a-4a3b-8fbc-06a456d11fd1","resolution":{"observed_at":"2026-08-07T11:56:34.907642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.894398Z","title":"BLEU: A method for automatic evaluation of machine translation","venue":null,"work_id":"6087d47f-162c-48a4-b971-4863957675cd","year":2002},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.392631Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:9fe4586cd5c3691d16e264b466b69e729fbb4c8f2348f5c8b611be63acd2408c","observation_id":"ce2a9fe4-7ca7-4a92-98d4-b5a1a592c3c0","resolution":{"observed_at":"2026-08-07T11:56:34.897789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.885466Z","title":null,"venue":null,"work_id":"127a3e52-ee18-43e8-968b-c38872c2d32f","year":2019},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.542099Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:98e5b52f8f76e4d780e839df48046135b237544d7f2e174a3793bd287d16dda5","observation_id":"0faef811-19d8-4ae0-9219-45c3b109bcb2","resolution":{"observed_at":"2026-08-07T11:56:34.888538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-08-07T11:56:33.693512Z","title":"Humanity’s last exam.arXiv preprint arXiv:2501.14249, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.693512Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:dbeedae9a196fc5eb34581ed1d7e32e7b1014550aa51747b9ce703f9c9e88ac0","observation_id":"68e09110-55f4-421b-9086-8ebd96634a3c","resolution":{"observed_at":"2026-08-07T11:56:33.693512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:33.840301Z","title":"Do large language models know how much they know?arXiv preprint arXiv:2502.19573, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.840301Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:96f1e797c8469596a5cb2fc9163f6c95fb9afde184f12c4526126e1c5160e734","observation_id":"900d1761-f576-45ef-b239-387891575e95","resolution":{"observed_at":"2026-08-07T11:56:33.840301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.876505Z","title":"AI and the everything in the whole wide world benchmark","venue":null,"work_id":"b1c093cc-21fa-4141-a060-36569e5bcad2","year":2021},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.927131Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:60bab6c36c9d4d9b6568251b8852e047a2cdefd1ea9a4e732997f0badfb7065d","observation_id":"96fb3030-8cd4-4bf9-90ff-ba9b27161418","resolution":{"observed_at":"2026-08-07T11:56:34.879529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.867164Z","title":"NLP evaluation in trouble: On the need to measure LLM data contamination for each benchmark","venue":null,"work_id":"15442787-f265-4264-a901-32f861418f89","year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:33.972092Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:17db4defd72c5cb67196983ead718152b019b564cfb439a7a2339a329966b1fd","observation_id":"4b1c0bfa-8e40-4db1-82b9-0aa6c63ca32c","resolution":{"observed_at":"2026-08-07T11:56:34.870380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13507","last_updated":"2025-03-13T19:35:40Z","snapshot_observed_at":"2026-08-07T17:05:49.568835Z","submitted_at":"2025-03-13T19:35:40Z","title":"NeurIPS 2023 LLM Efficiency Fine-tuning Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13507","snapshot_observed_at":"2026-08-07T11:56:34.073212Z","title":"NeurIPS 2023 LLM efficiency fine-tuning competition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.073212Z"},"links":{"cited_paper":"/paper/2503.13507","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:00d2b1a74dc2ea72a070f150f2247c72ac789291fe66b66412a69b3b0fe96ab3","observation_id":"af1bb3c2-8c34-48f4-ba7e-f3450f84ede4","resolution":{"observed_at":"2026-08-07T11:56:34.073212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/nar/gkab920","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.388833Z","title":"Human disease ontology 2022 update","venue":null,"work_id":"ab4ca00b-3517-4ae3-a1f3-623468d7cf85","year":2022},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.173184Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:6318c5289767f55c0454828c7086cbf45f602e6f82a86f1f33127a939b02e792","observation_id":"fadec12e-09ec-48bd-bdad-4678fb372d40","resolution":{"observed_at":"2026-08-07T11:56:34.393035Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.857550Z","title":"Auto- Prompt: Eliciting knowledge from language models with automatically generated prompts","venue":null,"work_id":"523624f5-200d-4fbb-babb-8ee6d14d741b","year":2020},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.298457Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:996011188530ccb1a8988ec089467fbcac4addabc5bef9df3ac92c38e56e4f9b","observation_id":"bfa37a32-4556-4365-bde5-612215903355","resolution":{"observed_at":"2026-08-07T11:56:34.860670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.304140Z","title":"Welcome to the era of experience.Google AI, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.304140Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:43999fbc34426f51eecbf099bd2e5b718f4beb22de307e0afbe1a877816f1b6c","observation_id":"4278205c-6193-4b12-809a-f2a1b2779fd5","resolution":{"observed_at":"2026-08-07T11:56:34.304140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20879","last_updated":"2025-05-12T16:33:58Z","snapshot_observed_at":"2026-08-07T15:58:09.672851Z","submitted_at":"2025-04-29T15:48:49Z","title":"The Leaderboard Illusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20879","snapshot_observed_at":"2026-08-07T11:56:34.307356Z","title":"Smith, Beyza Ermis, Marzieh Fadaee, and Sara Hooker","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.307356Z"},"links":{"cited_paper":"/paper/2504.20879","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:a957f66c178263c60bd417909b57e893b5f2a907f614391814cee501c0cd84e7","observation_id":"cb6f8d71-aa20-4602-a8c0-b521e391c82c","resolution":{"observed_at":"2026-08-07T11:56:34.307356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.311072Z","title":"Large language models encode clinical knowledge.Nature, 620(7972):172–180, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.311072Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:478b1aa6f49215b65506d820e3bf030880a13bb6efa4931542c4d2aec62525f3","observation_id":"0714b062-436d-42fa-8830-9680c3342321","resolution":{"observed_at":"2026-08-07T11:56:34.311072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.314529Z","title":"The bitter lesson.Incomplete Ideas (blog), 13(1):38, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.314529Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:d59094c9805f5f7afe79c2395995f8393ff910e4787323508fe0ffca3e938279","observation_id":"63154cd9-7896-4b3b-bc9f-231e38059ce7","resolution":{"observed_at":"2026-08-07T11:56:34.314529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09085","snapshot_observed_at":"2026-08-07T11:56:34.317573Z","title":"Galactica: A large language model for science.arXiv preprint arXiv:2211.09085, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.317573Z"},"links":{"cited_paper":"/paper/2211.09085","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:5240b0630670c0cf1d295b90c3c96f8ac669a2e0f8b365d726f9252ea88596e0","observation_id":"cdf82a61-b4c1-4319-99ba-e27ea41fb45c","resolution":{"observed_at":"2026-08-07T11:56:34.317573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T11:56:34.320882Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.arXiv preprint arXiv:2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.320882Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:71c27bc57376fe669340ba814bd0d92b5ad2b6272e8090ebc9c7cf36a490975d","observation_id":"bf256b5f-6e75-449f-bc4e-52fb3deaba4d","resolution":{"observed_at":"2026-08-07T11:56:34.320882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5749/j.ctttv","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.377703Z","title":null,"venue":null,"work_id":"38535c0f-a85b-4348-8dd5-b62ad85b188a","year":1957},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.324022Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:d009fb7e5690673ff7b607e6b7e6f8f7f8186c4943fc56b275c4c15975801ab4","observation_id":"18c493fd-f9b1-4e8b-9689-78de7603398e","resolution":{"observed_at":"2026-08-07T11:56:34.382001Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11967","last_updated":"2020-10-22T18:01:56Z","snapshot_observed_at":"2026-08-04T11:38:54.164582Z","submitted_at":"2020-10-22T18:01:56Z","title":"Language Models are Open Knowledge Graphs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11967","snapshot_observed_at":"2026-08-07T11:56:34.327247Z","title":"Language models are open knowledge graphs","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.327247Z"},"links":{"cited_paper":"/paper/2010.11967","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:6ec1714bc2e528e0907b3a2abfc3583763abaf5d4e4a03ec5598d722a04d876e","observation_id":"64e7e780-3939-43a2-953a-1324e6ab1c40","resolution":{"observed_at":"2026-08-07T11:56:34.327247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01623","last_updated":"2024-01-25T13:10:15Z","snapshot_observed_at":"2026-08-04T12:39:40.178596Z","submitted_at":"2024-01-03T08:49:12Z","title":"Can AI Be as Creative as Humans?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01623","snapshot_observed_at":"2026-08-07T11:56:34.330717Z","title":"Can AI be as creative as humans? arXiv preprint arXiv:2401.01623, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.330717Z"},"links":{"cited_paper":"/paper/2401.01623","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:9090272d069af8cc33e63b34f384356666d6752aef8aa1edb8abfea3a2fd8225","observation_id":"60d4733b-45b1-4bef-880f-000b5a15117c","resolution":{"observed_at":"2026-08-07T11:56:34.330717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.828336Z","title":"Chi, Quoc V","venue":null,"work_id":"1ac78e23-8329-49c2-8f3c-e35c03245bf7","year":2022},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.334226Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:dd4dcc36851a32559b45aa3507a2ee5b50cb3f46139958a51a8c9cb14f296adf","observation_id":"5d323f19-07f3-41a9-9f95-676aaa7aae99","resolution":{"observed_at":"2026-08-07T11:56:34.830980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.819081Z","title":"Estimating the probabilities of rare outputs in language models","venue":null,"work_id":"21b0ccc3-37fe-4dc1-ad1a-9a88217c4aa4","year":2025},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.337670Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:db9880ec654af53c1f3cbc165dd2ef9062e7cc9b44e8bbacc3f0986ce6c666c7","observation_id":"40608028-8344-4c9d-bbfe-42717f898ea3","resolution":{"observed_at":"2026-08-07T11:56:34.822545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T11:56:34.340659Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.340659Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:48b749ba9e039820bf326cfdd536bc80a6d4e9cbc9bed582b1be56bea6b59195","observation_id":"8f4f37ea-0c4b-4110-a534-f91081bc8a5e","resolution":{"observed_at":"2026-08-07T11:56:34.340659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.809970Z","title":"A careful examination of large language model performance on grade school arithmetic","venue":null,"work_id":"98fdccfb-627e-4efb-a742-3b14546c0118","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.343378Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:a4f8b99fa4ba50bd6e1b9d523154fa95ac2b64614db580bc1b898d4d73e66bc6","observation_id":"893d72c8-1572-424b-9370-94f79a7c44b2","resolution":{"observed_at":"2026-08-07T11:56:34.812963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06779","last_updated":"2024-07-09T11:48:49Z","snapshot_observed_at":"2026-07-06T18:43:38.955120Z","submitted_at":"2024-07-09T11:48:49Z","title":"Using Pretrained Large Language Model with Prompt Engineering to Answer Biomedical Questions","version":1},"cited_work":{"arxiv_id":"2407.06779","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.06779","snapshot_observed_at":"2026-08-07T11:56:34.409879Z","title":"Using Pretrained Large Language Model with Prompt Engineering to Answer Biomedical Questions","venue":"cs.CL","work_id":"c23055ea-e176-43d8-9054-5fbdbd7a7c57","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.346706Z"},"links":{"cited_paper":"/paper/2407.06779","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:d249e22097187231d9c2c2d870a67730620d1b9b32116337410c2201bbd99dfe","observation_id":"88fcaddc-d668-4a60-87fd-a06a821f89a5","resolution":{"observed_at":"2026-08-07T11:56:34.413661Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:34.800654Z","title":"Test your knowledge of mathematical theorems by listing 20 theorem names, separated by commas","venue":null,"work_id":"b950616e-dba1-481c-9670-2c9249bda57a","year":2024},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:34.350227Z"},"links":{"citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:f0dcfd5e247d7db92c8adb637196b2d4b0924a5bccfc7f004c6eb25f138b77d6","observation_id":"29d200ca-a50b-460f-8047-70ddb01d209f","resolution":{"observed_at":"2026-08-07T11:56:34.803679Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":3,"verified_fuzzy":29},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 1 inbound Pith citation observation for arXiv:2506.02058."}