{"as_of":"2026-08-12T06:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37da5dbb89699fead82ad03ec6b596eb32de25f1006f381c4c6bc882d91178d1","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T01:51:25.883463Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03528/citation-record","integrity":"/paper/2607.03528/integrity","json":"/paper/2607.03528/citation-record.json","paper":"/paper/2607.03528"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Large language models in law: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:dec076a2bb8deb7045bd0066d0f16fe498a4ca0467801fdd5e409791d5e603d9","observation_id":"bec28eef-0332-460a-abc3-7b6f0dca8bd7","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Ai-trader: Benchmarking autonomous agents in real-time financial markets,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:01987ec21537d73c8f791047d507bb3a3468817ed6b3a7025d9e072096a2d744","observation_id":"399e735f-572a-42cd-bf71-6dc98bd988e1","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Evaluating large language model workflows in clinical decision support for triage and referral and diagnosis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:079ade1d469d2131d3e85296a808fbfa5fdbf9ef30d5a09d8d2a85fec11a590a","observation_id":"2f82fbcf-4e73-42f1-ad29-f95afd75463c","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Evaluating large language models for accuracy incentivizes hallucinations,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:c077d2a8815ab85e7b2d88974152d0e9e295f14c33fd3c7ea07919cf042496d4","observation_id":"6bcbc1f7-0d38-492a-8436-436c979c5818","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"On calibration of modern neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:85e5ba7e34b4bd23a5fd7c5aa50a8ecde5f0cb88b382ee793b92adb56bca6ae0","observation_id":"4b862ac0-9538-420a-ba92-390ec667910e","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Measuring calibration in deep learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:12e17ef6952b80fe45f7434568048e25335fd1d32d2aa5727a74253cbf7faa09","observation_id":"5908e105-8391-4047-9328-0422c771ced7","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Calibrated selective classification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:b6638e73c30ff0e435b63e1f5d6b1dcd3d48e2322aafeca8801a66542f5a2acc","observation_id":"3eaab900-dcc5-41ef-8372-8955ca9c58ae","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Selective classification under distribution shifts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:f2bfd8b8d67027faefdf79a3a73a3c3d35fa1e9b1f7e5b253ead9c8f82a01f4a","observation_id":"0f78c077-9fe9-46f7-ae84-a7307fc22c0a","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:d1baf38206baa4d9984efb5501e2d63b9cd9df4dd7deb297645acb2d1fa95e99","observation_id":"c774baec-4272-49e4-bc4d-143a69575ff6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Beyond binary rewards: Training LMs to reason about their uncertainty,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:b10c1222bf4fd00bc453e3926f3ff162e832dfcf263cbc1d86e015c4cf3543c3","observation_id":"eebb9ee0-1246-4eb6-8769-406802e96599","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Deepseek-r1 incentivizes reasoning in llms through reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:6fe66d3eb910e262f5591e6dfa3923d4e23e7fbc63f845e1d3dc508158867cb5","observation_id":"c2df9701-1132-41bd-8a05-dc0b36ce8292","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Reinforcement learning with verifiable rewards implicitly incentivizes correct reasoning in base LLMs,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:2965241b6e1b13465a5e89e0cf7ad3bebc35eb666e98ec78d11716f63d8cacff","observation_id":"fbc0cec5-79ca-4751-9f81-30b4ca35eeda","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"How do LLMs compute verbal confidence?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:580ccb9e350abd2dbd7c74afff185ca6426712c35b3b887edaa7a1e53124b982","observation_id":"36c829d5-e77f-4d76-99c0-7efd896e3611","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Can LLMs express their uncertainty? an empirical evaluation of confidence elicitation in LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:d3f03b76a97fb1875dee7111cb0bbc3efdee32c9dcec8ca2e566e91973dcf5c4","observation_id":"c4e87e80-47a9-4f5d-9b85-9b1e9e14f768","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Taming overconfidence in LLMs: Reward calibration in RLHF,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:ea720a949f4ef543a255bda75272d6978e725c5570d9da5114a5dc1402e1c826","observation_id":"91533b61-79f0-40e5-8524-eb79f5e30dff","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Available: https://openreview.net/forum?id=l0tg0jzsdL","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:2e78bb070d45d6a669484690f684baed54a7019749947833a808f326280daa83","observation_id":"02c50abb-39b1-4511-a967-adc3d9249c57","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"A novel characterization of the population area under the risk coverage curve (AURC) and rates of finite sample estimators,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:cbd3562e287dcb7ece18052b6874c282078a40ae06522ccbce6c5fff22c03346","observation_id":"157382eb-bbe4-4978-a19b-a62ae6ab16d3","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"A survey of confidence estimation and calibration in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:e8082403875adbcf50f21203caccf9a8ab357f02b15bf9eccbec1b644b2a608c","observation_id":"5f539d47-596b-4aec-ae19-746c6ba8d1aa","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"A survey of uncertainty estimation methods on large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:a44da5ad5ae85a333c34032b190961b108bce842208db9c5a41a4c797ed9ff25","observation_id":"e24d06d2-96c1-409f-855f-b56a4ddae7b6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"What does it take to build a performant selective classifier?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:384622c09096ff1bc8a9a6774594dcfcfeaca3809eca4a90f9c4e38ebb365f9d","observation_id":"9ada13f3-525a-4f01-ae60-1b957770d3ce","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Adaptation with self-evaluation to improve selective prediction in LLMs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:703c65e639a9ae3d48e4862e9b4c6dc99d557fada116d4066567b110628679c2","observation_id":"19f0741a-6bab-4df4-a59b-d652fba0b1e7","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Calibrating LLMs for selective prediction: Balancing coverage and risk,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:f60076700d7f598cf4ab45d07df4d53b0d93b12865540dd6e2e532ce57d4d3e1","observation_id":"776c2baa-5fa0-4dd9-a576-9e886ba32709","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Optimal strategies for reject option classifiers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:2c3981213c0ef85daebe85ba89d81f519f75516b18e42b35243957375e8ba06c","observation_id":"256b359c-5440-432e-bb12-bce912b72a95","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:046387a967a12a57d3c594ef67b094d749a1999e7ec9b4ab72a5415c2b62dfff","observation_id":"b3d407f7-e19a-45ef-aebd-631deab47f1a","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:02c7586185f9d549f010814b31b9dc7d946ffab6b5bb96db6cf6e3d9a922c3e2","observation_id":"f8694dab-80a0-4ba8-845a-4f062a946013","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Available: https://arxiv.org/abs/2407.21783","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:8e372a779abcf49f5029651d8cac88930d5b59730612a7fc3120a21d2c1a534a","observation_id":"3fc86f36-b6dd-4f64-80f1-0b2a98837980","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"HotpotQA: A dataset for diverse, explainable multi-hop question answering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:8ae70bbfd0a1e1deffae24498b23454a6d7bca61c0a2f79c58443b9760d2b9bd","observation_id":"700cbd24-69db-430c-9d94-60ffee5476bc","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17387","last_updated":"2025-02-24T18:14:01Z","snapshot_observed_at":"2026-08-07T23:15:28.158449Z","submitted_at":"2025-02-24T18:14:01Z","title":"Big-Math: A Large-Scale, High-Quality Math Dataset for Reinforcement Learning in Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17387","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Big-math: A large-scale, high-quality math dataset for reinforcement learning in language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2502.17387","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:6bc39a83914751db977eba2d00523c9e16e74ae7f2565c6a8394580b44d716e7","observation_id":"6a4d4a1d-dfc8-46ab-93ae-5bb9458538c6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Measuring short-form factuality in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:29bf197012c964b29a643b5cc7cc358484bb7090f1dc6fedbb1b93825940617c","observation_id":"1f3dab7b-1b16-4dfd-9b34-fae242a03c93","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"TriviaQA: A large scale distantly supervised challenge dataset for reading comprehension,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:892030562236990cddc30c826613f7f19e55d9e52e61b986d64c21aad76d2ee0","observation_id":"e3012517-8558-48d6-b134-d3e03a9b1072","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"GPQA: A graduate-level google-proof q&a benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:5c011d33b70d523823948da4cb05662e54775b0cf9dda63b69686c0a6757b568","observation_id":"2cdb5e26-c61a-4b73-b9cc-6f2b646c2588","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Measuring mathematical problem solving with the MATH dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:43bf67539276329ef521ef487e56c60380a287fc667323534ed9fcb6a72f26d4","observation_id":"4b236d53-dbcb-41af-9f1e-d860d5e360cf","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:7091129ad20faa1148c42f51fd9e74901c059b61705a4e2f22e1d96e38985fa6","observation_id":"a1e0b9de-58e3-45c0-bbeb-afe4fa02ca6d","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:aad29c90650d5ff7a8092500ff81a810ea11899d233636d2132e9b72a8b10584","observation_id":"f83d0c91-6836-4b5e-8701-b740fa29ab62","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Outcome-based reinforcement learning to predict the future,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:75bbca6888c79cdeffc7c369c142057be1e3cad9734273b07238951d1bc19267","observation_id":"1fb966ea-bee1-4ed0-94a4-79c52dc31338","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Available: https://openreview.net/forum?id=bbhdeL8EUX","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:deea295c50dbee55a2a9e98ff320d45b6e6620b36180eeaea2e104bf1d67251d","observation_id":"25d657a2-15c4-4336-9ef1-edd9c610a392","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:ae02550d00b8071fad3bd96a3302cd79a34d9ebca74c72940efbd778d17735f9","observation_id":"92469c7f-8fb8-4488-9773-ed82e3696d71","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06707","last_updated":"2024-10-09T09:20:24Z","snapshot_observed_at":"2026-08-10T07:38:56.114406Z","submitted_at":"2024-10-09T09:20:24Z","title":"Calibrating Verbalized Probabilities for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06707","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Calibrating verbalized probabilities for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2410.06707","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:b14e768b41f6dac7dc21b62f44ff832ce888d2780ebf44d699c4a02381822fe7","observation_id":"89b878ca-576d-4218-bf78-33d3ddb3e7e3","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Selectively answering ambiguous questions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:45cc1f7eb2b357f8ea85285c25e4fc191f4f746626e4def7c3f348aa2e856324","observation_id":"85381dc8-d0b5-4b5e-8a68-5539990767ff","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Post-abstention: Towards reliably re-attempting the abstained instances in QA,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:ea36143d44918cb1e5a41f1292a77792c1d60d843335643c971256e946d81973","observation_id":"761e4b7b-da68-497f-bfc3-d2e8a461adc6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Conformal language modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:7804f664335a1db1969f4b42fabc2eb7fdcf3c56f1aa4a35576d3d6df99e4031","observation_id":"645ce5ec-2ee7-4127-a80f-cfd1cc008e62","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12599","last_updated":"2024-08-22T17:59:04Z","snapshot_observed_at":"2026-08-12T00:44:36.092545Z","submitted_at":"2024-08-22T17:59:04Z","title":"Controllable Text Generation for Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12599","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Controllable text generation for large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2408.12599","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:1419205d9e7cf5a3cb779af265e4036b10bce39292a2e6890f1fb9741344a00a","observation_id":"9f7d682d-d0ff-467c-8d35-9f8a56dd3659","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Just ask for calibration: Strategies for eliciting calibrated confidence scores from language models fine-tuned with human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:71469f5b8a7ff338fc2c617c41b448882becc9f2bfb40fff4a31d5eb3d5b1d76","observation_id":"016e8036-a80b-4bd8-a6ca-44dd263b8219","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Semantic calibration of LLMs through the lens of temperature scaling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:b8b5d15ff6455acf2e023870251397dd3dd46f077bab8d1b115977f50b9565bb","observation_id":"3609a32f-2553-4cbf-b743-5fbc861e0480","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Calibrating the confidence of large language models by eliciting fidelity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:0e3626e38e3aa472430c21a6ac11938ed8291be63f534469d9aed57519183587","observation_id":"12d3293d-c9f7-4078-8211-7f0689a77774","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Calibrating large language models with sample consistency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:bb1a86fc25c030215be10be11ed624783505a755d0c85832689732ad46d6d15c","observation_id":"14152856-2e82-4974-aa85-792d61984d61","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Open-reasoner-zero: An open source approach to scaling up reinforcement learning on the base model,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:653fc741c0434edb6b0780cedec32bb9cb1ba9527190eb79ab5c3ba3aa84044e","observation_id":"0d9c4862-4cf3-457f-8eae-6b82a7b98ae4","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02864","last_updated":"2025-06-03T13:28:57Z","snapshot_observed_at":"2026-08-10T01:49:57.636880Z","submitted_at":"2025-06-03T13:28:57Z","title":"BNPO: Beta Normalization Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02864","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Bnpo: Beta normalization policy optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2506.02864","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:0a4e64e264244925e04c5985618b2e518029a38cfc4b0e1c4c4832c6676780a3","observation_id":"93c0b0fa-9621-45d6-8aef-b56b0f3682c0","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:9b353949ffb1d39fb539bb250599d5e3f04d5c4bda27ee3902bf3a49acde4829","observation_id":"80602925-b826-4ed2-862f-5351eb3694d6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Lora without regret,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:8cc321943d17e7ddc3926ab6868b7fc7e85bb0d7821fa728e92f4c8036a78ad9","observation_id":"baf6e7f4-eec1-4300-a671-a8189169d647","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:baa97a8daf91b0b07d6a4d916b368e5dfa96bfeac6a0ccba66bc059e80c987b2","observation_id":"02b733a5-ed49-4ec6-a1ed-2350b81d0ec1","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:269ac220981a06cc1e67e97aeecc4921e17b65ba2c88a6b4e7dbf119d5dbc330","observation_id":"0b1ddfe3-c134-45c5-a84e-698c71b32900","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18416","last_updated":"2024-05-01T17:12:10Z","snapshot_observed_at":"2026-07-06T18:06:49.190172Z","submitted_at":"2024-04-29T04:11:28Z","title":"Capabilities of Gemini Models in Medicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18416","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Capabilities of gemini models in medicine,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2404.18416","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:01307a66387f35ae93317e8878ebe7e24c3448788eedd952f6a06405ea2cd45c","observation_id":"996504ec-f614-42a8-8c6f-0a9b2105cf0f","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-07T23:53:34.814339Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Medgemma technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:9c644a34b8776b55e74a861e13cdd6ef3fd1c52add2053a338cf8016240cf60b","observation_id":"bd0f7b7e-ba27-4d9b-97b7-5ca920f2b8f5","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:f77fefa71fc157d66f96f93d412248c2efe6f99ec70a03a40d29904c311dd0bc","observation_id":"64cd9659-eed7-4f07-923e-a4d0a10b4e0c","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:28b6bbe46afff15b49080741226623e989f52d1507f1ffe2ad78adc8cf176d97","observation_id":"9f5b1ba6-ff35-49e4-ba49-de19d3c0846a","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"In these cases, it is also okay to have only a small number of uncertainties and then explicitly say that I am unable to spot more uncertainties","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:3226bc3206d7ae0debf965ec0003c38599383c0a5eac29fb91842e53f6b5706c","observation_id":"3f434036-2f13-4cb1-b571-dd703852b285","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"For example, uncertainties may arise from ambiguities in the question, or from the application of a particular lemma/proof","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:7832d2bfa9dbb390f1fba2db1a7bf4fd4094f4297327017d1ab1fb513e337bbd","observation_id":"27aeeec9-88df-4db9-bed7-464c3c43faf4","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:f9c1f4a302678696576ec2382082e1bfb5f11b67f9e0b5db6abe7098a6c38820","observation_id":"3d1e2356-23e2-4021-8f19-8d31cafc4497","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:cba79958f68853e6dd0e6fa1faddf8125f67bce57e7edff0c3756dfcb3e56094","observation_id":"2ec8dca4-a5eb-4425-ae3d-53486c432d4c","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:0a4fa2c33d00e5200e2f360e4c9c0c9a98f8d71964b1c9b06e19b20335a31da8","observation_id":"1e8d68b4-d610-4709-8903-f18c46f0b81f","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"This verifier is used for HotPotQA and HotPotQA-Modified","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:7038188d3e32851fc5ee82737bc6a3e774113e2174625f5e5de4abd58e2a41a3","observation_id":"ba18d7c5-0126-4301-9104-33545bcb21b5","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"This verifier is used for Math-500, GSM8K, and Big-Math Digits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:5428b856b30413b3bddfd62c9d567b3fbb2e9947f5555b1b9808966779ef2b74","observation_id":"c85f93ce-3f64-43bb-aa4a-0b105ae36b31","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"YES” or “NO","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:44bd3aa9435d4d1d7b675dabcb1487e3c0680d541ff6df2f48360eba7cd6cf4b","observation_id":"61f058d1-998d-4a3e-a07c-22926662d6af","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"This modified version systematically varies the availability of supporting evidence by removing zero, one, or both of the key para- graphs required to answer each question","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:e4c0cd52c6594c8f4c41fd63ec1edaf1cc1a730e1210cef9bfe28a91af9d4c7b","observation_id":"d3fecd6c-147a-4ff2-ba5b-df0ff99e3a77","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:104ff5aca1c8fe1a62e1028baba9d4b2342d96faa4538c1920ef8d721fd414a3","observation_id":"f8a3e2e5-6543-4a68-b92f-cef0805c7f49","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Thus, each question contains 8 paragraphs with both supporting paragraphs present","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:456ca9c0e78c0f710a6825621086d4dd6933f10940498d7a4c14fddb5378a5e9","observation_id":"117501cd-a0f7-4415-bac2-0a61fd6d9510","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured using exact-match","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:0ee9c6fa87fd3540dbf00f3bde535d9e77c34555e2830f1913983b670f51b7cf","observation_id":"09289332-7e68-4868-9870-e985e9410e1e","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured usingmath-verify","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:1e716bcdb568a690a3c2a7722bb5ea70a0891ab7b16ab7bc169e011a8e7a0be4","observation_id":"f2d6c769-46cf-4d89-b455-a9128b9d64e9","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured usingmath-verify","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:2f476b1de64d0edbf92dec2673a7b76589e9923b4352229d2e4a41ea66eb87bf","observation_id":"f1b1ac74-fbd6-463d-a1e2-03da61999975","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured usingmath-verify","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:8414ba1b0731f33747497cb711fdbc6fa52d355bf6eb0cdbd12b6d71c823b53c","observation_id":"93d37c81-2e19-4beb-a503-d318ca065359","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured using LLM-as-a-judge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:c06a61322a914fba3ab21cbfbb6faf99371ab40b36e59656db327c43ae86882b","observation_id":"96a6dcc6-b8ca-48f7-b537-f7fe982686cf","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured using LLM-as-a-judge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:9c424dbb1dd13d201474e1508002aa506320b345a4aab97f38d4cdef5e5b2d8d","observation_id":"ef4c4c29-706d-47a2-8362-abddb5efa5c6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured using LLM-as-a-judge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:da192f15a952e8ac4d965e43d08dd1521c6de2a2f8d42a1b8d6762ec40161e59","observation_id":"f5336130-c10e-4099-a2ee-72c12181bc58","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured using LLM-as-a-judge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:99be46956b10807345aa3901e4cb02f5f339f174f1a2244dfd534ac5f09a0609","observation_id":"64f70914-6f6d-4187-a804-5991a8ab911d","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"Correctness is measured using LLM-as-a-judge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:de121e562395888d3b1c5cec1e52890b6984c3388059e7986950b4f2ed291a53","observation_id":"d47453aa-3a5e-4263-90d0-5af5363531a6","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"We refer the reader to Sec","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:89d703a9d803138a30fe61fe7740765a10449d2bc457e07d03b5265604dbe81e","observation_id":"ce152bdc-3929-46ca-b4d1-3166a03cd78c","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"We useM= 10bins","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:9a7dc8f7d9afcc7f8e8dada1c0a7e1f0b017b40bd224680c3f00216919690d4b","observation_id":"32794888-b62e-4905-8be0-5ae10da7a64e","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T01:51:25.883463Z","title":"D. Nitrofurantoin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-12T01:51:25.883463Z"},"links":{"citing_paper":"/paper/2607.03528"},"observation_digest":"sha256:34240f9575a25fbbb833aba572853308677840dba33f93ae5c8a08c10fb826e0","observation_id":"2e75d477-13dc-4219-bd3a-adfcbd97c40f","resolution":{"observed_at":"2026-07-12T01:51:25.883463Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03528","last_updated":"2026-07-03T17:59:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T12:10:15.366904Z","submitted_at":"2026-07-03T17:59:02Z","title":"Aligning Language Models with Selective Prediction"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":78,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 0 inbound Pith citation observations for arXiv:2607.03528."}