{"as_of":"2026-08-19T18:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:003dee90aa67d516c6574c32a9143882f14abcb6adb7426161875f958420ba58","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T06:30:43.889136Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T05:47:14.970921Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05122","snapshot_observed_at":"2026-07-12T05:47:14.970921Z","title":"Self-evaluation is already there: Eliciting latent judge calibration in base LLMs with minimal data, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02966","last_updated":"2026-07-09T05:23:35Z","snapshot_observed_at":"2026-08-12T21:53:21.913406Z","submitted_at":"2026-07-03T05:17:48Z","title":"Distill Where the Student Goes: Teacher-Regularized RL for English-Evidence Cross-Lingual RAG","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-12T05:47:14.970921Z"},"links":{"cited_paper":"/paper/2606.05122","citing_paper":"/paper/2607.02966"},"observation_digest":"sha256:b7785dd4a441d4a3119cbe7f9c55615dfd049d02f1e2cd3cf748aed8c394eaf8","observation_id":"ab02c2e2-20ec-402d-b72a-ee1617e4ec3a","resolution":{"observed_at":"2026-07-12T05:47:14.970921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.05122/citation-record","integrity":"/paper/2606.05122/integrity","json":"/paper/2606.05122/citation-record.json","paper":"/paper/2606.05122"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"and Zhang, Hao and Gonzalez, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:af53327c18cd9ba8a5a764c45d131eeeddc6445e43309839b0a4fc40db5d3ac1","observation_id":"a631d994-c432-46fc-919b-eb89760e6e9a","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:2fa62507b2a3756b345bbe3ba68dfd35b5e9c2996e01a6acdf80d783270e502c","observation_id":"2b47c1af-e4e4-41df-a162-b1c2db35cd91","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:b1b7d9d3f200edaa0bcb1de29be41d9fc615a4e840cfe7a7b908e9b999e0981b","observation_id":"7c6f12db-2c19-46a0-9c07-9ced1698d743","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"Proceedings of the 41st International Conference on Machine Learning , articleno =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:40feaa18a95edb59047c140aadf7593c0f5ab24720f9da562ae673e70a2fa44f","observation_id":"542fdfee-eb25-444e-a765-28998b540b9f","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"Beyond Binary Rewards: Training","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:32ab4a9dfc96aae3e61affd2e662653a2cccba4196a792223c8e1deb19587898","observation_id":"7b0d3432-367e-4118-984f-78ca4c6d5233","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:a8447ab27d5b0c0d0c7944cc0f8a6b63c5be1179a86e7b8fbb158f5c36ebeb4e","observation_id":"fc28d5c4-e98a-48fb-a50f-73ae52e909f0","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:626922bb8bddd7419e195f94a780999c152b31cdeba12a3060dc93410865188f","observation_id":"30345224-185b-421c-8052-47c202ecbb44","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:410179f3410b0d5306de94264b52a116d97676867957e52f3a6a66e1caf42c94","observation_id":"f7baf63f-4770-4279-a6ee-b3dabfa0e3f0","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"The Thirty-eight Conference on Neural Information Processing Systems Datasets and Benchmarks Track , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:3b069276cbd54cc119f3e21f7401fd1b9440cfbcedd70eb2d24b8e823e3fae51","observation_id":"c1b0ee24-56e1-4cc7-a45f-d69770cd3439","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:48935491cf68d55f6d8f43a189a15a37df1626b26ea96b75dab39093592115e8","observation_id":"484e5b9c-3792-4469-89ab-bea747603432","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2023 , url=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:0167b89f2730d38ba60a94041d0430cd68ac6c361c59cc21b983a35132659717","observation_id":"71d18235-a1b1-4771-afbc-dda567400bf3","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1025","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S1: Simple test-time scaling","venue":null,"work_id":"16de4a03-b204-42b7-ab29-734d87b8cd33","year":2025},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:dbd7a9382cbfbd84368bd174679e3058fe225b29c11dffdcf81d5666de9b9a30","observation_id":"a5721d91-0afe-4d0c-9956-791508b12067","resolution":{"observed_at":"2026-06-28T06:31:42.636437Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-16T19:20:54.872421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T19:20:54.872421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:cbc2bcb636ef69198ab0e643ddd0358e5c3a5fe974cfa1f7e6b787189be3b19d","observation_id":"9c4014ca-7a79-4adb-8f02-f8b8ed85b534","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:b1d1a54f3317cf7f767736e46bffa3d6485ccbbb948b1d6ab31cebef3127178e","observation_id":"6df3854f-c1c5-454b-943f-3eabe58a0aa5","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:f06501b67f6049541ce8367c762990256b7e954e8e549385a7f3f47ab8b88a83","observation_id":"ddc72e44-ecdb-484c-bcf4-ca64a8b4829c","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:0a28f44051f703bc422ef480f41e15e338bafacf727614569167828634c5c939","observation_id":"7e1d91e0-1ddb-46d8-87a2-42129fd36dd5","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:8dd48b81b5495e467512a2c97416c6dacf1fbee214eee21e5d2a70e8473b91ac","observation_id":"c2eca5ea-4372-4eed-9650-20737dab47a8","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:1e78746d26f037214b74d2d7c95ceb40a15bcb79e4db91a858183c13a83eca28","observation_id":"a45af100-4dad-4758-9c17-bb526795ca73","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:c970187d2356f8b3e667a5a7639d0c0f8805a472ecccdb270a892fe3ca623fb6","observation_id":"a3506c85-cb4c-4812-9ddb-8d585bc91484","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2023 , url=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:ac46be120960f5d7eb4c0ca23db05154d0129f09fc3b0d6c0e6226f4d7326203","observation_id":"ed3cfe7e-875d-442b-b169-42a8610e1675","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2022 , url=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:03ac51f34aa7308206421ba2e390d979138a9ee90e625f51e17f83783822905a","observation_id":"f97445a0-2e75-46cb-9c95-23f773db77c3","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:eee263ad8996a7eeb2d1572302a27d854b8849a7ddcb0207af19631e5466755a","observation_id":"cb97ecf5-cd3b-4e21-bb9a-8169ddc0a612","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:23d822e3a3490ec204dbfac8a9bcb0789ec2c13a29c6ff1fedd9ba42e94c1b9a","observation_id":"4a9e9e3e-70b7-4a63-bada-849200616f16","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:72c6433284e1b310de8e1bc5730383133063898050ccdc6f16881806a90241d0","observation_id":"43eb4650-4eff-4da6-904f-a6213e5b0b56","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:30:43.889136Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-28T06:30:43.889136Z"},"links":{"citing_paper":"/paper/2606.05122"},"observation_digest":"sha256:3a3883bcec5110217ba0e377a3a025a80a81faf982a369d2259e41f4a2940aa8","observation_id":"4b6cdb14-0998-42f7-9cc5-8d37fb2336c9","resolution":{"observed_at":"2026-06-28T06:30:43.889136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05122","last_updated":"2026-06-03T17:27:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T01:37:02.099247Z","submitted_at":"2026-06-03T17:27:16Z","title":"Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2606.05122."}