{"as_of":"2026-08-23T17:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fcb15dc90dffb3682cf902c27c329eedd0b9480a636d76055b0ca21d62742562","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:15:30.801562Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10315/citation-record","integrity":"/paper/2608.10315/integrity","json":"/paper/2608.10315/citation-record.json","paper":"/paper/2608.10315"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.294626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.294626Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:9488724bfec1d7f91502e690be1ee674545c4f1b73076caf12e19c32e7ea2f12","observation_id":"abe9e57c-1036-4e07-bad4-2f8c2682b559","resolution":{"observed_at":"2026-08-14T04:15:30.294626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.302543Z","title":"Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.302543Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:1e4076e3daa62787c4821b7b6dd88288f5577af1300f0df8f6c108a90cf17137","observation_id":"a23b5df4-e4f6-40ab-b970-027dc5b9ed90","resolution":{"observed_at":"2026-08-14T04:15:30.302543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.307592Z","title":"Calibrating the Confidence of Large Language Models by Eliciting Fidelity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.307592Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:594288cac57e46d975250f8724def94c0a32199756a3fc70fe655375efebcb99","observation_id":"d782df50-5e40-4f60-982b-da62ae1700b4","resolution":{"observed_at":"2026-08-14T04:15:30.307592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.313559Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.313559Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:f64303e6cad4326b1ed2edb1fe6b605bbbb6f908ac2f2e3cb5815a97067ae12b","observation_id":"5743f506-f56a-4011-8dc3-844abc3d1ed4","resolution":{"observed_at":"2026-08-14T04:15:30.313559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.230","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.224938Z","title":"Just Ask One More Time! Self-Agreement Improves Reasoning of Language Models in (Almost) All Scenarios","venue":null,"work_id":"94c47d51-13f8-43e0-a47c-6d331e4a48c2","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.319247Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b44eb31ac0819dd47541f281c0b1c70f8ffb830c2e65780238a7f3ea4b145c6c","observation_id":"ba301e16-c15f-4676-a765-b50f24d2ac1f","resolution":{"observed_at":"2026-08-14T04:15:31.234863Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.324929Z","title":"Mirror-Consistency: Harnessing Inconsistency in Majority Voting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.324929Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:fe568cec80fc361262c944128008769e4c7e7a600ca099699bf246900c84afe9","observation_id":"aca90084-7008-4eb0-85f9-962a00e3fb6b","resolution":{"observed_at":"2026-08-14T04:15:30.324929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.330851Z","title":"The Consensus Game: Language Model Generation via Equilibrium Search , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.330851Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:8c1eff7b01ff33c7fe9e4f22b9003353e3759f0c9f70fc5579939fc2bc97beeb","observation_id":"d2949ae0-5e52-4c72-9f23-83fba459abd1","resolution":{"observed_at":"2026-08-14T04:15:30.330851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.336252Z","title":"Le and Ed H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.336252Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:a39673de5c555ae470ee97a5be4ddc322f4096d5856a681fd2d829959eb09fc2","observation_id":"93c3f99d-b5fc-4a36-bd8b-b399b2d5f9e5","resolution":{"observed_at":"2026-08-14T04:15:30.336252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.341669Z","title":"Confidence Improves Self-Consistency in LLM s","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.341669Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:61307824f3647c467c2dd4d69dcb525e8aab8814931fd1c0c78f43d9b5f7d580","observation_id":"6f2e55db-a3e5-4cb7-a270-e92d8140692e","resolution":{"observed_at":"2026-08-14T04:15:30.341669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.347438Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.347438Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:750f3563569366d21c1a92653d8d1f430c64ec4016e07862f2e90586d1f58265","observation_id":"b6e1eb9b-d9a4-4885-b126-9ed31261c5e8","resolution":{"observed_at":"2026-08-14T04:15:30.347438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.352691Z","title":"SPUQ : Perturbation-Based Uncertainty Quantification for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.352691Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:92718648ec6b83853eda7eacebf28a61353d7ba7d1892fd5e908d622dda67e7c","observation_id":"1a0f32c2-c561-4e12-b1a7-f995c62fb808","resolution":{"observed_at":"2026-08-14T04:15:30.352691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.357573Z","title":"Semantic Entropy Probes: Robust and Cheap Hallucination Detection in","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.357573Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:3c319eb84cbb2b1b253697f1a3aea4d82c0858f53ffe99df4aa13feeec4fb474","observation_id":"6b69f52a-d87a-4cd6-9895-7d08ece25168","resolution":{"observed_at":"2026-08-14T04:15:30.357573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.362416Z","title":"State of What Art? A Call for Multi-Prompt LLM Evaluation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.362416Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b453a3b10457d08059a063ca51a91fb4c8906da66d9c8ea2f8bdaae4fe579aad","observation_id":"3476e836-0679-458d-8ff9-dc17eebf92da","resolution":{"observed_at":"2026-08-14T04:15:30.362416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.367189Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , author=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.367189Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:9c830a4b5c1f0227746912c7288cd9eea145afabeb4810d72e6cbad88d026be3","observation_id":"d66673ed-4690-46dd-a461-8c559f2da4dc","resolution":{"observed_at":"2026-08-14T04:15:30.367189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.372018Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.372018Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:58debda3af5b885c816ed8534fce3cf089109f2c0a7fef37a7d28f0285bea4b1","observation_id":"3cdb0b1e-f283-4a16-972e-263e7da8c01f","resolution":{"observed_at":"2026-08-14T04:15:30.372018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.377671Z","title":"Calibrating Language Models with Adaptive Temperature Scaling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.377671Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:ecbf4a6e700055bd1ce775c827fa810a2f9f0238cf962f7b06c98f76c8b75b1f","observation_id":"55bb1647-8d96-45b5-ab65-27443bd54a28","resolution":{"observed_at":"2026-08-14T04:15:30.377671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.384193Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.384193Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:88c1a79258ee5d61a7214c0c412814e9fee1214f12c5c8d6aac59fef2eb9b269","observation_id":"669b8d70-50db-4309-a473-21913ab94c40","resolution":{"observed_at":"2026-08-14T04:15:30.384193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.389186Z","title":"Nature , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.389186Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b1202b6361c5b151ef245ddd23fdc3c6715535a4fd8573d43f7c14b4093962a4","observation_id":"5d3702bb-84de-4213-be75-15fd39bcc7b6","resolution":{"observed_at":"2026-08-14T04:15:30.389186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.394484Z","title":"Beyond temperature scaling: Obtaining well-calibrated multi-class probabilities with Dirichlet calibration , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.394484Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:3fbff5a30ff3caca6923123af96861c8b33391b981f48bc7e42498ba86294ea1","observation_id":"1723659d-5912-4e6e-8763-68a5aba9dc64","resolution":{"observed_at":"2026-08-14T04:15:30.394484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.399537Z","title":"and Tay, Yi and Metzler, Donald , title =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.399537Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:f26d9d795ef7022634c9f05f19aac4ba56e2b9961228919159fecf96edcbbcd5","observation_id":"aa28e2fa-9b97-49f0-a884-b1f43078c0f6","resolution":{"observed_at":"2026-08-14T04:15:30.399537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.404210Z","title":"Fast and Robust Early-Exiting Framework for Autoregressive Language Models with Synchronized Parallel Decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.404210Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:70a1ead20a26b10e34e992eb6f7b76fc329f14d87e3b48601a6c99d3b08e01b0","observation_id":"2799d27d-d695-42c2-800d-174df465e2e2","resolution":{"observed_at":"2026-08-14T04:15:30.404210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.410032Z","title":"Fast yet Safe: Early-Exiting with Risk Control , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.410032Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:cf034136893ac2f84de11b4be9f8abb7e7e9d3af93bacb2da1bb27f2ff751009","observation_id":"bf253b84-56e1-4d95-8c6b-d4331bc0b100","resolution":{"observed_at":"2026-08-14T04:15:30.410032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.415614Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.415614Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:6dcab94cfca6f7e8bacfbb8e1fcf8a16c693bc0ae527fef1858d1df0897c91a6","observation_id":"100699b1-634a-4387-ad68-cdb5f25b426d","resolution":{"observed_at":"2026-08-14T04:15:30.415614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.928328Z","title":"BLoB: Bayesian Low-Rank Adaptation by Backpropagation for Large Language Models , url =","venue":null,"work_id":"a084121a-8ff8-46b0-af80-ed316e284a04","year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.420805Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:72c3a9e3213e8226ee479673632f7758bae018f3e4873a15010ddd77b74b8a6d","observation_id":"fd5569f0-7587-4cb5-be40-f1293e4b958e","resolution":{"observed_at":"2026-08-14T04:15:31.933821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1231","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.092478Z","title":"Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets","venue":null,"work_id":"877f272a-288c-4d3a-a884-3614e3088353","year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.426913Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:2b6f0e80a030bdfee224f1ff3eebdc947a341cb909dc3b5cd7c317a4901f9953","observation_id":"a0ff9094-6cb9-4703-b610-1dc67e0d0df4","resolution":{"observed_at":"2026-08-14T04:15:31.099271Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.911293Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":"f4449e96-2cd9-40d0-aaf6-fd5ff3500b73","year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.432774Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:4136f44c19d82c1ddfb4f600e7797cfce1b68d07ca4dceba985a389dc8232fae","observation_id":"0335e003-ff58-473a-9c3f-604c6e475000","resolution":{"observed_at":"2026-08-14T04:15:31.916714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.893189Z","title":null,"venue":null,"work_id":"f713b2f1-aac5-49ff-a3e7-6d66a8451a8f","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.437927Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:339318b76ef569a3323984ae7601951701af07d23bafff41734db978f3d57f92","observation_id":"b087c293-f474-458a-9b87-069a825af4cd","resolution":{"observed_at":"2026-08-14T04:15:31.898093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.443242Z","title":"Spotting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.443242Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:c6935ab4073e6f4aebf6f3e5446b12ee3a3b880b6de66acf8a7a515c2d0cbefb","observation_id":"43b8e894-7344-4200-af1a-8c1fe346d57d","resolution":{"observed_at":"2026-08-14T04:15:30.443242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.865172Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages =","venue":null,"work_id":"44263137-a152-49ce-8b18-f0ad1d707757","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.447939Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:a52be2db95da345ea3ba053a9ac415dff3869dd2915bf125ce3f1d83d60f53b6","observation_id":"a0d22552-aab0-49ca-8944-f9783f9d9c78","resolution":{"observed_at":"2026-08-14T04:15:31.870314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.453081Z","title":"2024 , url=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.453081Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:c1985a6d70037466966c8b9315873c060be1437ad67990aa169b70630abae9a8","observation_id":"4b63b55e-929d-41c4-a312-3465f55c49f1","resolution":{"observed_at":"2026-08-14T04:15:30.453081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.833942Z","title":"LLM-Check: Investigating Detection of Hallucinations in Large Language Models , url =","venue":null,"work_id":"a36fa29f-244d-480c-8e92-de730616fc48","year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.458084Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:e0ec72f49c3c496dd28a19268375c31fa80f1d3c37976f3436332e9c5038a128","observation_id":"e150c468-794f-4743-8048-241c5574e4a6","resolution":{"observed_at":"2026-08-14T04:15:31.839703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.817051Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":"3b1cdf70-0615-4f4d-adf6-6622ec668c2f","year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.462953Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:716af71bb91c8ab0ed12f454d1371c7fab05d5d6e58778c3bbb44bec860146bf","observation_id":"1bf65cbe-8fca-4962-ac6d-c7dd8421b99f","resolution":{"observed_at":"2026-08-14T04:15:31.822379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.798901Z","title":"2024 , url=","venue":null,"work_id":"4ab83423-96d2-427f-906d-5e60e96c3a4b","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.469180Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:1cbda78137487ec7ed7a0d82df5f3e3adfabcebff5f606a0e94210728a7415c0","observation_id":"b5af3d71-575c-48a2-877c-72f6fc1ac6b7","resolution":{"observed_at":"2026-08-14T04:15:31.804446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.779066Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages =","venue":null,"work_id":"281a425f-bf00-42d1-98d6-497e68c6a84d","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.475238Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:e831483c20aca2d510a04318e001efae4033562db910ceefe6f9d74891a27efe","observation_id":"6de0cb57-0828-4147-818a-c079b926ba5f","resolution":{"observed_at":"2026-08-14T04:15:31.785091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.762625Z","title":"Lamb and Desi R","venue":null,"work_id":"bca7c2f8-5454-4174-8ba0-a6146a0a9171","year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.480218Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:478e64f12dbc180b635b7e265ad2042fe33ffd68e6354363d2cda637af40452a","observation_id":"2e16cebd-cb9c-489e-90eb-05422a37575e","resolution":{"observed_at":"2026-08-14T04:15:31.767761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.484996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.484996Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:c460a77c9e426d622c43696f11d9876f6da4fa32354d852f756d194736260251","observation_id":"e039cec8-6c02-4663-a863-3a0645597aa4","resolution":{"observed_at":"2026-08-14T04:15:30.484996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.489905Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.489905Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:12f1d3082b90a551900d526a79666128d05aafaa132a06f83a65b36563ac0ff5","observation_id":"9344dc3a-a8f6-4d24-bdc1-75103f927a98","resolution":{"observed_at":"2026-08-14T04:15:30.489905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.494463Z","title":"Paraphrase Types Elicit Prompt Engineering Capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.494463Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b8ea23a40fe7c26c7ec089249b642ef3bd6d620bc6ec2e9758633c9022402d02","observation_id":"144445da-1fb5-41e6-9c59-ac0a3542d0e8","resolution":{"observed_at":"2026-08-14T04:15:30.494463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.059372Z","title":"Howie and Boix-Adser \\`a , Enric","venue":null,"work_id":"abd2cd4e-9431-48c2-840b-7bea6c34f50c","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.500056Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:8ba11a0eeca14cf819e018dfd724fe7090582a5b96cf2c7329a940982addf83d","observation_id":"1f30e5aa-ca86-49e8-a0bf-2bb61a3204c7","resolution":{"observed_at":"2026-08-14T04:15:31.065653Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.504935Z","title":"A Critical Evaluation of Evaluations for Long-form Question Answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.504935Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:2a796dd9df597c2b825d8906b2ea5af5087a558ab6d075e93f3fd1bfc32853f3","observation_id":"c477d87e-f0e3-4ec7-a210-4b09d9ab688d","resolution":{"observed_at":"2026-08-14T04:15:30.504935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.511155Z","title":"and Kry \\'s ci \\'n ski, Wojciech and McCann, Bryan and Xiong, Caiming and Socher, Richard and Radev, Dragomir","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.511155Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b0c7c71df834cf7caf5cf83f02d6504c93f5a45c6b4144edaaa86bde6562b536","observation_id":"f8ad056a-683a-4c01-9f8f-774afe5acb2a","resolution":{"observed_at":"2026-08-14T04:15:30.511155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.516891Z","title":"Humans or LLM s as the Judge? A Study on Judgement Bias","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.516891Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:5f79513da94abe35c02e18acbd1f52489bd9ad653c4216ecce3942c301005cb5","observation_id":"44e7f68e-cbe1-4784-a889-9cccc38b1b2a","resolution":{"observed_at":"2026-08-14T04:15:30.516891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.523408Z","title":"R -Tuning: Instructing Large Language Models to Say ` I Don ' t Know'","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.523408Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:23d2b55e5929b11d0c7559d5c2d8892dd9cf7df7d14c5dd0f37e610d78858ab0","observation_id":"dc028c09-e27a-4ec3-9186-ac9610bcbcd7","resolution":{"observed_at":"2026-08-14T04:15:30.523408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.528684Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.528684Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:09207ed83e870a2dd9dd78180dfa4ede6f1310a7b1399718f916e390c1d7945f","observation_id":"b6c0b2fc-dde2-4661-a738-f987ad436bd7","resolution":{"observed_at":"2026-08-14T04:15:30.528684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09297","last_updated":"2020-11-02T06:54:52Z","snapshot_observed_at":"2026-08-15T10:18:25.332628Z","submitted_at":"2020-04-20T13:54:12Z","title":"MPNet: Masked and Permuted Pre-training for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09297","snapshot_observed_at":"2026-08-14T04:15:30.538299Z","title":"arXiv preprint arXiv:2004.09297 , year=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.538299Z"},"links":{"cited_paper":"/paper/2004.09297","citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:76c8e7240628253cab5d1a032f30b84b6ebbe6bb195b26748f670c614027a137","observation_id":"fdc9e50a-0ab7-471f-91b5-e2e15ee5d2b7","resolution":{"observed_at":"2026-08-14T04:15:30.538299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.544610Z","title":"Attention is All you Need , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.544610Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:6438a5b81cd2561181821505127969abd4517351eb79f7c6dc6977e6b9aa1ae9","observation_id":"b96a61aa-0d80-49b6-abb0-8c232971c8a3","resolution":{"observed_at":"2026-08-14T04:15:30.544610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.549513Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.549513Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:cdb6be55a93cfe8eb3b3817464ad3183d0cba1e2516acb540e80493cbd712d27","observation_id":"b48af35e-0a98-46b6-ac50-cd962fdb3285","resolution":{"observed_at":"2026-08-14T04:15:30.549513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.554094Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.554094Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:1dc479768bc66e7d0935e64fc47ccf73a5b799e9afe4e4080e432299dc0dad2e","observation_id":"10896dbb-cf8f-4758-a16c-96811f7faf8a","resolution":{"observed_at":"2026-08-14T04:15:30.554094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.558846Z","title":"Borgwardt and Malte J","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.558846Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:a69df1a8288ea4ba87546d36d1a4bf3cf247ec4652d49e499b3afe29ed67cd63","observation_id":"ca4034f5-1847-4a51-9a89-3d038588a237","resolution":{"observed_at":"2026-08-14T04:15:30.558846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.666042Z","title":"2025 , eprint=","venue":null,"work_id":"812cc3c7-25a5-4008-9f73-3b49fd9d4933","year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.563419Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:f8dad08eba23a5caa871b62934a5dd0c6474b007931ff7391ab57660c57e4158","observation_id":"c9d72383-1af9-4100-9c2e-b61e85badaac","resolution":{"observed_at":"2026-08-14T04:15:31.671152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.568069Z","title":"FA ct S core: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.568069Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:c695d6ab37b4832880088f28fe0e2c637501b5c29c5cb868d6dfb4f32c9d6189","observation_id":"54b7e0c3-d2ce-45ee-8e8c-3e3edc61cda0","resolution":{"observed_at":"2026-08-14T04:15:30.568069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-14T04:15:30.573819Z","title":"Evaluating Large Language Models Trained on Code , journal =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.573819Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:f248404755350c23f14a318b78808da6bfac4dd0483b874faafcc26c8307db66","observation_id":"5c2133b5-0b2b-4f64-aec4-1d2c53c9d0fd","resolution":{"observed_at":"2026-08-14T04:15:30.573819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.578792Z","title":"Proceedings of the International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.578792Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:57763f5bcf9694ef8484007bef7b1a8b44586fac03968a6a43edb4af656e7903","observation_id":"61f0b4bf-3819-4b00-a780-f3dc027035ab","resolution":{"observed_at":"2026-08-14T04:15:30.578792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.583629Z","title":"Proceedings of the International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.583629Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:ba45bea085f16b60239d4a97a66af3e71d654d9c8993e848284b45de5d217f6a","observation_id":"01854225-4193-4eb6-966c-27db2627e298","resolution":{"observed_at":"2026-08-14T04:15:30.583629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.588650Z","title":"Are NLP Models really able to Solve Simple Math Word Problems?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.588650Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:366d4073339422f5552b546712fd596c7003165a1096a5fae1e1601a2b2f9927","observation_id":"62dfc15d-2727-486e-9157-e8a49f34034c","resolution":{"observed_at":"2026-08-14T04:15:30.588650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00937","last_updated":"2019-03-15T18:02:58Z","snapshot_observed_at":"2026-08-20T20:40:13.172297Z","submitted_at":"2018-11-02T15:34:29Z","title":"CommonsenseQA: A Question Answering Challenge Targeting Commonsense Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00937","snapshot_observed_at":"2026-08-14T04:15:30.593965Z","title":"C ommonsense QA : A Question Answering Challenge Targeting Commonsense Knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.593965Z"},"links":{"cited_paper":"/paper/1811.00937","citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:8fee140c15dd4a60890d10cdd9c4e5f9eb146741479f3596f1135b15ccc4192c","observation_id":"985aa8eb-26c5-4d83-ae81-d484754b76e3","resolution":{"observed_at":"2026-08-14T04:15:30.593965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.599559Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.599559Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:c3f6e39657b600a486ac08da7a085e85b99c94f37b3e6d4ce28db14f42f1e2d7","observation_id":"dde19000-efa6-4316-9346-984f0d49e902","resolution":{"observed_at":"2026-08-14T04:15:30.599559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.604239Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.604239Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:09f23fcd7e7002f9c88f16c7d9145a151820ec02b631e41341b56b35a33840b7","observation_id":"95ee15a3-8725-4008-96d1-11243ea6e5c8","resolution":{"observed_at":"2026-08-14T04:15:30.604239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.594528Z","title":"2025 , eprint=","venue":null,"work_id":"8e16760b-1b68-4173-9b3a-a281aa99adba","year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.608996Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:6a8cb933e5e965e98dee204dbf835c4e790e0648d20acd76dcbf47c791a52004","observation_id":"fe4e3c5d-1775-465d-b7e1-64866a189e6b","resolution":{"observed_at":"2026-08-14T04:15:31.599770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.613787Z","title":"and Szlam, Arthur and Dinan, Emily and Boureau, Y-Lan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.613787Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:cf32a3a8c3ca162ea8cea259be5622902ebb964670de94c6176d1b8909c8d42f","observation_id":"90b27959-3a28-406a-9a2e-33d52ae61590","resolution":{"observed_at":"2026-08-14T04:15:30.613787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.578558Z","title":"2025 , eprint=","venue":null,"work_id":"c09b6604-7e65-42e0-a53f-caf7be95fa55","year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.619119Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:76dbbf590c4acfb9498fdf7d5f48a6cccbd42ce6b001b0a576b15199a45a402e","observation_id":"7c5369b5-6a3c-4b91-b805-d1fdb33d070c","resolution":{"observed_at":"2026-08-14T04:15:31.583294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.624112Z","title":"PAWS : Paraphrase Adversaries from Word Scrambling","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.624112Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:743d82130bae7da9442a31c8813238f37b1b1aedf482cafc8e3a62b6875a6395","observation_id":"5ff39a4f-d46a-4a4f-9e78-ff7f03211797","resolution":{"observed_at":"2026-08-14T04:15:30.624112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.631225Z","title":"Investigating Data Contamination in Modern Benchmarks for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.631225Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:43692cdcae82694221a0fecf86d58f7512f489990ab47ff73b519307fe25adf6","observation_id":"9cf13e7d-ab42-4b15-8d87-08a2f16b94c4","resolution":{"observed_at":"2026-08-14T04:15:30.631225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.638619Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.638619Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:77501eccd91efffb304a33e5a51f0c6a1c11e6897ecf45853018e220b11353b2","observation_id":"43745f02-65ef-4102-be4a-fac507296f93","resolution":{"observed_at":"2026-08-14T04:15:30.638619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.644187Z","title":"A Careful Examination of Large Language Model Performance on Grade School Arithmetic , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.644187Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:e36a72a20c9e11c04ee90a9e4630727c9045c5cfb4bc590a080d532f819e673d","observation_id":"357efbf7-16b2-4885-9133-5112d673c2e7","resolution":{"observed_at":"2026-08-14T04:15:30.644187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.649693Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.649693Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:8b00bdcea075343360e8cca729b5c5fb7b32508d848553f154475bae0b8a96ea","observation_id":"9a19a718-fa30-469f-9f1d-452f6ad6accd","resolution":{"observed_at":"2026-08-14T04:15:30.649693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.654889Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.654889Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:a1ff71e8069d4891279b186d8d035ebb12bc1501d26a527074992502eef50c08","observation_id":"94b71320-546e-42ac-ae62-4a3c2836c3b7","resolution":{"observed_at":"2026-08-14T04:15:30.654889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.660521Z","title":"and Tram\\`","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.660521Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b0f6b15eb5458738d62e70d93de1fb1bc1ac49802b4ec05cabe1bc676652b9d6","observation_id":"54864481-5ff9-4206-b2fc-95105ad47a22","resolution":{"observed_at":"2026-08-14T04:15:30.660521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.528716Z","title":"Proceedings of the 38th International Conference on Neural Information Processing Systems , articleno =","venue":null,"work_id":"5f403dae-10fe-4e0c-ad54-137cbbaa5979","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.665606Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:9326a5dc774b9d004fc18e2ea917f519be0f8ec26815b9ad96408f4dd519570d","observation_id":"7b4b5b72-1048-43e1-b585-b3a19282a8a2","resolution":{"observed_at":"2026-08-14T04:15:31.534130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.676199Z","title":"Beyond Accuracy: Behavioral Testing of NLP Models with C heck L ist","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.676199Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:1bf13644fc8d030a3557bdf50828fc89adcb82275caddc5b0fbfcbbef6494b2c","observation_id":"ead02946-bc19-4756-a747-d4e78725624a","resolution":{"observed_at":"2026-08-14T04:15:30.676199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.681309Z","title":"Strength in Numbers: Estimating Confidence of Large Language Models by Prompt Agreement","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.681309Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:7cef0287f5cbdf98a58091973c70f80f59ee3a68527b77d382d24ff6fbdb7267","observation_id":"23e76d1f-9d4b-463a-b12f-5a6cfaf9349d","resolution":{"observed_at":"2026-08-14T04:15:30.681309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.686192Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.686192Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:ac9d9e6f4951adff6c25928e7d5dd6b3e44c0040db8f9ca8bf29f37f53adddca","observation_id":"73d18c4f-9f3e-48a2-87a2-30887da218d5","resolution":{"observed_at":"2026-08-14T04:15:30.686192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.510057Z","title":"Collins and Arka Pal and Umang Bhatt and Adrian Weller and Samuel Dooley and Micah Goldblum and Andrew Gordon Wilson , booktitle=","venue":null,"work_id":"0f0c0d3e-8c4e-422f-8493-0e7c0daaf70a","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.693457Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:483bae9ce1b90754db2c61331e1bd124591f9a5fbe42642b4d7041d5c3a450fd","observation_id":"f72b8900-2aec-43e9-bd4c-44c1b75254fe","resolution":{"observed_at":"2026-08-14T04:15:31.516071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.698629Z","title":"I Can't Believe It's Not Better: Failure Modes in the Age of Foundation Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.698629Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:ecd92038aa9aedb815604179cd5c161d938408614e86d48c0dd526d8651c543a","observation_id":"f0aad962-3299-4d2e-ba87-7016259d4f73","resolution":{"observed_at":"2026-08-14T04:15:30.698629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.704100Z","title":"Proceedings of the ACM SIGOPS 29th Symposium on Operating Systems Principles , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.704100Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:9e5b45f6fac99bbfbe63d51666f34702179bc902be57277c3d5eb2aad5e3a777","observation_id":"aee71090-a8de-482f-a521-ed9b24450ceb","resolution":{"observed_at":"2026-08-14T04:15:30.704100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.709956Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.709956Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:5bc5e882cbe4f8c44f63cfb0fc03897b0a3cebe4f4dc6175ad1af1c8ef1175e2","observation_id":"46956b4f-e621-442e-aa56-5ceb86346569","resolution":{"observed_at":"2026-08-14T04:15:30.709956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.714885Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.714885Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:03f9229c2a9a0fa048450d1350b5051195fc981e28ff85d9c7cb1c145331b42d","observation_id":"7ee86732-f1fd-444c-9eba-f9ed65c958e8","resolution":{"observed_at":"2026-08-14T04:15:30.714885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.719790Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.719790Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:759b24d25d5209981d78263157d108fd3ae719b37cf41307830e70be63ab1d86","observation_id":"c7a1e4af-d319-4d27-9d0e-5289ee38468b","resolution":{"observed_at":"2026-08-14T04:15:30.719790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.727443Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.727443Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b235377e65853f34b4608875ff46bddd6e2d322aa5449bda76c416b130054859","observation_id":"9b57d3eb-c02e-4f43-bb2f-f5d73f4e914f","resolution":{"observed_at":"2026-08-14T04:15:30.727443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.732662Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.732662Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:181d294bdae0d36fd6222c56fe19a62714d690d59d9a85ae7a788d005d298263","observation_id":"c8b370bc-cf06-4d06-8175-eb324cec5e88","resolution":{"observed_at":"2026-08-14T04:15:30.732662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.738589Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.738589Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:a4bd0194b342f30c7fdb8a9309dcf057798d29778423682eaa71d3a1b9db3a23","observation_id":"563e5923-e322-428b-80d3-cc86eaf6fd0e","resolution":{"observed_at":"2026-08-14T04:15:30.738589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.745137Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.745137Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:5e1b49aec6387262904f2f4c0974fddf36659e42e3f5d92c86ed19593ad66b47","observation_id":"c078bfb1-148c-4070-993c-f64c7faed9ff","resolution":{"observed_at":"2026-08-14T04:15:30.745137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.750401Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.750401Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:60f6bd56babd79d0f10cc821ef515154523086333966f59aca80dae7298b11a0","observation_id":"78e9c394-f298-4675-b5cb-3e333aa7c160","resolution":{"observed_at":"2026-08-14T04:15:30.750401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.757912Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.757912Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:b5a22ceea285faa47191e216294c393f75f297aca339842af4210b04abaaa95d","observation_id":"085a5f6e-428c-4be1-9625-e4964811a1fb","resolution":{"observed_at":"2026-08-14T04:15:30.757912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.368759Z","title":"The Reversal Curse:","venue":null,"work_id":"d6845df9-2b1d-4a98-b203-83f15d1b805a","year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.762940Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:1738e00080234393356fc59eac89686f3b39860fc1ad7be07b5f8d8a97cb1229","observation_id":"125fc43a-2812-48ec-9603-ee19fa30a7c7","resolution":{"observed_at":"2026-08-14T04:15:31.373855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:31.351516Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"273fe6ca-be2c-418a-aa5b-3bf656544539","year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.768313Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:2e477fdb8b0aca21e6eefb4556baf6c3303c4cd9243c659e68d75ba4e89b5524","observation_id":"0f1edf75-21a4-4883-9542-135732909284","resolution":{"observed_at":"2026-08-14T04:15:31.357614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.773001Z","title":"Do We Know What LLM s Don ' t Know? A Study of Consistency in Knowledge Probing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.773001Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:7ac2b876e00d0bcde46b460d6b7a66c7b19396e1170cd73bbda99a9a8828cf2b","observation_id":"07cf59d5-f25d-423c-a004-df6bfea33a93","resolution":{"observed_at":"2026-08-14T04:15:30.773001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.777915Z","title":"POSIX : A Prompt Sensitivity Index For Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.777915Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:fcfd6bfa720ddb3f7cff26a186fbe0f7861fb1be8a29429c0a5bca862212ece6","observation_id":"14b0d081-d690-45f7-b710-e03f517b7d83","resolution":{"observed_at":"2026-08-14T04:15:30.777915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.784724Z","title":"What Did I Do Wrong? Quantifying LLM s' Sensitivity and Consistency to Prompt Engineering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.784724Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:2d5c9383b00e92798cf8186b69eec80fa25a47af2e2740073502e2190a468dc4","observation_id":"a4f70253-426c-4182-b7fa-41a0d7241a85","resolution":{"observed_at":"2026-08-14T04:15:30.784724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.790255Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.790255Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:fbe2b8c8f13f55a9b7c5ab3be4ba34e6272cc0188119a5f7548e05ab0c996d01","observation_id":"06a0f199-6096-4128-bbb8-0793c3e93192","resolution":{"observed_at":"2026-08-14T04:15:30.790255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.795423Z","title":"Adaptation with Self-Evaluation to Improve Selective Prediction in LLM s","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.795423Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:99ac2ddfb7da3b5788c64685c51f552aaec517fe6dbec55f3e01f091a45ff14b","observation_id":"287aa04f-7f83-4555-b5f4-0b6c076eb52d","resolution":{"observed_at":"2026-08-14T04:15:30.795423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:30.801562Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:30.801562Z"},"links":{"citing_paper":"/paper/2608.10315"},"observation_digest":"sha256:158741f8e129e3b1a9a6ff3f2fac389bd3577fea053a24e8a976c9c2ebf040ff","observation_id":"f8d89a27-745d-441a-bcfb-c9f68c61c8eb","resolution":{"observed_at":"2026-08-14T04:15:30.801562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10315","last_updated":"2026-08-10T23:38:10Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T03:56:35.778494Z","submitted_at":"2026-08-10T23:38:10Z","title":"Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":74,"verified_exact":3,"verified_fuzzy":15},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 0 inbound Pith citation observations for arXiv:2608.10315."}