{"as_of":"2026-08-07T09:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e4c317bed644cbbb6aaa159d8374331f69e32268bf3037c50422d8ecfd79c8bf","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:10:44.120366Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06377/citation-record","integrity":"/paper/2608.06377/integrity","json":"/paper/2608.06377/citation-record.json","paper":"/paper/2608.06377"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T04:10:43.127049Z","title":"Anthropic","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.127049Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:efee0a2d55d7fda227ab0a012d62e57b86f4316b96a503dbb47d9cdf4a6f21db","observation_id":"de5fff26-e8b1-47a2-bcc3-f095138614c9","resolution":{"observed_at":"2026-08-07T04:10:43.127049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T04:10:43.503102Z","title":"Mor Geva, Daniel Khashabi, Elad Segal, Tushar Khot, Dan Roth, and Jonathan Berant","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.503102Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:23eaeb7bebad1f8d81a417fe141f35bd1a19c34c296a5fe54e51b48de23a75fc","observation_id":"6e938e8c-db6b-4dc0-ac0c-5762692f62be","resolution":{"observed_at":"2026-08-07T04:10:43.503102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:10:43.574558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.574558Z"},"links":{"citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:ca3179404d8a5e164855d9e817cd242aa391cc49be21fb2459e0cf0c0c994d3d","observation_id":"ebb65bb2-77a6-48d0-b336-fc58a81573cc","resolution":{"observed_at":"2026-08-07T04:10:43.574558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15815","last_updated":"2026-04-19T06:21:12Z","snapshot_observed_at":"2026-08-04T00:23:39.759653Z","submitted_at":"2025-08-16T20:33:09Z","title":"User-Assistant Bias in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15815","snapshot_observed_at":"2026-08-07T04:10:43.689310Z","title":"the moon is made of marshmallows","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.689310Z"},"links":{"cited_paper":"/paper/2508.15815","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:6c500d1abe65ed3fe105dcc85e278c03b9dfc0a73beb9ddb5abb6729d4e9ee05","observation_id":"4d82cb14-4d33-4725-bd02-00f969e27112","resolution":{"observed_at":"2026-08-07T04:10:43.689310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09527","last_updated":"2022-11-17T13:43:20Z","snapshot_observed_at":"2026-07-06T14:19:47.424778Z","submitted_at":"2022-11-17T13:43:20Z","title":"Ignore Previous Prompt: Attack Techniques For Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09527","snapshot_observed_at":"2026-08-07T04:10:43.752073Z","title":"North Am","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.752073Z"},"links":{"cited_paper":"/paper/2211.09527","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:17846be77992384048ace15d5787d906319524f0929c547bb4a6f51ac1e7d49d","observation_id":"89561fec-e23d-4a63-a641-293eab41b16d","resolution":{"observed_at":"2026-08-07T04:10:43.752073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:10:44.446845Z","title":null,"venue":null,"work_id":"8920c1c7-e477-48c7-9f48-83ac2c24c3cf","year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.838984Z"},"links":{"citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:72c09ee4dfa2ed469d4e693831547ceeafd9a1feeadd47676d401037a8a34515","observation_id":"f6d5ff6d-3413-4f9d-87c4-f67d0d645c0f","resolution":{"observed_at":"2026-08-07T04:10:44.536920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13743","last_updated":"2025-08-19T11:30:52Z","snapshot_observed_at":"2026-08-05T18:53:44.682428Z","submitted_at":"2025-08-19T11:30:52Z","title":"Sycophancy under Pressure: Evaluating and Mitigating Sycophantic Bias via Adversarial Dialogues in Scientific QA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13743","snapshot_observed_at":"2026-08-07T04:10:44.016598Z","title":"Siyan Zhao, Zhihui Xie, Mengchen Liu, Jing Huang, Guan Pang, Feiyu Chen, and Aditya Grover","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:44.016598Z"},"links":{"cited_paper":"/paper/2508.13743","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:5ff720a78ed8a39b9d298aecc92c096c9d0d1da56d87bec7e0e4cd06b1f6193f","observation_id":"6757a1d3-49ee-44ec-a07c-bcd9837e1cbe","resolution":{"observed_at":"2026-08-07T04:10:44.016598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:10:43.266892Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.266892Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:e268b442cb80a5d7c307fe7ef22eb59a4c18260193cd6f6e805ce9ce7b30501c","observation_id":"11c4f194-8b8c-4dc9-8b93-a3cd0d378853","resolution":{"observed_at":"2026-08-07T04:10:43.266892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:10:44.649846Z","title":null,"venue":null,"work_id":"5c6ae050-41fd-41cc-8171-ab706376c6d9","year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.423326Z"},"links":{"citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:dba98ea94c4d382b46fa113e1df55770b04df0a525c97220f83f4306e46eeeee","observation_id":"c5bd237e-3b6e-4762-9592-bbeaf23a7bb4","resolution":{"observed_at":"2026-08-07T04:10:44.758253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.02234","last_updated":"2026-07-02T14:33:07Z","snapshot_observed_at":"2026-07-07T00:07:42.752664Z","submitted_at":"2026-07-02T14:33:07Z","title":"Purified OPSD: On-Policy Self-Distillation Without Losing How to Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.02234","snapshot_observed_at":"2026-08-07T04:10:43.931332Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.931332Z"},"links":{"cited_paper":"/paper/2607.02234","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:6abe23e15a81b52857c1ba5792a0ee1482d4fac65f6a3c2309c7a6e2423387f2","observation_id":"a2ffcca9-4f3c-4ee8-9a5e-e6bd2b924f5c","resolution":{"observed_at":"2026-08-07T04:10:43.931332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21318","snapshot_observed_at":"2026-08-07T04:10:43.082824Z","title":"Loubna Ben Allal, Anton Lozhkov, Elie Bakouch, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.082824Z"},"links":{"cited_paper":"/paper/2504.21318","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:0968921a70b0f07978d61c124d4a59b86e95a42abf8079190ffdccc968643273","observation_id":"dce39efe-da83-462a-b9b7-a328143600b6","resolution":{"observed_at":"2026-08-07T04:10:43.082824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-06T08:49:57.295985Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-07T04:10:44.120366Z","title":"Wei Zhou, Xiongwei Zhu, Zelin Xu, Bo Dong, Lixue Gong, Yongyuan Liang, Meng Chu, Leigang Qu, Lingdong Kong, Wei Liu, and Tat-Seng Chua","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:44.120366Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:79a57829aedd646d914b1576f5d5f4a3c623fda5238ce8c36df84709adfe200c","observation_id":"ad3daa9e-4fa4-4c73-a3e0-ae48bf3b87fe","resolution":{"observed_at":"2026-08-07T04:10:44.120366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T08:57:14.469418Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2608.06377."}