{"as_of":"2026-08-04T15:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48c176c06fe10329de9c53131abeff471b6d7d602c407259093ecff8f978ae48","coverage":[{"denominator":143,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T19:01:18.153145Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.00869/citation-record","integrity":"/paper/2606.00869/integrity","json":"/paper/2606.00869/citation-record.json","paper":"/paper/2606.00869"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:9d253d2887ea3da086e4f7b41cd09c3923b19019f21320af6c366e524f62db04","observation_id":"6e8ddb13-d959-4422-9b56-a948ff9426aa","resolution":{"observed_at":"2026-06-28T19:02:33.919403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a6e1eec8bcb1a385584dd47dc591796e3b3a4da0f187cfc895dfe92ebdf3af49","observation_id":"3e27f3d8-cc51-4dcd-9db2-313b076fff82","resolution":{"observed_at":"2026-06-28T19:02:33.921975Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"DeepSeek-V4: Towards highly efficient million-token context intelligence,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:2594c4ee4cb7a4097ac429e3a987607bef4596047aafbbd35a1127291a9e83ab","observation_id":"f826adc3-6a16-47a0-820c-41ed6a9e9b75","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.10165","last_updated":"2026-05-11T10:03:41Z","snapshot_observed_at":"2026-07-06T22:48:35.345421Z","submitted_at":"2026-03-10T18:59:01Z","title":"OpenClaw-RL: Train Any Agent Simply by Talking","version":2},"cited_work":{"arxiv_id":"2603.10165","doi":"10.48550/arxiv.2603.10165","metadata_source":"pith","pith_arxiv_id":"2603.10165","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"OpenClaw-RL: Train Any Agent Simply by Talking","venue":"cs.CL","work_id":"78607317-8305-4515-8dc3-20b4ff5b8f3a","year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2603.10165","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:17d6b9538cefff5e27e75aa9bb5eab48ddbcdb290e4f35d6406c2aea52269455","observation_id":"2664db67-8658-47b0-9f2c-8be158890c6a","resolution":{"observed_at":"2026-06-28T19:02:33.914341Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Magpie: Alignment data synthesis from scratch by prompting aligned LLMs with nothing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:e433cb0f1616cb6f022f0f14e09f5cbfb1141ada33edaad174d9eaebe91f000d","observation_id":"01c10909-202d-4780-a831-d277e9189004","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.24701","last_updated":"2026-05-18T04:10:32Z","snapshot_observed_at":"2026-07-06T22:34:18.297603Z","submitted_at":"2025-10-28T17:53:02Z","title":"Tongyi DeepResearch Technical Report","version":3},"cited_work":{"arxiv_id":"2510.24701","doi":"10.48550/arxiv.2510.24701","metadata_source":"pith","pith_arxiv_id":"2510.24701","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Tongyi DeepResearch Technical Report","venue":"cs.CL","work_id":"1c8db01b-b50f-4711-b181-a04bcc3e9aa8","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2510.24701","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:bf6d7808ec64eaac2181f732781973b211a8d820ff0ac9f5a1ecfc33733686e8","observation_id":"dda4e049-f471-4511-a460-3987c6c3876d","resolution":{"observed_at":"2026-06-28T19:02:33.916799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:5fceabe990cb9dd64d389c3bedd6a1c80582ab0d6af371633f75d01c8b002333","observation_id":"0b73d65d-9913-4209-86cf-830410a43f4f","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02957","last_updated":"2025-01-17T11:59:23Z","snapshot_observed_at":"2026-07-06T18:09:59.472962Z","submitted_at":"2024-05-05T14:53:51Z","title":"Agent Hospital: A Simulacrum of Hospital with Evolvable Medical Agents","version":3},"cited_work":{"arxiv_id":"2405.02957","doi":"10.48550/arxiv.2405.02957","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.02957","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Agent hospital: A simulacrum of hospital with evolvable medical agents","venue":null,"work_id":"cf994316-a61e-4c2f-94ab-afd7e70dc9d4","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2405.02957","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:caceb866dc7f68ebad61dcdcc8baf485461f738606ab679dee62c834342d2069","observation_id":"b034ec21-6d64-4e82-a233-b050464ceda3","resolution":{"observed_at":"2026-06-28T19:02:33.924827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Cbr-rag: case-based reasoning for retrieval augmented generation in llms for legal question answering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:80f9cb2aae828cb8cb562eca062de5fda2df53a8a4d2a5141639320905befaf4","observation_id":"ec3f4121-2ca0-48b7-b902-31ee327523cb","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07221","last_updated":"2024-08-01T03:02:44Z","snapshot_observed_at":"2026-07-06T17:58:25.894552Z","submitted_at":"2024-03-23T00:49:40Z","title":"Improving Retrieval for RAG based Question Answering Models on Financial Documents","version":2},"cited_work":{"arxiv_id":"2404.07221","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.07221","snapshot_observed_at":"2026-06-30T12:34:38.887084Z","title":"everyone wants to do the model work, not the data work","venue":null,"work_id":"8b08319b-b9aa-4476-aa3d-47991e8dc2b9","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2404.07221","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:fa55e8fb649a663be2bdebb15362949b16255312567cd23c2571601d6641434f","observation_id":"c1263faa-8c19-466e-8740-322a3025e680","resolution":{"observed_at":"2026-06-28T19:02:33.911742Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10912","last_updated":"2026-05-11T17:49:43Z","snapshot_observed_at":"2026-08-03T00:15:01.823825Z","submitted_at":"2026-05-11T17:49:43Z","title":"WildClawBench: A Benchmark for Real-World, Long-Horizon Agent Evaluation","version":1},"cited_work":{"arxiv_id":"2605.10912","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10912","snapshot_observed_at":"2026-07-11T01:37:42.499659Z","title":"WildClawBench: A Benchmark for Real-World, Long-Horizon Agent Evaluation","venue":"cs.CL","work_id":"070744ec-8dfb-4b87-96fe-d67e9e2114e8","year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2605.10912","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:2a0b9bf21710d327a1b60c801199cdf36ab66462628bcceb6a7471ea240306e6","observation_id":"5ee71bc8-a2b4-4e17-88cb-69ce72df285f","resolution":{"observed_at":"2026-06-28T19:02:33.881402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01428","last_updated":"2026-05-02T12:59:14Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T12:59:14Z","title":"Hallucinations Undermine Trust; Metacognition is a Way Forward","version":1},"cited_work":{"arxiv_id":"2605.01428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01428","snapshot_observed_at":"2026-07-03T06:07:41.049223Z","title":"Hallucinations Undermine Trust; Metacognition is a Way Forward","venue":"cs.CL","work_id":"ef0c767a-e327-478c-a71c-1e133337d5db","year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2605.01428","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:670ec52d778a63b3f81b926139ca9758cf726ec26bb5ebe8f45d5216ec0f8d7b","observation_id":"536ded1c-c08a-4e55-8639-549244faeaeb","resolution":{"observed_at":"2026-06-28T19:02:33.880648Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Metacognition and cognitive monitoring: A new area of cognitive-developmental inquiry,","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:272d854660e5de3ad63569bb2d3f885d5a424e5b267e4669302ad8849a711cd6","observation_id":"48bbdb7d-c90a-475e-b46b-b7eafbf7f55b","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:52bb981b259d597f24fb43e5b99f664355da2a61379421097fabb79175eac890","observation_id":"7b979ac2-2b79-4fb1-8aaa-4e319465e85f","resolution":{"observed_at":"2026-06-28T19:02:33.876321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Deepseek-r1 incentivizes reasoning in llms through reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:779cd3dc7590bc4c1bc055f3167a2049954b7bb8200c0c2d4ffd43844cc07da2","observation_id":"ae1f67ed-030e-4eb2-90e2-f674a127993f","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-07-06T21:33:02.686798Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:f7844c06baa8a090cb1e105ac586b7a360cf5bdaffe546bf5cadcc16f0a95e97","observation_id":"19f04b23-eba5-4293-a7d0-3b07fc25ec0c","resolution":{"observed_at":"2026-06-28T19:02:33.919996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-03T03:23:56.857266Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.16419","doi":"10.48550/arxiv.2503.16419","metadata_source":"pith","pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","venue":"cs.CL","work_id":"21afd80d-63a7-472b-800d-3b81161c39d3","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:71572dd3b2001193708a82cae9f48ef8585f79179b960861a1b33de67b9ea962","observation_id":"b45fbbee-7570-484d-9940-b4e60a599413","resolution":{"observed_at":"2026-06-28T19:02:33.917472Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.13143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:02:33.929101Z","title":"Haotian Luo, Li Shen, Haiying He, Yibo Wang, Shi- wei Liu, Wei Li, Naiqiang Tan, Xiaochun Cao, and Dacheng Tao","venue":null,"work_id":"8ede4fc8-adfc-4976-9526-a903703bdefe","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:64367eacfdb9ade0a28b61ece9c89fd5a328a30d169dcef6869608ec4c3ac703","observation_id":"46c1d457-8f31-445a-aa80-e03da166da28","resolution":{"observed_at":"2026-06-28T19:02:33.930698Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"The hallucination tax of reinforcement finetuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:c54a1c298b3cbfb747a4c34365f1a37501eb10db45ccd897d7f80b57475ecd28","observation_id":"bc404058-8563-4522-8e45-f5c31132fa01","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:edb4161bd56bd532c3f7d013bc5702c6d79f001028391edca11c9c111b632c07","observation_id":"b9164ef4-4993-4756-b43b-715dcb4ba286","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"A survey of confidence estimation and calibration in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:d949f82bd77f799228f4204766981151c61052a7ab77c599b29758fad6be9335","observation_id":"3ea8474f-eead-4af0-8688-406c3a8d4427","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"R-tuning: Instructing large language models to say ‘i don’t know’,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:b7efd168aa77a00477c85e4e34e50d6fafbab242f695eb7aaca4e0315e0c24bd","observation_id":"e54d488d-13ca-4b09-8acb-a52de0d7c7a7","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Beyond “i don’t know","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a9ce95a298722496f613f143c430c14c61a2383243af99c888e375d10b980a9d","observation_id":"bcde1d15-6972-4ab5-9dcc-adcf6d8f9fc7","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.02495","doi":"10.48550/arxiv.2504.02495","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Inference-time scaling for generalist reward modeling","venue":null,"work_id":"be1aa439-dad2-4f1c-b107-a8c1d5a94e91","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:e592a8d3d725c652be64e6f7d771d7afacf5337b7c0704c35a6753b2c3618ca6","observation_id":"76586b7a-ba5f-4e02-af6c-ef27f171fc42","resolution":{"observed_at":"2026-06-28T19:02:33.814905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Let’s verify step by step,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:b16d22c62a60a7a4988db699bac37ae8a54e1a598f5a67be8b959499e2dbbd19","observation_id":"7b1533b5-c7d5-4b7c-b113-75ec43816771","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08558","last_updated":"2026-05-24T21:56:11Z","snapshot_observed_at":"2026-08-04T10:47:54.049813Z","submitted_at":"2025-10-09T17:59:17Z","title":"Agent Learning via Early Experience","version":3},"cited_work":{"arxiv_id":"2510.08558","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.08558","snapshot_observed_at":"2026-07-04T20:00:07.735443Z","title":"arXiv preprint arXiv:2510.08558 , year=","venue":"cs.AI","work_id":"f0d69349-a2c2-4250-8431-82719c22096f","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2510.08558","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a5e414a8a3d5cb23e5d045477482f187b2435ee515d950f6264ef7f88c771500","observation_id":"6bdf2e05-4eb1-4d78-b2cd-0c719b5ca6bc","resolution":{"observed_at":"2026-06-28T19:02:33.901234Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"General agents need world models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:6e5da231d1bd98fade755ae5afbd9ce80ec72b0a2026cc09907478bf6de22d2a","observation_id":"69f4d5fa-622e-4ea7-af9d-c4a5e2a7a8fb","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02087","last_updated":"2026-05-22T00:10:04Z","snapshot_observed_at":"2026-08-01T00:37:13.679376Z","submitted_at":"2026-05-03T23:16:14Z","title":"Model Spec Midtraining: Improving How Alignment Training Generalizes","version":2},"cited_work":{"arxiv_id":"2605.02087","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.02087","snapshot_observed_at":"2026-07-10T15:37:20.480015Z","title":"Model Spec Midtraining: Improving How Alignment Training Generalizes","venue":"cs.AI","work_id":"5e46c26b-306f-423f-abae-d3b34082bdbe","year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2605.02087","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:d868984cff339ddd46950a78df000c1ec8dca9dd4d75f483a82aba00e2f22a61","observation_id":"0148317a-91c0-4eb4-af55-577250628e3e","resolution":{"observed_at":"2026-06-28T19:02:33.927866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:42d854c63d77ef15b742581d5c7d21f66461df6abf1b08b635ee78c7b78893d2","observation_id":"3bf6a049-c66c-470b-bb4d-773a5d06abf7","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Judging LLM-as-a-Judge with MT-Bench and chatbot arena,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a130a9918c875b8a9b3670015125d82fddb8a55129c4aaf63b24c0ac04b5341e","observation_id":"be427412-84bf-4b43-a144-80da635d787e","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-03T19:35:11.838629Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":"2305.17926","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-07-11T02:27:48.661096Z","title":"Large Language Models are not Fair Evaluators","venue":"cs.CL","work_id":"d04a3326-b025-498f-a8f0-3d2df254a77f","year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:0e98d3b7d0df917b796fe9fde364d19b8b9fca83164cf77c77e586e58ea66e40","observation_id":"22be0e16-e232-4b4e-ad20-8d2fe9c07c9f","resolution":{"observed_at":"2026-06-28T19:02:33.911851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15717","last_updated":"2023-05-25T05:00:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T05:00:12Z","title":"The False Promise of Imitating Proprietary LLMs","version":1},"cited_work":{"arxiv_id":"2305.15717","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15717","snapshot_observed_at":"2026-07-04T05:09:36.906364Z","title":"The False Promise of Imitating Proprietary LLMs","venue":"cs.CL","work_id":"f843d86a-7fd6-4b0d-bf8b-f1ad3fbc3f04","year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2305.15717","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:145321fdbe9ee673aa4ae5ddcf3a5091b737bd7ba66dbd81f5027cceb79f42e7","observation_id":"96c9eaa7-6613-43ec-8d14-cadead6e7799","resolution":{"observed_at":"2026-06-28T19:02:33.871338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:89f8ffaf95207c0638cfa10484458f7c03e2154e859b440e8fde3d7025afabf5","observation_id":"98974800-0815-4d80-b88f-fade31ec5c41","resolution":{"observed_at":"2026-06-28T19:02:33.873974Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-07-06T22:39:08.850289Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:686403a424a6d210fa16e80e98379cc7843198c59e7b56aa2f28dcb088b0baf8","observation_id":"d75d3a30-7166-4658-8725-27c38f14f4ce","resolution":{"observed_at":"2026-06-28T19:02:33.903560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09038","last_updated":"2025-06-10T17:57:30Z","snapshot_observed_at":"2026-07-06T21:39:56.824255Z","submitted_at":"2025-06-10T17:57:30Z","title":"AbstentionBench: Reasoning LLMs Fail on Unanswerable Questions","version":1},"cited_work":{"arxiv_id":"2506.09038","doi":"10.48550/arxiv.2506.09038","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09038","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Abstentionbench: Reasoning llms fail on unanswerable questions.arXiv preprint arXiv:2506.09038","venue":null,"work_id":"9f8c5581-0c37-41ab-8abb-1fc7627e1a7e","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2506.09038","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:aa0a2e672249ad95a9bff83e44de9dd5a3ca2d3b72db7bf2a64582664b886f1c","observation_id":"1c7dbb91-ded5-459e-b334-c1a6e338d509","resolution":{"observed_at":"2026-06-28T19:02:33.904071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Self-refine: Iterative refinement with self-feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:9376008227570ccc8962d78576e6f6721e44c29153b9c875bd3e1f724d650186","observation_id":"9a9ffb7a-3497-4017-8609-368dc776c869","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Reflexion: Language agents with verbal reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:fcc356879e109c349177efe4c8c6664446a8b4f3d41962add1e6dc022d51d89d","observation_id":"793a895a-3150-4339-b11d-08e14176726a","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16806","last_updated":"2026-05-15T00:00:51Z","snapshot_observed_at":"2026-07-06T22:01:12.359748Z","submitted_at":"2025-07-22T17:56:01Z","title":"Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty","version":2},"cited_work":{"arxiv_id":"2507.16806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.16806","snapshot_observed_at":"2026-07-10T01:16:41.377531Z","title":"InProceedings of the 2022 Con- ference on Empirical Methods in Natural Language Processing, pages 2292–2307, Abu Dhabi, United Arab Emirates","venue":"cs.LG","work_id":"f782e200-f772-4bab-b33a-02ad5e0437b7","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2507.16806","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:47dc8abf80b847c5ab9b7dfb392a7eb21113af9b68c9f45edf16780e3436f9c8","observation_id":"297b0023-3a7d-453c-bc1a-5b71026d70f3","resolution":{"observed_at":"2026-06-28T19:02:33.868887Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.02623","doi":"10.48550/arxiv.2503.02623","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"arXiv preprint arXiv:2503.02623 (2025)","venue":null,"work_id":"2dfada27-5b98-46b2-a288-443735b20e73","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:d3da693fe974f72f423e8b3bc2a42bcea3eb1ff18dec37cc11a5a469983b21e4","observation_id":"4009fc6c-eddc-4428-a058-4313f964beae","resolution":{"observed_at":"2026-06-28T19:02:33.884024Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01152","last_updated":"2026-04-13T17:08:57Z","snapshot_observed_at":"2026-07-06T22:31:24.978726Z","submitted_at":"2025-10-01T17:41:54Z","title":"MASH: Modeling Abstention via Selective Help-Seeking","version":2},"cited_work":{"arxiv_id":"2510.01152","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.01152","snapshot_observed_at":"2026-06-29T21:23:59.201517Z","title":"MASH: Modeling Abstention via Selective Help-Seeking","venue":"cs.CL","work_id":"a951971c-a838-46ec-a500-dbfa5cbda8d2","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2510.01152","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:989201d090f70c92dfaecc873dfc5cdbbfe697a738ba37f32b6dee766dfb95f6","observation_id":"f89db0cc-e6cd-423d-8f01-af7e97b9fdad","resolution":{"observed_at":"2026-06-28T19:02:33.824556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"SelectLLM: Query-aware efficient selection algorithm for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:d9f17bd1cf4c3eeca79d824fd0095c892fe99347a49965c6b8031b8d9258f2aa","observation_id":"22626431-2395-4ad5-83f5-eeca25ed775e","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12996","last_updated":"2026-06-07T11:11:47Z","snapshot_observed_at":"2026-08-02T23:42:56.058178Z","submitted_at":"2026-02-13T15:07:35Z","title":"Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models","version":2},"cited_work":{"arxiv_id":"2602.12996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12996","snapshot_observed_at":"2026-06-28T19:02:33.881898Z","title":"arXiv preprint arXiv:2602.12996 , year=","venue":"cs.CL","work_id":"4da2f129-0b8a-4393-9038-a98fb6127a02","year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2602.12996","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a732fd97a8a755130eb51eb5441a6adcece8e1df3f9cb8ffdf63593aa05f27de","observation_id":"7bb3cf00-a191-4d71-8362-43f8533d3dd1","resolution":{"observed_at":"2026-06-28T19:02:33.883180Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":"2503.18892","doi":"10.48550/arxiv.2503.18892","metadata_source":"pith","pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","venue":"cs.LG","work_id":"94a68437-02e7-425a-91b2-5846ddcbd38c","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:85efd9a94b3232d7a2fbd1869c1ceb9ef35b8456e42bd1018ca17e51a121185d","observation_id":"99a67573-e027-4352-bcb5-01aeddfabfc4","resolution":{"observed_at":"2026-06-28T19:02:33.906505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-07-11T03:07:50.815080Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:fefaa1d132823791bc491aaf85de95037d85721d2faeced3ed10a871605878f8","observation_id":"88e877e0-dd6b-4dbf-b637-782b6253c19a","resolution":{"observed_at":"2026-06-28T19:02:33.841748Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-07-10T16:57:24.565388Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:6a4c0df66dc33cbb0022bce8c2c7da0212e19f4b9f9cf6b0c0ef8b24ff255117","observation_id":"d8670fb6-0709-4e4b-87e2-16f1c366d255","resolution":{"observed_at":"2026-06-28T19:02:33.889375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":"2402.14008","doi":"10.48550/arxiv.2402.14008","metadata_source":"pith","pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","venue":"cs.CL","work_id":"19abed3b-0ff6-409b-aded-a50205319aa3","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:8dbfcbe7cc4e3b381919cc0cc804a7980b642c9efbdd3cabe6d588214f6c75b9","observation_id":"ed3a809b-6e16-4dfe-9c23-b6b936641b66","resolution":{"observed_at":"2026-06-28T19:02:33.889808Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Solving quantitative reasoning problems with language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:e9ebce0d0536b0c12f1db30f056aff871e5d9081924d4d279de744e27d49ea6f","observation_id":"c34744f3-830a-4218-91fc-9156b47103ee","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"AIMO validation AMC: Problems from AMC 12 2022–2023","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:01ca12b97a57555440fc92621a8fb104c0da753975a41d5d5d2bbd3131eac805","observation_id":"ef3ecce6-8f6c-48e3-8a58-21d2d154cbff","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"AIMO validation AIME: Problems from AIME 2022–2024","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:d66835dc1f0f370f2f401292c0ed53a2decc0b003aa63a90d7436f47b8550497","observation_id":"b5ceee4f-0029-4968-9fd1-85633bfcbb75","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:cfaa592c96da605acb571c8a1a7c43e1eb8686e66691d34f5e8c781e3d6d0f05","observation_id":"96b2c637-b915-4de9-9ba4-30cf970d492c","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Hybridflow: A flexible and efficient rlhf framework,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:af52b189f4da3550a6f7893c019da636f66f3d174b0abab309d8aff2b59ebda6","observation_id":"2dd81aa2-bd44-4698-ac8e-88695aac5ab3","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Efficient memory management for large language model serving with PagedAttention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:5284e97b1e36014eb2dc7663f68b6d31d6a5d5d136f74221ba8993da3dc60796","observation_id":"d7c0216d-0df6-49d0-af4a-e7b23f66b916","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08500","last_updated":"2025-06-15T11:20:19Z","snapshot_observed_at":"2026-07-06T21:39:32.912866Z","submitted_at":"2025-06-10T06:52:57Z","title":"DRAGged into Conflicts: Detecting and Addressing Conflicting Sources in Search-Augmented LLMs","version":2},"cited_work":{"arxiv_id":"2506.08500","doi":"10.48550/arxiv.2506.08500","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08500","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"DRAGged into conflicts: Detecting and addressing conflicting sources in search- augmented LLMs","venue":null,"work_id":"edff3353-d741-4f5a-a98a-8f2b6e10ec30","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2506.08500","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:9bf82338222836cb78d51fdb18301267cdd886d590f1c38a887591508ff2f230","observation_id":"8eaa26c5-9c30-425c-b68c-50887251c3cf","resolution":{"observed_at":"2026-06-28T19:02:33.909346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:33:45.146128Z","title":"Justrl: Scaling a 1.5 b llm with a simple rl recipe","venue":null,"work_id":"fae7d2ce-42fc-469f-9b46-42b5103f2013","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:dfc77106050262064fd4f1341a2831824b27e5893b5267b96c3e9d5d1fd29617","observation_id":"27c8c8b0-526f-4e3c-a001-10c8cf58049e","resolution":{"observed_at":"2026-06-28T19:02:33.936053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Ur2: Unify rag and reasoning through reinforcement learning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a727377e2cdf894c6c1ed68e9bd3312544951ff05079a3a6910d9d9cf4fd9014","observation_id":"8bdf3b5b-6178-47ba-a4a9-9eef55a067c6","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"OpenMathReasoning: A large-scale dataset for mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:cded7adae91cbee0adde9e93b4ad863aa70f61ec12e930eb1551fe014d596c2c","observation_id":"30aa5c0e-6835-40d4-adb9-0b46876d988e","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Deepscaler: Surpassing o1-preview with a 1.5b model by scaling rl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:643b8fb6b0591eeba7b046643f069a5d42fb37d918188c8af83ced8bce4f2858","observation_id":"de9bac03-2f72-459d-87e5-4b5db66b4fba","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"ALCUNA: Large language models meet new knowledge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:ec5f3cc72f418ce4600b92620ba8cd42539c819e672fce9017277d526982f375","observation_id":"8754b689-100b-48a9-b502-a305724c3190","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"BBQ: A hand-built bias benchmark for question answering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:6e82a9c40a593f05634de70f68e48aa9de6449b9f05e77b8df2570f04e6286cc","observation_id":"2596288f-d4fb-4d71-9fd0-1e21afa726fe","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:9178fbf12df3f6e49b2e8418f688512248b6a6e383cb2b6b8b8156b0f419395b","observation_id":"510c8ede-dcf2-4fb3-93e5-06e22cbfafca","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12043","last_updated":"2024-11-22T17:48:57Z","snapshot_observed_at":"2026-07-06T18:47:25.751118Z","submitted_at":"2024-07-02T07:12:51Z","title":"The Art of Saying No: Contextual Noncompliance in Language Models","version":2},"cited_work":{"arxiv_id":"2407.12043","doi":"10.48550/arxiv.2407.12043","metadata_source":"pith","pith_arxiv_id":"2407.12043","snapshot_observed_at":"2026-07-10T15:37:20.477680Z","title":"The art of saying no: Contex- tual noncompliance in language models","venue":"cs.CL","work_id":"fb17e5aa-5a94-41a8-bfde-cea56437a988","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2407.12043","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:317fc3431764846b2670e9cda2f36b9330e639c8ae7dde3fc43f4e38a3b4d231","observation_id":"b242b36f-a163-4102-8952-ff737cb88192","resolution":{"observed_at":"2026-06-28T19:02:33.914764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Won’t get fooled again: Answering questions with false premises,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:ed3c42ea99eaf080fa42e774ad39b54a7d6be8d0016e303bf6e8b2cfe7197fdc","observation_id":"17ff83c3-bbb6-40a6-9d5f-f4457095cf0e","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-02T23:46:38.854124Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":"2311.12022","doi":"10.48550/arxiv.2311.12022","metadata_source":"pith","pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-07-10T14:47:14.590391Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","venue":"cs.AI","work_id":"9e2a976b-f5ad-4aee-af5c-243fe0fe75d2","year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:c976ed7f9bb24c059dcdc2d7f9e5c0f63b29a0c10deaebe12967b3292c7c704d","observation_id":"af7f8dda-8e5e-49b8-ab79-01530d7e72f7","resolution":{"observed_at":"2026-06-28T19:02:33.886938Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:76f14120dd630499846f13b8a9156c06d7f15b97e23a1ebe9025aff1705ea36b","observation_id":"390869fe-e783-4c9e-b84d-b8175df683cc","resolution":{"observed_at":"2026-06-28T19:02:33.894758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Knowledge of knowledge: Exploring known- unknowns uncertainty with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:56b37c3b797a75f4da3351b235b75a1e8f98a3884a1b9eb0f88c5d23345a9478","observation_id":"cc734824-a6f8-48ef-9c07-921805a7f29b","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"MediQ: Question- asking LLMs and a benchmark for reliable interactive clinical reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:c094a560f7cc696e90117ee2f86c22a4a3198f4cc555b4e8e5c7406abe763514","observation_id":"e2918d1a-655d-443e-be30-0de0d1c28bf9","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-07-11T01:37:42.666395Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:15dd98f302b22008bb21a62e077885c2abc3518d1a2bb7ac160a0bdf64599f65","observation_id":"1f6f3b94-b327-4c5b-8412-19444b39f0f2","resolution":{"observed_at":"2026-06-28T19:02:33.925386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Evaluating the moral beliefs encoded in LLMs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:05efcec673b87ab104b679f376cd72c859b9fc29382e76d54bbbf145f4d4e97a","observation_id":"05c61c68-1a22-45b7-ac26-9509b07f215d","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"MuSiQue: Multihop questions via single-hop question composition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:98a4382dbb565cac194509f4b2f5468d702288515a1b64d701a52555a00d5239","observation_id":"2f0d2a6b-01c7-424c-8bb2-cbfa76c76257","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"(QA)2: Question answering with questionable assumptions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:770197d272c25fcb2891d857685b82126217549b6fed86a27090e165f29eeb09","observation_id":"c4b97692-3725-4f11-adea-1ede892a549b","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"A dataset of information-seeking questions and answers anchored in research papers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:c3e06e6f253cd336762e46c241a4e175fb4d96459cc7285b850973d809ece4bb","observation_id":"b15a0044-e5cf-4b89-9065-12387670db2d","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"SituatedQA: Incorporating extra-linguistic contexts into QA,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:ba81a86b215d385b20c9545c1824e5d8bca07163cae00280aba2692fb5b76744","observation_id":"ff3f6037-ebbd-4de5-bb89-69c38c2c9f0c","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Know what you don’t know: Unanswerable questions for SQuAD,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:f0a9f3829e7eff562520592fc72e81fe4612f1d636013b3b8c3dcea99f1abb16","observation_id":"020ab70b-345c-4e92-b2d2-d44c20e7eb48","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03558","last_updated":"2024-03-06T09:06:34Z","snapshot_observed_at":"2026-07-06T17:40:20.922598Z","submitted_at":"2024-03-06T09:06:34Z","title":"Benchmarking Hallucination in Large Language Models based on Unanswerable Math Word Problem","version":1},"cited_work":{"arxiv_id":"2403.03558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.03558","snapshot_observed_at":"2026-07-01T10:35:42.145281Z","title":"Benchmarking hallucination in large language models based on unanswerable math word problem,","venue":null,"work_id":"34c717f1-cc93-4685-a1a5-f7c9cf12dae9","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2403.03558","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:a0a256edc9a473a91dbfa1b5527bd93a346fe2e975122e4e8b7658da2cc00d87","observation_id":"9aca73f5-75ae-4ec9-b117-543e1dce8d0d","resolution":{"observed_at":"2026-06-28T19:02:33.895497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15930","last_updated":"2023-11-27T15:38:17Z","snapshot_observed_at":"2026-07-06T16:53:10.021630Z","submitted_at":"2023-11-27T15:38:17Z","title":"WorldSense: A Synthetic Benchmark for Grounded Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.15930","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.15930","snapshot_observed_at":"2026-06-30T09:54:34.363302Z","title":"Worldsense: A synthetic benchmark for grounded reasoning in large language models.arXiv preprint arXiv:2311.15930, 2023","venue":null,"work_id":"3d2fcff3-347f-4064-9e25-ef3d071ff9be","year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2311.15930","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:fadd9aff56e00f9c73cab305df0c0a8cfd5b41f56ec9bfa0476d447855f91674","observation_id":"87a0a974-f900-43b5-b4e8-7a7afb72d8e2","resolution":{"observed_at":"2026-06-28T19:02:33.886009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"A coefficient of agreement for nominal scales,","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:4bba092d8484aee3e8c39ce96949c4e3472e8d5e008e6e2de0d8993a16ee1052","observation_id":"abf0102e-ac5e-4a66-b00b-73e2c003fadc","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"The measurement of observer agreement for categorical data,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:1703bbd6d3c41f17594fce2cd4a2d325b164e3ac5262a77711289ee4f666f5dc","observation_id":"fc117fe0-dd0b-499f-9a82-f756c76c995a","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Measuring nominal scale agreement among many raters,","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:013f02353885a78e096ac4dea3609cbed5be4d3bac3f906e8932554db642d2e5","observation_id":"73959039-848e-4cdc-99ba-858d46b7a98a","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01624","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:38:55.653242Z","title":"Quagmires in sft-rl post-training: When high sft scores mislead and what to use instead","venue":null,"work_id":"5ed12f4c-6449-4502-b766-516066517e99","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:ea3b9d6453daec5b609d7cf19a5719a829e046868d719ef9612c00f1468252db","observation_id":"05335121-b50c-4b1a-924d-b1738993691e","resolution":{"observed_at":"2026-06-28T19:02:33.832707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06948","last_updated":"2026-05-30T09:01:09Z","snapshot_observed_at":"2026-07-06T22:26:03.668339Z","submitted_at":"2025-09-08T17:58:02Z","title":"Beyond Two-Stage Training: Cooperative SFT and RL for LLM Reasoning","version":3},"cited_work":{"arxiv_id":"2509.06948","doi":"10.48550/arxiv.2509.06948","metadata_source":"pith","pith_arxiv_id":"2509.06948","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Beyond two-stage training: Cooperative sft and rl for llm reasoning","venue":"cs.CL","work_id":"c187c8ff-10ae-4b69-9b4d-8a04c661f929","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2509.06948","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:5e39fabd9723b59514a2d68e28b912d22e23a6d0d8a839a2a3b795af5748142b","observation_id":"f2d39fa9-1d82-46a6-a59a-91ebb8415b88","resolution":{"observed_at":"2026-06-28T19:02:33.906107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22617","last_updated":"2025-05-28T17:38:45Z","snapshot_observed_at":"2026-07-06T21:32:23.537939Z","submitted_at":"2025-05-28T17:38:45Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":"2505.22617","doi":"10.48550/arxiv.2505.22617","metadata_source":"pith","pith_arxiv_id":"2505.22617","snapshot_observed_at":"2026-07-10T21:57:38.198014Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","venue":"cs.LG","work_id":"d4b4aee4-d20f-4572-886a-4ba9ea6c9b81","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2505.22617","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:c33397d5da2eea7c2034eb7231e9fb52edd4c7212ddfcecc5c9d705f89928b07","observation_id":"42dd68ee-d222-4ae8-a4eb-d2e076113b97","resolution":{"observed_at":"2026-06-28T19:02:33.878927Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12854","last_updated":"2025-07-28T17:46:50Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T06:28:25Z","title":"Enhancing LLM Reasoning with Iterative DPO: A Comprehensive Empirical Investigation","version":3},"cited_work":{"arxiv_id":"2503.12854","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12854","snapshot_observed_at":"2026-06-28T19:02:33.817155Z","title":"Enhancing llm reasoning with iterative dpo: A comprehensive empirical investigation","venue":null,"work_id":"ea5b95ba-1ed2-4602-910d-5bbbda341aab","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2503.12854","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:4215219d2d902eda875982d117463b1c55a4d7eafcc6ae5e2a0e3ea794ea40b9","observation_id":"a6ce62f4-2f0c-435d-9727-edc4d7977589","resolution":{"observed_at":"2026-06-28T19:02:33.820741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":"2406.18629","doi":"10.48550/arxiv.2406.18629","metadata_source":"pith","pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","venue":"cs.LG","work_id":"c36a9ddb-5e98-40df-a3c4-ec831be19023","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:3376088af56052acedb4527094d59455a507a30bb36245c913d58284e841bbc7","observation_id":"d0349acd-d333-4845-8385-e9e4ec6bbcf1","resolution":{"observed_at":"2026-06-28T19:02:33.922491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":"2411.15124","doi":"10.48550/arxiv.2411.15124","metadata_source":"pith","pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","venue":"cs.CL","work_id":"28c9dbea-056a-48c2-8000-85f809827e45","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:25ec7cf0c4d058b1e7a8af24169b71e942354ae77b608d1324b71b3a3b480e8d","observation_id":"f52aa683-347a-41b1-b4a1-96e1d3268983","resolution":{"observed_at":"2026-06-28T19:02:33.933275Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":"2406.20094","doi":"10.48550/arxiv.2406.20094","metadata_source":"pith","pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-07-11T02:27:47.622390Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","venue":"cs.CL","work_id":"4acdd1d7-4a74-460c-a32c-01c386a5c58a","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:62524cfcd1500a867e08e7e4588aa05769e27ec8d0add56c3a29caed5bf9e0d0","observation_id":"9bd659e4-fe25-4360-b389-5b52ea14fdef","resolution":{"observed_at":"2026-06-28T19:02:33.900775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:58.855418+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:58.855418+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"The flan collection: Designing data and methods for effective instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:d19f6857f99bacc3fc9a52c46e5cffcfe7f994ed7c8b119c30937d2c292994d4","observation_id":"bef76b20-5982-4376-bab4-4beffeef4bfb","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"No robots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:10993d17619a412633ba9f5ad0e4c89e302dabb65ee3f0bfd9267c515f9d9062","observation_id":"b13a5645-3881-4eef-b975-4b12e6774f7e","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Openassistant conversations-democratizing large language model alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:57d96e78a0a439a174e74af15ad7e5425562c37c6ffd2a356f79405c0f083a97","observation_id":"f8b8d6ec-418d-442c-8b39-433afeead9dc","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Aya dataset: An open-access collection for multilingual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:f8e3b9eb78549fc5b5f5a7661ccf36575b15de1528b5cd14b0e68b64f7e8a8f0","observation_id":"b3887d8e-8486-4f29-8db4-743526df9e16","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08674","last_updated":"2023-08-07T12:08:17Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-17T17:36:09Z","title":"TableGPT: Towards Unifying Tables, Nature Language and Commands into One GPT","version":3},"cited_work":{"arxiv_id":"2307.08674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08674","snapshot_observed_at":"2026-07-03T20:18:57.788198Z","title":"Tablegpt: Towards unifying tables, nature language and commands into one gpt","venue":null,"work_id":"b26eb585-6cfd-49cc-a346-60659ec9bf4a","year":2023},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2307.08674","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:f3a66049381ab9dccc728b92ed0ec3f7e342307a33c4ac816803aae1f86621c8","observation_id":"65a97c2b-5886-440c-9cd5-8062bf0075e1","resolution":{"observed_at":"2026-06-28T19:02:33.892949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01470","last_updated":"2024-05-02T17:00:02Z","snapshot_observed_at":"2026-07-06T18:08:56.480769Z","submitted_at":"2024-05-02T17:00:02Z","title":"WildChat: 1M ChatGPT Interaction Logs in the Wild","version":1},"cited_work":{"arxiv_id":"2405.01470","doi":"10.48550/arxiv.2405.01470","metadata_source":"pith","pith_arxiv_id":"2405.01470","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"WildChat: 1M ChatGPT Interaction Logs in the Wild","venue":"cs.CL","work_id":"799d0d7b-7d66-40bb-b17f-205e5d2f3e13","year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2405.01470","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:abb12673df9e0d1954b2f06046ae5e1085da39fe44d2763c83f31c50f52b8a94","observation_id":"10f6f86e-b98a-4838-9fcc-e75f0f78d3f3","resolution":{"observed_at":"2026-06-28T19:02:33.875220Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Wizardcoder: Empower- ing code large language models with evol-instruct,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:3a04b8bac9ba94abfa55f6fc7e4101f81ee736f102562497fd1fc17849f547ab","observation_id":"ec15ae00-cfa5-4f1a-a14a-e9bf671ad825","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:ed1440dfcbbaa94bfca6c5dcbce4895ba73c24e26759e9a5d83378521789dc6e","observation_id":"dcbf4f63-cb42-4545-9a92-c9d2cde371c6","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Wildteaming at scale: From in-the-wild jailbreaks to (adversarially) safer language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:f01ba613c8ea46abaae945720d65532c64536e35cf508f5700e80d12669b6a42","observation_id":"841cab1c-4f80-4c4e-8ac5-8a21afe1e32c","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"Sciriff: A resource to enhance language model instruction-following over scientific literature,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:2b8d3cee41c3e662ae1092bc48aff41cdacbd7eb888059d67a8911b27ee11d5b","observation_id":"11a2b820-3a99-4a15-85ca-7566c57a6205","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:c6795926737a5e9ffabfe6bbdba28d16a000c28b5a5899a907757366bb5a8dac","observation_id":"5a889d61-35bc-4534-94a6-cd68941ec8b0","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:2c43702c979f5ae0d67afd736742031265c40d68f4ba3f4df79b781a63092051","observation_id":"550ad1d4-ac42-4ac7-8583-59784a9471c9","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"I don’t know","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:e12cf23ccdced184d9ae52fd15e0a84812a3bbb298152262feed7437cdb35ed3","observation_id":"9c923e4e-db04-4b16-9032-a24d3db713bf","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"For base checkpoints, the dataset loader extracts the raw prompt text from the stored chat-style field and tokenizes it directly, instead of applying a chat template","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:5207849037092ffdd23c35db734b9842565d795cd407f43b6b2e167d23f61035","observation_id":"7df0871e-ed7c-4dce-bdd4-6b37b4390253","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:01:18.153145Z","title":"For each promptx, the policy samples a group ofGresponses{y i}G i=1 from vLLM [52]; in the main Math-RL scriptG= 16, temperature is 0.9, andtop-p=0.95","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:38e67e67e38cc6fad2c1c5ce3d68b641aead81e9235416aa162fe5cda3b4eff2","observation_id":"8f1a6f02-4963-4586-8152-bfcfc5519889","resolution":{"observed_at":"2026-06-28T19:01:18.153145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T18:48:30.860504Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":55,"verified_exact":39,"verified_fuzzy":0},"total_outbound_references":143},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 143 outbound references and 0 inbound Pith citation observations for arXiv:2606.00869."}