{"as_of":"2026-08-07T08:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3be1ac3ceb2f1698b489fa6a85e427d5336e822ed267d746be1f9625fe1bef5f","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:35:32.587153Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.03396/citation-record","integrity":"/paper/2508.03396/integrity","json":"/paper/2508.03396/citation-record.json","paper":"/paper/2508.03396"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:36.121933Z","title":"S.; Kazi, S.; Sourabh, V.; et al","venue":null,"work_id":"8309cec8-1c0b-4004-8bbc-f81c4c7c0413","year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.014179Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:7a0fba297095c8337615345c8752ed7a12ea3976e14311211925727f14f9cad5","observation_id":"6efec82b-67aa-4172-a0d4-c65cb0d0d945","resolution":{"observed_at":"2026-08-06T04:35:36.239512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:35.972691Z","title":null,"venue":null,"work_id":"3338315e-0c6e-4ba2-98d2-48b9bb50cdd9","year":2023},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.028774Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:ce6d83a6deb2b16d75bcac615d5c73dccecff42beba42118de192fa84dad2266","observation_id":"53e67fae-f0c7-4a85-9e3f-8cb8ddf42f6b","resolution":{"observed_at":"2026-08-06T04:35:36.031185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:35.815435Z","title":null,"venue":null,"work_id":"d3550417-0069-4626-8384-e8295d53ed2e","year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.042241Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:2b6ad1f504344017399043667e3ad31284cccff106ae35620dd97d362a6d8d73","observation_id":"f732523d-7f1e-43f9-9c1b-b92c835bcf0a","resolution":{"observed_at":"2026-08-06T04:35:35.903118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T04:35:31.057805Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.057805Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:e29e993e2232424811a222de97d5d5d36cd485e4bfa8d36ad357ab17ff184141","observation_id":"56a9be93-3491-44ef-ba28-da5c3a95d859","resolution":{"observed_at":"2026-08-06T04:35:31.057805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19766","last_updated":"2025-07-26T03:42:33Z","snapshot_observed_at":"2026-08-06T14:07:10.172157Z","submitted_at":"2025-07-26T03:42:33Z","title":"UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19766","snapshot_observed_at":"2026-08-06T04:35:31.077918Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.077918Z"},"links":{"cited_paper":"/paper/2507.19766","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:e8985929b1d2b82dc7da0ca29a4363ddede565fa773633bd3a7daa157d1cfd83","observation_id":"dfd12a22-b3f9-4d70-9b11-dfb5301856d3","resolution":{"observed_at":"2026-08-06T04:35:31.077918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:35.647650Z","title":null,"venue":null,"work_id":"7acc2fda-3ef3-4843-a5a3-62ee05aab616","year":2023},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.091051Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:e935d9781b2f8f1d704dcaab7c0a55e75b03b4fa0b18dfe7d2acb76e32720870","observation_id":"25dbc973-0abc-41cc-a0ef-2b700ecb86aa","resolution":{"observed_at":"2026-08-06T04:35:35.731083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:35.490181Z","title":null,"venue":null,"work_id":"85b8ecaa-006e-462a-b596-41894973da6a","year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.104790Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:2d17dbbec8c1c0b2800a2236ed58fa90dd4427fd8c06b14ce3fe191bd34251a7","observation_id":"8a565c9e-096e-401a-9847-6e190f6c7802","resolution":{"observed_at":"2026-08-06T04:35:35.560043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:35.279238Z","title":"L.; Liu, Y.; Shang, N.; Sun, Y.; Zhu, Y.; Yang, F.; and Yang, M","venue":null,"work_id":"fad8bfd2-fc10-4f3f-90c3-cbc0781d316e","year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.119363Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:a43ac2b674792870451c3d41e9df1b1bfbb0ff89574279d9339878d77f24e1f9","observation_id":"7ec34be1-9257-49ef-9de5-b01380e0090b","resolution":{"observed_at":"2026-08-06T04:35:35.370968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:34.978448Z","title":null,"venue":null,"work_id":"55a5d833-4c72-440f-b48f-09aaf664d7cc","year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.134048Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:db632e6c61ff07566deca8561463962ab69fd6c5427b1399c18a346d9ca7a47e","observation_id":"3c1e1432-07d5-4af5-82dd-b8b1470b9a3d","resolution":{"observed_at":"2026-08-06T04:35:35.157693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T04:35:31.149105Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.149105Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:c906ea384e946f6f2b4e8a5082fe5a1dc604371426a6e9e6bfac3379b3672061","observation_id":"9b9db833-d11d-4a2f-850c-9221e873f626","resolution":{"observed_at":"2026-08-06T04:35:31.149105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:34.727802Z","title":"S.; Yu, A.; Song, X.; and Zhou, D","venue":null,"work_id":"c519dc40-7146-4c5e-80d4-d2ff30cd0cb0","year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.164078Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:ecc4f78283c0bcd5d8e2386fb94ab944e84c2ed92263a55291cb43af5cf76d90","observation_id":"de8a7881-3eec-4a4d-8712-61e6474933e2","resolution":{"observed_at":"2026-08-06T04:35:34.828222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-07-06T18:48:37.723242Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-06T04:35:31.176661Z","title":"H.; Chen, Y.; Edwards, H.; Leike, J.; McAleese, N.; and Burda, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.176661Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:d50ba12d73cbc6cfe280bb5890824a326b4c7d885310d64bf07774d288314488","observation_id":"915c15dc-8988-4842-9e87-dd6f040bed42","resolution":{"observed_at":"2026-08-06T04:35:31.176661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:34.455045Z","title":"Q.; Shen, Z.; et al","venue":null,"work_id":"782ecb8b-1ede-4dd9-83a6-16a74234c7d2","year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.191255Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:26fcfe2cd149711ffcd12e2f3bbd2296c63cc338935fcb9f7a91b1cb23dd4a96","observation_id":"ee58e9c9-b9d9-4112-8a18-fd3b5edd409b","resolution":{"observed_at":"2026-08-06T04:35:34.577326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19058","last_updated":"2026-08-05T12:36:09Z","snapshot_observed_at":"2026-08-07T07:58:09.631076Z","submitted_at":"2025-02-26T11:17:50Z","title":"MathDebugger: Detecting and Diagnosing Errors in Synthetic Mathematical Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19058","snapshot_observed_at":"2026-08-06T04:35:31.214664Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.214664Z"},"links":{"cited_paper":"/paper/2502.19058","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:0952e23af1390adeb0cf7dd84e081b4ba7487aa4ef4a6227f93396da2c12ee6c","observation_id":"3e0f0473-5d9b-454c-8cd9-d5542d5d5485","resolution":{"observed_at":"2026-08-06T04:35:31.214664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:34.134638Z","title":null,"venue":null,"work_id":"6e38e12b-002b-4cb5-aa36-6401665cf8d6","year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.232841Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:7c880f259bcdd1d0fa73346fa76f4546ccfd5d69b99f4baee5be8b7a0a36d65a","observation_id":"8f0452db-b52a-4391-ae76-d4125b656030","resolution":{"observed_at":"2026-08-06T04:35:34.296698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01352","last_updated":"2026-03-02T20:56:17Z","snapshot_observed_at":"2026-08-04T07:18:25.941807Z","submitted_at":"2025-07-02T04:40:29Z","title":"Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01352","snapshot_observed_at":"2026-08-06T04:35:31.254766Z","title":"Y.; Zeng, L.; Xiao, Y.; He, J.; Liu, J.; Wang, C.; Yan, R.; Shen, W.; Zhang, F.; Xu, J.; et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.254766Z"},"links":{"cited_paper":"/paper/2507.01352","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:e97a2405f7535ce522e7142f40783d54f401a214708c5c756b459c2d0a5cad84","observation_id":"17b8ece2-d40e-4eeb-b0d3-f335fa4b077d","resolution":{"observed_at":"2026-08-06T04:35:31.254766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:33.881004Z","title":null,"venue":null,"work_id":"4363d5ff-3003-4669-8fd8-2999fb0796d7","year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.345470Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:32d6804272af3a0a60fd1109cc00c82b357acb2820e8b861427219b739e3660c","observation_id":"2c50cb34-9d42-4ce3-9899-47a61997746e","resolution":{"observed_at":"2026-08-06T04:35:33.972176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:33.736069Z","title":null,"venue":null,"work_id":"5a35d558-4530-497b-8ea7-f6c7d52cbfda","year":2022},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.453897Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:39d9f75969f51daabb8e3a1b3784877b500213f7aec975a15327ead42e60eefa","observation_id":"fb554cd4-817e-49dd-b1a0-a525861ecc07","resolution":{"observed_at":"2026-08-06T04:35:33.795569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:33.550446Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":"0daa2a0b-4a81-4c28-b70c-e9bf9256e9c5","year":2023},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.523214Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:7dfbfe53fe03efa99b338170808cbd5362168609342ff4effac966d3b7275a92","observation_id":"c26cf467-c98f-434c-9c75-0eb38ec3faf9","resolution":{"observed_at":"2026-08-06T04:35:33.633698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T04:35:31.595403Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.595403Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:be2a108b86263303124caa72092e2be097bff4099fffc8a40c4dca39eedf6162","observation_id":"1800bddd-1402-434d-a15b-9317b518e41e","resolution":{"observed_at":"2026-08-06T04:35:31.595403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06374","last_updated":"2018-10-27T09:10:37Z","snapshot_observed_at":"2026-07-06T05:56:07.592346Z","submitted_at":"2017-08-21T18:22:19Z","title":"On a Formal Model of Safe and Scalable Self-driving Cars","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06374","snapshot_observed_at":"2026-08-06T04:35:31.690384Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.690384Z"},"links":{"cited_paper":"/paper/1708.06374","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:ff46d67ec507e52836c51e44f05afc0ea60e7a3297ed4562ea558d71b19aa6d1","observation_id":"c1dd8568-a275-4aa0-8d9b-9ba935fc77f1","resolution":{"observed_at":"2026-08-06T04:35:31.690384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T04:35:31.762696Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.762696Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:ad404d3bcb57dbff718658f7826f1ac4dae8f9d2e9e4ce10c8211a03d6cc06ce","observation_id":"8409a533-71ac-4edd-bc3d-3e125a4e41ea","resolution":{"observed_at":"2026-08-06T04:35:31.762696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:33.398710Z","title":"P.; and Mak, T","venue":null,"work_id":"cbd36144-0eaf-4e3b-b7f7-02b296db3b02","year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.863051Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:7eaa6feb6232730ae9f3491d2753b6267f4f57cafd6025d095f40a1fae388579","observation_id":"070a0122-2a06-4a99-909a-3472a0bd88f3","resolution":{"observed_at":"2026-08-06T04:35:33.464339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:33.260992Z","title":null,"venue":null,"work_id":"103615d3-87fa-4b6d-9d65-ec2ce0e80127","year":2023},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.977617Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:6e891d825a4f5b9714a11cc3e82c890bad03d83c9ed5a7cf616b97722dd7daea","observation_id":"30ce62c6-35bb-45b8-ae91-7e12a979ceed","resolution":{"observed_at":"2026-08-06T04:35:33.323862Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18105","last_updated":"2024-04-01T18:47:45Z","snapshot_observed_at":"2026-08-05T22:34:48.476134Z","submitted_at":"2024-03-26T21:04:29Z","title":"Large Language Models for Education: A Survey and Outlook","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18105","snapshot_observed_at":"2026-08-06T04:35:32.045533Z","title":"S.; and Wen, Q","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.045533Z"},"links":{"cited_paper":"/paper/2403.18105","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:fda3931affc9b73839305c8c47fb000a84ca788a9cdb2a36dba08f17cdebfd89","observation_id":"3413d6a4-733c-4b9c-a08e-e35f5047d21c","resolution":{"observed_at":"2026-08-06T04:35:32.045533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:33.094153Z","title":"V.; Zhou, D.; et al","venue":null,"work_id":"c2587c79-002c-4151-be7e-306ba0e7daf4","year":2022},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.119965Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:a6bd7e2e447c123ecb82b6fb44feb991d5a22eb0256c1d38df0ef92e0d57f5e2","observation_id":"883de42d-e437-4fd9-b43f-1b2727c879b5","resolution":{"observed_at":"2026-08-06T04:35:33.181720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06302","last_updated":"2024-07-03T00:51:21Z","snapshot_observed_at":"2026-08-04T06:08:32.233717Z","submitted_at":"2024-06-10T14:18:56Z","title":"Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06302","snapshot_observed_at":"2026-08-06T04:35:32.226777Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.226777Z"},"links":{"cited_paper":"/paper/2406.06302","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:3deb2dd4da344a279452161633b7084876ecb4cb71b6e704df5178eb9f924722","observation_id":"05b28a88-1c5d-4b92-8407-93b2008ea8d3","resolution":{"observed_at":"2026-08-06T04:35:32.226777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-06T04:35:32.297735Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.297735Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:b94601eafcda5238586dadb2ee870259dbfb70f11d40f52ee73a5d741e65448c","observation_id":"b29c6c51-9e65-48f3-8de4-4a48c5ab1f92","resolution":{"observed_at":"2026-08-06T04:35:32.297735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04307","last_updated":"2024-09-15T05:37:56Z","snapshot_observed_at":"2026-07-06T17:40:54.163034Z","submitted_at":"2024-03-07T08:25:46Z","title":"HaluEval-Wild: Evaluating Hallucinations of Language Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04307","snapshot_observed_at":"2026-08-06T04:35:32.417153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.417153Z"},"links":{"cited_paper":"/paper/2403.04307","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:9bc95d79dae60bdc514cf13087ceddd1322ce7bd2f7311bc45e3a312b3ea7340","observation_id":"c57377c5-daf4-4b04-b091-0e812290174e","resolution":{"observed_at":"2026-08-06T04:35:32.417153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:32.488758Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.488758Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:3363d29a71eac3b0f631583a4e8191a2587ff11708dd536ecba1e1430428c055","observation_id":"71eeedfb-b77b-43d5-8d65-75837760cc9d","resolution":{"observed_at":"2026-08-06T04:35:32.488758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:35:32.587153Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:32.587153Z"},"links":{"citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:532229ec0ef68f128c5394ebd03b0e774b7076488ba047a3b85039db5b535036","observation_id":"80bbb304-1516-4d8e-8fd1-0370ae92a777","resolution":{"observed_at":"2026-08-06T04:35:32.587153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T04:35:29.833839Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2508.03396."}