{"as_of":"2026-08-16T13:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d2e00d3de2f963d3bf61a4f6667ece074cba0814f83b02e685fd2750cd36679c","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:53:24.144910Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19996/citation-record","integrity":"/paper/2508.19996/integrity","json":"/paper/2508.19996/citation-record.json","paper":"/paper/2508.19996"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:22.635823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.635823Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:dad66c3df0f1b3b4388ebb3ff703c7844d1b14a52644bd60d1cd3330b1731b54","observation_id":"f10647c8-ed85-49b9-822d-9cef21ffa8da","resolution":{"observed_at":"2026-08-15T16:53:22.635823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T16:53:22.710545Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.710545Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:d46ff06dcd1749136c886714c0100eee78713371cc72275ec55dbd07f5da7f17","observation_id":"03ae6404-01e4-4cdc-bf28-fa0999ac3161","resolution":{"observed_at":"2026-08-15T16:53:22.710545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.539326Z","title":null,"venue":null,"work_id":"36433581-e4a9-492e-a431-c5996fe14532","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.765824Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:58e3b700ce07784ffb4765758d26e2676e4701feb51a988625467be2fe52393a","observation_id":"82fbd01b-e317-41a7-8819-83582f239710","resolution":{"observed_at":"2026-08-15T16:53:25.578274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-15T01:55:26.051681Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-15T16:53:22.770073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.770073Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:cbe606959605912854cfc5579aff79c17570e963ffa059dda480dddd87963702","observation_id":"dfcd6ad6-1880-4786-868f-4f7737c631c8","resolution":{"observed_at":"2026-08-15T16:53:22.770073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-13T10:54:00.274565Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-15T16:53:22.774472Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.774472Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:43189e4f76e88ed688c4266db051e7724f05411af7c09afb98116c0ebf5a0e57","observation_id":"717c9d84-f083-4143-98c5-1debe8b8c561","resolution":{"observed_at":"2026-08-15T16:53:22.774472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.502054Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":"3a592d2a-221c-4841-abab-0b0b952d055c","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.779149Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a201563ecc34556dc6d89a1511cbdfe9c0d1136f654e1dd7676cbdd58276c420","observation_id":"0de0604f-ff71-4389-8955-931c12b12fb9","resolution":{"observed_at":"2026-08-15T16:53:25.505964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T16:53:22.783699Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.783699Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:29740d006f3e5cf82b36e3f4ed6236c26cf03b9512a929e968985347d7a0a2f5","observation_id":"38b34c33-d68c-45e9-82d4-fe5acae628c6","resolution":{"observed_at":"2026-08-15T16:53:22.783699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07327","last_updated":"2023-10-31T11:38:07Z","snapshot_observed_at":"2026-08-13T12:02:41.563345Z","submitted_at":"2023-04-14T18:01:29Z","title":"OpenAssistant Conversations -- Democratizing Large Language Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07327","snapshot_observed_at":"2026-08-15T16:53:22.788829Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.788829Z"},"links":{"cited_paper":"/paper/2304.07327","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:514bda3cefda813c60421bc6e8fdad377cdeeccbd5407a432330f6fd1c803eb8","observation_id":"9772d448-c8aa-46ce-bf8b-4fdd38473acd","resolution":{"observed_at":"2026-08-15T16:53:22.788829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.csl.2015.11.001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.422492Z","title":null,"venue":null,"work_id":"7a0298d1-911b-48c5-a405-9e977f454999","year":2016},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.792835Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:24db602fe156417e73fbe6a24318ce9eeaa3589b13d9776262592f25fce30150","observation_id":"3f94880b-5269-49cd-bd72-7f66f9009f6e","resolution":{"observed_at":"2026-08-15T16:53:24.426226Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:22.798076Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.798076Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:49978c034293e50dff400822cb2c3c7a3df5dfa7dfb07423197de2b223201555","observation_id":"d19cb73e-99c9-457d-8ca2-b2062ac98757","resolution":{"observed_at":"2026-08-15T16:53:22.798076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-14T22:24:15.551461Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-15T16:53:22.802082Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.802082Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:18ffc19be1da9e965e18c4f040bb47ec617dabe4411a36ccd3a5ada7afa6d05e","observation_id":"aa28f2e5-6daf-4799-b1e4-5206150ee31c","resolution":{"observed_at":"2026-08-15T16:53:22.802082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15653","last_updated":"2023-11-27T09:33:13Z","snapshot_observed_at":"2026-08-13T05:17:14.338733Z","submitted_at":"2023-11-27T09:33:13Z","title":"MoDS: Model-oriented Data Selection for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15653","snapshot_observed_at":"2026-08-15T16:53:22.832237Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.832237Z"},"links":{"cited_paper":"/paper/2311.15653","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:3d4c0d26d9a1758ee7a0397ede5fc4bb8de7ef81c4f3ed06bee832b0720cba50","observation_id":"e5ff5e40-c2ac-493a-a866-962d67405388","resolution":{"observed_at":"2026-08-15T16:53:22.832237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20231","last_updated":"2025-08-13T03:43:47Z","snapshot_observed_at":"2026-08-11T00:58:41.102412Z","submitted_at":"2025-05-26T17:10:43Z","title":"MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20231","snapshot_observed_at":"2026-08-15T16:53:22.910537Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.910537Z"},"links":{"cited_paper":"/paper/2505.20231","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:5a1a97317d1ae65280f6eb938ee62cf0ff4c148e92a03df0f4a64fe37a8aa158","observation_id":"40abd064-255e-4903-9653-d731216da6e8","resolution":{"observed_at":"2026-08-15T16:53:22.910537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-15T16:53:22.970340Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.970340Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f6e1931a69ef825242abe83ce4c36f01d655bb7268129a98449db656bfe5035e","observation_id":"0afdf0da-9178-4431-a175-d9d9be2f19e2","resolution":{"observed_at":"2026-08-15T16:53:22.970340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14387","last_updated":"2024-01-08T04:46:56Z","snapshot_observed_at":"2026-08-13T11:36:59.381257Z","submitted_at":"2023-05-22T17:55:50Z","title":"AlpacaFarm: A Simulation Framework for Methods that Learn from Human Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14387","snapshot_observed_at":"2026-08-15T16:53:23.052812Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.052812Z"},"links":{"cited_paper":"/paper/2305.14387","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:bdf00815f843df2205a25516244b42edf70ddee919ce69fb1141666cac7e0891","observation_id":"0c38aede-0702-451b-8cc9-4c1f8ddd7839","resolution":{"observed_at":"2026-08-15T16:53:23.052812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.484421Z","title":null,"venue":null,"work_id":"9999576b-5148-4ef1-be0f-c766a6e746eb","year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.057382Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:6837e21f41b0187311db587e9915c244c78d9a4c516a4d0ef449cd3c3fa56e98","observation_id":"bb480604-dbb9-4fcb-8da1-30ac210c4959","resolution":{"observed_at":"2026-08-15T16:53:25.487976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-15T16:53:23.060599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.060599Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:fc9ca0dd35429a88162537681bb78189a13c118c07ac9625859d982c0a152c16","observation_id":"44fccc91-9124-415c-95c3-bb1a0a3d1e3f","resolution":{"observed_at":"2026-08-15T16:53:23.060599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T16:53:23.064696Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.064696Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:64fce9a97db89d1784d9c36d057cc0b6c82030b3c917d2b8c1545296a4da0a3f","observation_id":"3269b9c4-37bd-4a8a-b413-e9ca0d15c67a","resolution":{"observed_at":"2026-08-15T16:53:23.064696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.068957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.068957Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:364cc344d34994a9afdae4df7619dbf8785cc5479de08c522b3fe5d72aa55c70","observation_id":"e4b78710-c398-4964-9155-a58c809f0bcb","resolution":{"observed_at":"2026-08-15T16:53:23.068957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.072942Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.072942Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:155b2f6d94d3dd64880e3bbca569f3ec60f578d2a568966ee7fa8450b2d7a268","observation_id":"194405ed-a1e4-4235-89d2-65a8f4822b97","resolution":{"observed_at":"2026-08-15T16:53:23.072942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.57967/hf/1428","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.311996Z","title":null,"venue":null,"work_id":"0d6b15e3-d42d-4a25-95db-d8d16eb8ac6f","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.076596Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:5534f3d33c5f5abf84f6c6db4c9052d72a84ca53a908707e6408e17da608351b","observation_id":"314fbd2b-d2f5-4d77-b493-a7b611928e39","resolution":{"observed_at":"2026-08-15T16:53:24.381560Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-08-16T03:03:21.512563Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-15T16:53:23.080303Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.080303Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a8035d5edf7262ae656ff3d58c76df594bc834fcdbc7c4b6ac7687021d3f6e6d","observation_id":"913b9e89-8ef7-412b-ab52-9ac7e457651c","resolution":{"observed_at":"2026-08-15T16:53:23.080303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-15T16:53:23.084505Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.084505Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:76ff91cf7c3fd83d1afefbafe0f137426faaba5eaeac51067a47ae3e87d12a44","observation_id":"a06f190c-8419-4e18-a2b3-85bf9ca56358","resolution":{"observed_at":"2026-08-15T16:53:23.084505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T16:53:23.088432Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.088432Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a8085fedc0652494a25328cb632c53560a99da8d08943a493b769890cf78d88c","observation_id":"5755cbde-4e52-4b45-a840-cfda9b32aa87","resolution":{"observed_at":"2026-08-15T16:53:23.088432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.092553Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.092553Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:7e13cdc0c7e9520d18c5ca21669b38e005654ce5d58afb50fecfb3e43a503279","observation_id":"ab59eb2b-e59c-4285-ab43-ea66a02793c9","resolution":{"observed_at":"2026-08-15T16:53:23.092553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.129228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.129228Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:dd9cfb81895fde3bedced3a6edcc0175409c99079cddb56d4419f086110fbf6d","observation_id":"7c18b68d-87a2-4fa0-a04c-3b77c4710a63","resolution":{"observed_at":"2026-08-15T16:53:23.129228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.219890Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.219890Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:4287182f7a1d42268f964b2f98c78fe0bc52337c31c7c7eeafcf30da057518fa","observation_id":"a6186450-f037-47de-8ade-d2fcd2d2eaab","resolution":{"observed_at":"2026-08-15T16:53:23.219890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16745","last_updated":"2024-01-30T04:50:28Z","snapshot_observed_at":"2026-08-14T20:50:23.354301Z","submitted_at":"2024-01-30T04:50:28Z","title":"MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16745","snapshot_observed_at":"2026-08-15T16:53:23.265499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.265499Z"},"links":{"cited_paper":"/paper/2401.16745","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:2bff78580a64f62acaded48c8e55e063dc90a58e8d3aed52a622cf31eb8dd52d","observation_id":"4950a1a8-6d54-4e7b-9100-741d92b2e643","resolution":{"observed_at":"2026-08-15T16:53:23.265499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.323519Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.323519Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:682cee4aaac4404dbb1f3f7949a3849bd62b4427895c59d0e4cf2102012b7c87","observation_id":"a08f90e0-8ed3-4f38-a95e-ae99c3c68de5","resolution":{"observed_at":"2026-08-15T16:53:23.323519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.465646Z","title":null,"venue":null,"work_id":"8325f5e6-6156-4848-82ed-af5e60a56af7","year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.382869Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:112a3b2b175306354e2e3db5ea6cc66dfad1507a20d9b2101a830c88f1d5aff7","observation_id":"17c6750a-035b-45f7-b154-8c4ec800a170","resolution":{"observed_at":"2026-08-15T16:53:25.469471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.385896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.385896Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:77c1952c34f6cd5e179393e922e114685cda0be4b2d14b03dfb42b6ccfc14489","observation_id":"43a1d1f9-2888-4196-b3cc-d7e316d0709e","resolution":{"observed_at":"2026-08-15T16:53:23.385896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06259","last_updated":"2024-03-12T05:22:46Z","snapshot_observed_at":"2026-08-14T22:53:13.041119Z","submitted_at":"2023-08-11T17:47:54Z","title":"Self-Alignment with Instruction Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06259","snapshot_observed_at":"2026-08-15T16:53:23.389292Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.389292Z"},"links":{"cited_paper":"/paper/2308.06259","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:6b0d63365c091cc49d78cb5b4a2aae1ce449f71494fa387d75cd8faa3a7d8b52","observation_id":"70a761f2-bd8f-42e2-9035-b4f9c71549fb","resolution":{"observed_at":"2026-08-15T16:53:23.389292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.392910Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.392910Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:59594a455ff52156533a001b96154b5c8920f4eb0b77a5207e5d552d974fa803","observation_id":"40ed8e6d-d6ac-4220-8eba-de53b7dea1b0","resolution":{"observed_at":"2026-08-15T16:53:23.392910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.252","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.279916Z","title":null,"venue":null,"work_id":"ffb18511-7311-4ddf-a547-3a22bfd2fe6c","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.397011Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a4a04d57091e1ba551fbdfe853f090aab8b3cfd3eb9204c2a030ef9d21098d97","observation_id":"51d21797-22bc-46ad-8d91-67bb62f49797","resolution":{"observed_at":"2026-08-15T16:53:24.285040Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-15T16:53:23.400392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.400392Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:30bb7dd9aa46c3f4da5a9c5695d2f5895f5b59d6b7c51dc3ae08d496ebf03dd4","observation_id":"55713bee-64ea-44aa-ac65-22c47f218f2a","resolution":{"observed_at":"2026-08-15T16:53:23.400392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.444635Z","title":null,"venue":null,"work_id":"1f909719-7592-4471-a8d9-7c3ae06fca44","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.446430Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:2f717fbef3c2eb35278b5387cdf141da4c291d5143d19df15dfd44daabdfd75e","observation_id":"18611a9a-fbff-4cd9-960e-cbd4a4518022","resolution":{"observed_at":"2026-08-15T16:53:25.448786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.491011Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.491011Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:487f65e000a0198283bc6b596352a4e28087e8a122ebaa63b642fffedbc20c38","observation_id":"cde69e0a-c294-45f6-b4e6-a5554a23a5b6","resolution":{"observed_at":"2026-08-15T16:53:23.491011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08239","last_updated":"2023-08-23T03:37:04Z","snapshot_observed_at":"2026-08-13T10:33:48.015350Z","submitted_at":"2023-08-16T09:15:18Z","title":"MemoChat: Tuning LLMs to Use Memos for Consistent Long-Range Open-Domain Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08239","snapshot_observed_at":"2026-08-15T16:53:23.515745Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.515745Z"},"links":{"cited_paper":"/paper/2308.08239","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a134f05dbd178613d9557ef15e189288ff934ac597a4ca2f2782608cd70e480f","observation_id":"6340960d-80d7-4ecb-abb4-1f0bf2627fe7","resolution":{"observed_at":"2026-08-15T16:53:23.515745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07074","last_updated":"2023-08-15T07:37:32Z","snapshot_observed_at":"2026-08-14T01:50:52.757352Z","submitted_at":"2023-08-14T11:16:28Z","title":"#InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07074","snapshot_observed_at":"2026-08-15T16:53:23.519301Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.519301Z"},"links":{"cited_paper":"/paper/2308.07074","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:58bd545c823cc52549cdb2b33f3e5d3772af7bdb8390d5d2b4c7b157d6039a31","observation_id":"1a5ebd7a-4569-4943-b910-d0f511449864","resolution":{"observed_at":"2026-08-15T16:53:23.519301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16783","last_updated":"2025-03-04T07:56:00Z","snapshot_observed_at":"2026-08-14T20:07:15.237572Z","submitted_at":"2024-06-24T16:45:13Z","title":"M2Lingual: Enhancing Multilingual, Multi-Turn Instruction Alignment in Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.16783","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16783","snapshot_observed_at":"2026-08-15T16:53:24.738176Z","title":"M2Lingual: Enhancing Multilingual, Multi-Turn Instruction Alignment in Large Language Models","venue":"cs.CL","work_id":"cf06d60f-768c-4ecb-80d9-5850ff2b58c4","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.523157Z"},"links":{"cited_paper":"/paper/2406.16783","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f75ce1f134ce8e2492b2a74afc1b9b1f72b39f131ed72f111ba746d870f704cc","observation_id":"156ec57c-cb0c-4460-8965-c9480714e939","resolution":{"observed_at":"2026-08-15T16:53:24.742626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-13T00:38:23.444818Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-15T16:53:23.526966Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.526966Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f1801b3c6792b0c540d584099025d7c91eba31803dc388fe46ca3546b7da497c","observation_id":"2d18eea2-2a4a-4ef9-931d-23ee358c11c6","resolution":{"observed_at":"2026-08-15T16:53:23.526966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.391114Z","title":null,"venue":null,"work_id":"ba4e6786-a805-4413-9b23-28c82289c411","year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.531323Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a919d2743b8edfabd2986555274ea9d37b62624f506c8a5cdbcc168b6d32822b","observation_id":"faebdb45-7e5a-48c2-b23e-893817dcfe90","resolution":{"observed_at":"2026-08-15T16:53:25.435919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T16:53:23.534986Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.534986Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c45114cb075ee4fa4024efe676e2e61603e04b0521c5e2b0fe67d2a19be93b4b","observation_id":"a78009d9-526a-4a44-9a37-763a36d2a6d2","resolution":{"observed_at":"2026-08-15T16:53:23.534986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.282528Z","title":null,"venue":null,"work_id":"b2c73d80-eb9b-4f90-866a-f1be7b09066d","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.538893Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:3616a2e0782dc2b16ab8a1b0b37befc8d29ae76eac51d40cd9158bbcdbf25add","observation_id":"b50cab77-a832-459c-a22a-f6b6890bf261","resolution":{"observed_at":"2026-08-15T16:53:25.331798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.541858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.541858Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:eaac37f6c56bf1b46a9230fa71e4c7378dfa81af0d9522394504f09d7de5256a","observation_id":"ed2ff7a4-8dc7-4b8c-bef3-32e57142fef8","resolution":{"observed_at":"2026-08-15T16:53:23.541858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04579","last_updated":"2017-04-15T04:47:25Z","snapshot_observed_at":"2026-08-14T21:06:39.113868Z","submitted_at":"2017-04-15T04:47:25Z","title":"Evaluating Quality of Chatbots and Intelligent Conversational Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04579","snapshot_observed_at":"2026-08-15T16:53:23.544795Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.544795Z"},"links":{"cited_paper":"/paper/1704.04579","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:3cdcf82af4690d42ffa5ac68ec79fccf35a54e637cda1658214729a59dea3b0a","observation_id":"8a3b728e-5fe5-428a-ac67-8e466dc45789","resolution":{"observed_at":"2026-08-15T16:53:23.544795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.272200Z","title":null,"venue":null,"work_id":"95ffd020-3bfc-4292-b99d-1c08a394a016","year":2018},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.548603Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:400f911dedab6214242518c049cd6d10dfcc4ab73a67f661cdacb5a395b22ad0","observation_id":"e78b44c6-b917-46ff-a038-fc3f395e2e1d","resolution":{"observed_at":"2026-08-15T16:53:25.275143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.261872Z","title":null,"venue":null,"work_id":"6a225d13-c57e-4da9-b24a-944a16bf5e61","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.612899Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a32679406711a7c6c5d58a41126d26457683b374d988b1aacfaf340933d64cd8","observation_id":"f68002ae-1fd1-4dbe-abc6-9136f77189b1","resolution":{"observed_at":"2026-08-15T16:53:25.265239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14655","last_updated":"2024-12-02T12:37:46Z","snapshot_observed_at":"2026-08-12T23:59:45.002198Z","submitted_at":"2024-05-23T14:53:54Z","title":"Multi-turn Reinforcement Learning from Preference Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14655","snapshot_observed_at":"2026-08-15T16:53:23.703827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.703827Z"},"links":{"cited_paper":"/paper/2405.14655","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:b13e6889b46ff23f849aa90dfd7b2121ce3330ff564b82921aefcde1fa93777e","observation_id":"edbffcce-2a21-4322-abf6-f1115ea510ba","resolution":{"observed_at":"2026-08-15T16:53:23.703827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06619","last_updated":"2024-02-09T18:51:49Z","snapshot_observed_at":"2026-08-13T04:22:20.427195Z","submitted_at":"2024-02-09T18:51:49Z","title":"Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06619","snapshot_observed_at":"2026-08-15T16:53:23.707591Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.707591Z"},"links":{"cited_paper":"/paper/2402.06619","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:17fbc8e6674743f9b0ce1aa9a775466b5ced29d934c1e6cac46cc9c60075ce79","observation_id":"ad3238a6-8f2b-44ad-a7cc-4ee27f4e979e","resolution":{"observed_at":"2026-08-15T16:53:23.707591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.250900Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":"996782bb-9026-4b89-bd38-e3298d68e5d6","year":2020},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.713111Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:62c0865456b541511648574f9e4e890593f2e996e9d70cfae2e8313f4e4eeed1","observation_id":"37623523-3b5d-4487-a2c0-ccab6b8783d6","resolution":{"observed_at":"2026-08-15T16:53:25.254556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.717175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.717175Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:91a24af4d1ea64a1cbe306b9dbe2fd5f475e82bd6b37e3fd5ed04d1e755ec044","observation_id":"79ca3aab-10f8-4ea0-935a-c8fbb2c996d8","resolution":{"observed_at":"2026-08-15T16:53:23.717175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.720845Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.720845Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:62e22489e14af6e91a88a5759c3d279a27aee18c18dedcf73e2fa426f272790a","observation_id":"88715478-c663-4b37-bbec-fccf5eb0d830","resolution":{"observed_at":"2026-08-15T16:53:23.720845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T16:53:23.724594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.724594Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:58b09ad355c4e651ffd7e2488bc97397e67ed362470a1a6edbd7f217f4f08d4b","observation_id":"3f7944d5-7ad1-4201-8108-bf8422d1f19e","resolution":{"observed_at":"2026-08-15T16:53:23.724594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-15T13:55:57.190456Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-15T16:53:23.728202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.728202Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:d0c44fec1dc180d117028f2b6c865a02e75934e0f4324f7ca8eec38723f4497d","observation_id":"6cadf8f1-2ae0-412f-b6a6-8d73e5b1b716","resolution":{"observed_at":"2026-08-15T16:53:23.728202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.780407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.780407Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:763160172a219daa4bd1abf428f5940a95b1b1bdeca72116285775d589a0a4d0","observation_id":"9c32b1ec-7aa1-4914-8948-228fbb7abd4a","resolution":{"observed_at":"2026-08-15T16:53:23.780407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10646","last_updated":"2024-06-17T16:39:02Z","snapshot_observed_at":"2026-08-13T04:17:37.534181Z","submitted_at":"2024-02-16T12:47:11Z","title":"AbsInstruct: Eliciting Abstraction Ability from LLMs through Explanation Tuning with Plausibility Estimation","version":2},"cited_work":{"arxiv_id":"2402.10646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10646","snapshot_observed_at":"2026-08-15T16:53:24.623129Z","title":"AbsInstruct: Eliciting Abstraction Ability from LLMs through Explanation Tuning with Plausibility Estimation","venue":"cs.CL","work_id":"0f0dfbeb-250e-44f6-8b82-ad16a7267cf7","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.866631Z"},"links":{"cited_paper":"/paper/2402.10646","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c097dc5139eda48365f36e8edbeb0082e6cdc28c9cda391e1b546baf6e1973a6","observation_id":"425bb46b-fdd3-40c7-9b8d-5739ebae06c4","resolution":{"observed_at":"2026-08-15T16:53:24.658131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12067","last_updated":"2026-04-12T14:13:44Z","snapshot_observed_at":"2026-08-15T03:39:02.471554Z","submitted_at":"2023-08-23T11:27:30Z","title":"MM-LIMA: Less Is More for Alignment in Multi-Modal Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12067","snapshot_observed_at":"2026-08-15T16:53:23.871102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.871102Z"},"links":{"cited_paper":"/paper/2308.12067","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:d50c82e4ee5965e245aabe6da62d0cceec59caaeba4cf108442b878d56c6e3f1","observation_id":"bd1340cb-97d1-4b6e-bc8f-8c54e56c9c3e","resolution":{"observed_at":"2026-08-15T16:53:23.871102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.198437Z","title":null,"venue":null,"work_id":"91fb37b8-1294-4499-bc84-15265dc3838b","year":1962},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.875904Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:8c1d8a7acfbc2fa0b48f971eb938fd5fdba496a450e94e15a6d4261661509af9","observation_id":"30f9a656-305a-4232-83a7-fa56aadc9667","resolution":{"observed_at":"2026-08-15T16:53:25.237307Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12024","last_updated":"2022-03-23T12:13:07Z","snapshot_observed_at":"2026-08-14T18:42:06.410861Z","submitted_at":"2022-02-24T11:08:02Z","title":"NoisyTune: A Little Noise Can Help You Finetune Pretrained Language Models Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12024","snapshot_observed_at":"2026-08-15T16:53:23.879033Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.879033Z"},"links":{"cited_paper":"/paper/2202.12024","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:aaf464fad7bcfb0f742deed11a92d8fdb1ba7f160ce18dc5fa26024df2ff9826","observation_id":"5fd3280d-10e0-433e-9dcd-66cf22252cab","resolution":{"observed_at":"2026-08-15T16:53:23.879033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.882997Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.882997Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:5f99d74f3b679d88f93e3c32502449764b764aee9239e322ebb40056bfbf05e5","observation_id":"872e8747-ade3-4f00-90ad-4b0325b85acf","resolution":{"observed_at":"2026-08-15T16:53:23.882997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08182","last_updated":"2023-11-14T14:10:40Z","snapshot_observed_at":"2026-08-14T14:22:18.045271Z","submitted_at":"2023-11-14T14:10:40Z","title":"Self-Evolved Diverse Data Sampling for Efficient Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08182","snapshot_observed_at":"2026-08-15T16:53:23.892270Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.892270Z"},"links":{"cited_paper":"/paper/2311.08182","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f537ee08fe303f8a5c015e6bfba1e74e08cd035dbc378a1516d4c1d1a56fb255","observation_id":"14e13088-dd88-4c53-930c-065cc08b1a20","resolution":{"observed_at":"2026-08-15T16:53:23.892270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.896087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.896087Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:b96454fb07d6e0a41191969fc988f6c2747dc1defb4ee1fc69d0342f8206e101","observation_id":"a55ba2e6-5896-4da2-86ab-3274ef4cccd2","resolution":{"observed_at":"2026-08-15T16:53:23.896087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11508","last_updated":"2023-12-27T08:23:14Z","snapshot_observed_at":"2026-08-13T05:04:34.155323Z","submitted_at":"2023-12-12T03:30:21Z","title":"Rethinking the Instruction Quality: LIFT is What You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11508","snapshot_observed_at":"2026-08-15T16:53:23.926453Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.926453Z"},"links":{"cited_paper":"/paper/2312.11508","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:7d8d73a1ba4aa3b2d85d8024f260927350b10b1728b2ca9e655abeab27205fde","observation_id":"af67aada-dfe9-4b87-8a61-8ba7da4a36f7","resolution":{"observed_at":"2026-08-15T16:53:23.926453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-13T04:08:37.953823Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-15T16:53:24.015703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.015703Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:db5e9d952a6074c29534d95ef3360d0e94217bdc0eb3ccc78e11be24e849774f","observation_id":"ed9c2741-f0de-4de8-b376-7a02339b05d9","resolution":{"observed_at":"2026-08-15T16:53:24.015703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.034998Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.034998Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:a93d50a581542401ca29feae95e2ca6520c437445c292af8dd24edc474e72371","observation_id":"4688c757-0177-4528-9859-2c83033845bc","resolution":{"observed_at":"2026-08-15T16:53:24.034998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.039546Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.039546Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:4f790c7c1dc05a7f91c5f40e8aa25238d0f4066b3286613d243242fc3019174e","observation_id":"8fede186-0f16-46d8-b3eb-bb6ea6e76840","resolution":{"observed_at":"2026-08-15T16:53:24.039546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.042659Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.042659Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:80174c531c74667fb57c63479fc4b51580aac4f4c29286d7e6fa3c1dbb777f0a","observation_id":"696361dc-556d-42ee-85c3-da78279a9671","resolution":{"observed_at":"2026-08-15T16:53:24.042659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.112042Z","title":null,"venue":null,"work_id":"6c6727e8-e603-4aee-93b0-c23b8ed01347","year":2020},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.046352Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:af7e84cca6bed9724329ae583422b2ed9cb270025eb858359c22cc25277dde3d","observation_id":"8c24506c-dd7e-481d-8394-c3e214f02e01","resolution":{"observed_at":"2026-08-15T16:53:25.126994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-08-15T01:25:39.422061Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03507","snapshot_observed_at":"2026-08-15T16:53:24.049490Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.049490Z"},"links":{"cited_paper":"/paper/2403.03507","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c9a6bebe1fc4266a18a28e05d1a789d8705688148ce2bd85125d761f0398d344","observation_id":"f03a0931-03e7-4063-ae9b-641bcf4cf1f3","resolution":{"observed_at":"2026-08-15T16:53:24.049490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.100805Z","title":null,"venue":null,"work_id":"d4baa9b4-0c9d-4656-a1f1-d203e8753335","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.053224Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:e3cc2edffc7e38510babe5a370f8f0834b54a87849ee6285e80b50c0c95aa417","observation_id":"ce54a194-d112-4fe9-9bc9-fc77485275cd","resolution":{"observed_at":"2026-08-15T16:53:25.104662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.057189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.057189Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f7b82d419ed80f5f8d099d1ba38c8a0cabd908b11e6e1d998860e96a730364b8","observation_id":"fbb7a8df-1644-4e7d-a778-05e9e2990d62","resolution":{"observed_at":"2026-08-15T16:53:24.057189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.060676Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.060676Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:8bfe30b3b5492e6de95f170472762dd039f0ff5c5452e200f18b5df3a3aa21fc","observation_id":"3077031c-8295-4a42-b6eb-cab432af6f20","resolution":{"observed_at":"2026-08-15T16:53:24.060676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.064794Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.064794Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:66d2fcac61b7a57b5bdc69e83c319ce2a8f3d29a783017737cd4d768fbec6cc6","observation_id":"ef8982e5-a11d-4dd9-8bdc-0e7582c7f687","resolution":{"observed_at":"2026-08-15T16:53:24.064794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.144910Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.144910Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:5c6d7a92194eaf657da55c1a670948d1a323ebfb2c49ee1fa70c85bbd4243cd6","observation_id":"57553d04-06d2-4684-b091-326437b04518","resolution":{"observed_at":"2026-08-15T16:53:24.144910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T16:46:45.319828Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":68,"verified_exact":5,"verified_fuzzy":2},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2508.19996."}