{"as_of":"2026-08-08T22:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80963c9ff20303b3759c8d0a5f9ce401065feabd19e7314c5a78178e1080fc46","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:25:35.413399Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19922/citation-record","integrity":"/paper/2508.19922/integrity","json":"/paper/2508.19922/citation-record.json","paper":"/paper/2508.19922"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.14762","last_updated":"2024-11-05T16:40:21Z","snapshot_observed_at":"2026-07-06T17:34:07.737296Z","submitted_at":"2024-02-22T18:21:59Z","title":"MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14762","snapshot_observed_at":"2026-08-05T15:25:35.308051Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.308051Z"},"links":{"cited_paper":"/paper/2402.14762","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:21f4801c2d8140a6d88b10109eea7307c5b513a7313e956e8e2fe128d27e9c61","observation_id":"a18df4d1-2a4a-4f59-89be-946cb227ce9a","resolution":{"observed_at":"2026-08-05T15:25:35.308051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T15:25:35.312027Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.312027Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:844b63d4f9173f9787201b78968f3b2b96c62440827019fd80c270ce2741312a","observation_id":"81fe9f80-9a14-4b24-8f60-2ed60bab5c1e","resolution":{"observed_at":"2026-08-05T15:25:35.312027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19534","last_updated":"2024-10-31T14:32:28Z","snapshot_observed_at":"2026-08-08T17:04:33.949179Z","submitted_at":"2024-05-29T21:29:44Z","title":"Preference Learning Algorithms Do Not Learn Preference Rankings","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19534","snapshot_observed_at":"2026-08-05T15:25:35.315451Z","title":"Zhang, Xinyi Chen, Qiuyi Zhang, Rajesh Ranganath, and Kyunghyun Cho","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.315451Z"},"links":{"cited_paper":"/paper/2405.19534","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:c386450455def2b168830b75af55105a8cc0278a75e64ca6f37fa4a8dbe38c8e","observation_id":"a539f99c-50c9-4a24-b7c6-d7faa9d4fd88","resolution":{"observed_at":"2026-08-05T15:25:35.315451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-02T07:46:40.319683Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-05T15:25:35.318632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.318632Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:4f5b12e2bef9b5fb71adf2eac165e75684156ca7c6d6dae233288e92c90864c4","observation_id":"02b61796-c069-4de0-a360-c9dcc584af3c","resolution":{"observed_at":"2026-08-05T15:25:35.318632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T15:25:35.321876Z","title":"Hartshorn, Aobo Yang, Archi Mitra, Archie Sravankumar, Artem Korenev, Arthur Hinsvark, Arun Rao, Aston Zhang, and 510 others","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.321876Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:fac05cdbfc9b9ce00f8793d21956d514fe67b4b99a9e75a3ce9dc53a3560be7c","observation_id":"6400d7fb-8d6a-4e3d-801f-949194a5cdfe","resolution":{"observed_at":"2026-08-05T15:25:35.321876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-05T15:25:35.325156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.325156Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:26da3753d0bc268b665f66a326fca906991ef5ec40025034763d4d3cc6ccc4e1","observation_id":"279e15d7-63e2-4505-9f30-9db1bbf888c4","resolution":{"observed_at":"2026-08-05T15:25:35.325156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-05T15:25:35.328505Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.328505Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:958981dc7a7f43550b441000251254f54ed8a008cf4ed04575122338b73d0f32","observation_id":"bfe92514-dd2a-4c20-b687-8c64e7bc27c7","resolution":{"observed_at":"2026-08-05T15:25:35.328505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.834490Z","title":null,"venue":null,"work_id":"6ac6f35f-e00d-4398-9a6f-2e602528c591","year":2022},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.331630Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:3323edbf9332e1238c7875f5c8cf15b2e63e950da6faab48f85469c9d5be7e72","observation_id":"768642e3-ae38-4c1a-ad18-aa5dbc1cc6a1","resolution":{"observed_at":"2026-08-05T15:25:35.837450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-05T15:25:35.334486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.334486Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:88c15aecfa587a3ef170c68d172ddfd14d608df211e557e9bff34de56cd88db9","observation_id":"8fb3f77f-b479-4473-a490-2331c8df63c0","resolution":{"observed_at":"2026-08-05T15:25:35.334486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-05T15:25:35.337386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.337386Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:dee179b468ab4c4835ac5552f9bcceaea002d1b726a7e8a086382830af6a0599","observation_id":"43dfbf7a-46a8-45f1-8c41-50376056c31b","resolution":{"observed_at":"2026-08-05T15:25:35.337386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08825","last_updated":"2024-03-08T02:49:12Z","snapshot_observed_at":"2026-08-07T23:37:32.488201Z","submitted_at":"2023-10-13T02:41:55Z","title":"From CLIP to DINO: Visual Encoders Shout in Multi-modal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08825","snapshot_observed_at":"2026-08-05T15:25:35.340576Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.340576Z"},"links":{"cited_paper":"/paper/2310.08825","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:b86adaaf5a84a437bfef62d83068c6e3b3ae84ad152a259df4fb26d2f30ca66c","observation_id":"7de859b7-0815-4f8a-b1e1-53695a0ea7af","resolution":{"observed_at":"2026-08-05T15:25:35.340576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.825186Z","title":"Gonzalez, Haotong Zhang, and Ion Stoica","venue":null,"work_id":"4cf07564-ba7b-4ee6-94de-04a459e65413","year":2023},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.343809Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:ceee1bc4a7948380ec394144c2aa02b60202ed57d3dc390180e29754a594964c","observation_id":"98a8ee90-c487-4175-810e-7403af2fbc23","resolution":{"observed_at":"2026-08-05T15:25:35.828775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-05T15:25:35.346495Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.346495Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:baf9aea34707ac09f89dda3e0c21540857645b67a6428998c9c6f4e3ea276cd4","observation_id":"cf22cafc-b38e-42bd-a6d0-9e4780abe1ed","resolution":{"observed_at":"2026-08-05T15:25:35.346495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.349624Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.349624Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:f617bedc4d320a6076f1ac251a5360519ce6de925ce7ed424f9fe1e98fdecef4","observation_id":"5ca7e99f-4071-4063-93ac-0f7b35225c0b","resolution":{"observed_at":"2026-08-05T15:25:35.349624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-05T15:25:35.352224Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.352224Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:98ce21aa7ad8a356232ca22f1ce53667d3ffd872bb30c1a09fd3e4b25bab232c","observation_id":"facf74dc-aaa8-4041-b80c-a697b3c0462b","resolution":{"observed_at":"2026-08-05T15:25:35.352224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-03T02:02:15.325394Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-05T15:25:35.355296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.355296Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:bbd92e43524e7b55b05f830e0bd71f35beec3f1ca21e548fe34225a641ce0705","observation_id":"08de6af2-252b-4bd2-ac16-6ea088802325","resolution":{"observed_at":"2026-08-05T15:25:35.355296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T15:25:35.358311Z","title":"Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, John Schulman, Jacob Hilton, Fraser Kelton, Luke E","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.358311Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:4bb8821302bfc8739e8f5c549a347c9b561eb3146563a71cede637983b123f89","observation_id":"c649d71e-e58c-4e90-b088-c6d3f7a22e2b","resolution":{"observed_at":"2026-08-05T15:25:35.358311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08996","last_updated":"2024-10-11T17:09:22Z","snapshot_observed_at":"2026-07-06T19:31:57.906994Z","submitted_at":"2024-10-11T17:09:22Z","title":"Hypothesis-only Biases in Large Language Model-Elicited Natural Language Inference","version":1},"cited_work":{"arxiv_id":"2410.08996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.08996","snapshot_observed_at":"2026-08-05T15:25:35.602489Z","title":"Hypothesis-only Biases in Large Language Model-Elicited Natural Language Inference","venue":"cs.CL","work_id":"4ed60e82-4dba-4967-b0a7-d54b508730ab","year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.361362Z"},"links":{"cited_paper":"/paper/2410.08996","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:906981c9dc3b97c60534d3d5fc33206aba73dc664b0512d5507f6e08197cce64","observation_id":"a24bcf97-6762-47b6-9984-29a50dde373c","resolution":{"observed_at":"2026-08-05T15:25:35.605803Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.365480Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.365480Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:e9d0dc2317fa411710fc01aeb24704c829c51c51f96897173332a3531431050b","observation_id":"31890875-23db-473b-beb4-23c8de303c37","resolution":{"observed_at":"2026-08-05T15:25:35.365480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.811056Z","title":null,"venue":null,"work_id":"241d5d34-bf12-4029-89dc-fab9b6bc9e63","year":2020},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.368295Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:0c945ca8a05acb3c985819b6581094f11490003dbc58b0a8f50ca4a909b2630a","observation_id":"fdde10b8-fd83-4c49-98d8-ae73486fe0bb","resolution":{"observed_at":"2026-08-05T15:25:35.814122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T15:25:35.370884Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.370884Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:41f4b55821e63ecec066fcfe905072d2421a8307e9e6403c9922974740f9ff3e","observation_id":"3638db20-ec18-4d80-a848-247641455975","resolution":{"observed_at":"2026-08-05T15:25:35.370884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-05T15:25:35.373964Z","title":"Ziegler, Ryan J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.373964Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:1a2c661cb394f8ccc8b0aa32845951be6ad13107cf44e2653faeae5436442242","observation_id":"a5198434-c956-4da9-8c34-1a60a954360e","resolution":{"observed_at":"2026-08-05T15:25:35.373964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.376904Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.376904Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:d8d0d7b8dd8e6c4902b9a1618495a9755c46e86a8932c1387a50f6fa53b99572","observation_id":"b9fbefe5-a8b6-4452-8c8c-9ad588de887d","resolution":{"observed_at":"2026-08-05T15:25:35.376904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.379579Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.379579Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:f5bdfa2ab8a694328a993b1047c91b623d6a8b81b6bf96bcf8b2e51f795655f4","observation_id":"868bf964-29a8-4a94-a26d-be1fbe282ffd","resolution":{"observed_at":"2026-08-05T15:25:35.379579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15178","last_updated":"2024-06-21T14:23:57Z","snapshot_observed_at":"2026-07-06T18:34:56.008706Z","submitted_at":"2024-06-21T14:23:57Z","title":"Hybrid Alignment Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.15178","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15178","snapshot_observed_at":"2026-08-05T15:25:35.485957Z","title":"Hybrid Alignment Training for Large Language Models","venue":"cs.CL","work_id":"533cc931-ea37-462e-83a6-cb394c9a25f2","year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.382336Z"},"links":{"cited_paper":"/paper/2406.15178","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:3272645bf76426fb5fcde3e75d9d7e7668e3e9a5bccb60e85c37a7f3eb00b787","observation_id":"5c418fa0-b6b9-4179-9f75-6a6bbf36ed71","resolution":{"observed_at":"2026-08-05T15:25:35.491015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.797101Z","title":null,"venue":null,"work_id":"2fb43302-9f6b-4853-8ada-64eb2b3b7e11","year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.385312Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:4b243d718c6626c3b551ff35cdbcfb9d565573d698c5327365ee26483dee49a1","observation_id":"c798dd28-4929-4b73-a9d5-7102f66a80cb","resolution":{"observed_at":"2026-08-05T15:25:35.800105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01257","last_updated":"2025-03-06T12:13:14Z","snapshot_observed_at":"2026-07-06T19:25:42.156795Z","submitted_at":"2024-10-02T06:05:52Z","title":"HelpSteer2-Preference: Complementing Ratings with Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01257","snapshot_observed_at":"2026-08-05T15:25:35.388592Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.388592Z"},"links":{"cited_paper":"/paper/2410.01257","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:237fed964d8c30dc1c8a3bffba5f8088fd3010156a147384c52e4ad2364cdaf2","observation_id":"2a379593-88ca-4d08-bb53-4ebb4da394de","resolution":{"observed_at":"2026-08-05T15:25:35.388592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09223","last_updated":"2025-06-15T13:24:11Z","snapshot_observed_at":"2026-07-06T20:21:46.651618Z","submitted_at":"2025-01-16T01:03:56Z","title":"Foundations of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09223","snapshot_observed_at":"2026-08-05T15:25:35.391626Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.391626Z"},"links":{"cited_paper":"/paper/2501.09223","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:eda1cee68ad824d3293f82621f199b1e74306d52a5439dccb9bdc877f528fa8d","observation_id":"88c00a00-7b70-494f-a432-ab08a843f7e9","resolution":{"observed_at":"2026-08-05T15:25:35.391626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T15:25:35.394797Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.394797Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:7d5262c740ee368bcb700e47896b71d1a21f47c326a1f0d7b54d21fbd012a572","observation_id":"217601ac-2e29-402c-825d-d763b61db5cf","resolution":{"observed_at":"2026-08-05T15:25:35.394797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10216","last_updated":"2024-10-23T08:22:44Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:49:59Z","title":"Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10216","snapshot_observed_at":"2026-08-05T15:25:35.397981Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.397981Z"},"links":{"cited_paper":"/paper/2406.10216","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:eda9c940e266f911dfb1a1662e628d310da7a6af8007198ff2cece9830944d5f","observation_id":"ca0fdb99-e30d-4830-9981-4e1aa7a27de4","resolution":{"observed_at":"2026-08-05T15:25:35.397981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-05T15:25:35.400879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.400879Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:3d592cb06f220bdfd728e1ae49cbc630a2667f8a31b0fb79f7697f2b0b20920a","observation_id":"9d83beb0-7cbb-4590-bc32-b499daaba649","resolution":{"observed_at":"2026-08-05T15:25:35.400879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11206","last_updated":"2023-05-18T17:45:22Z","snapshot_observed_at":"2026-08-08T19:18:06.171048Z","submitted_at":"2023-05-18T17:45:22Z","title":"LIMA: Less Is More for Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11206","snapshot_observed_at":"2026-08-05T15:25:35.404093Z","title":"Yu, Susan Zhang, Gargi Ghosh, Mike Lewis, Luke Zettlemoyer, and Omer Levy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.404093Z"},"links":{"cited_paper":"/paper/2305.11206","citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:4821915483d9ead696f971867e76d830710d8d66643daa4818cb0afadcf9699a","observation_id":"2132af52-a5f3-4e90-83a0-270762cda0fd","resolution":{"observed_at":"2026-08-05T15:25:35.404093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.788342Z","title":null,"venue":null,"work_id":"5eb0c48d-0fd5-4f76-86bc-b66cde420cc6","year":2024},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.407005Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:9d77531155521492a09860c7d64efa639b63b3ddf81a90c5f1c1635d22842fe5","observation_id":"62608cbf-0e4b-4842-8a57-1625d88e15cf","resolution":{"observed_at":"2026-08-05T15:25:35.791472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.409794Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.409794Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:baad79ca2300894ad529faff2b49124f0a06f7542772bc5f6f40821f9f3d9afe","observation_id":"7abfbee9-2464-4368-af77-4ad008632c00","resolution":{"observed_at":"2026-08-05T15:25:35.409794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:25:35.413399Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:35.413399Z"},"links":{"citing_paper":"/paper/2508.19922"},"observation_digest":"sha256:11f1ce1e4cf0e92690e40d32c170e8303c25dbf027f20f517e122b0c132b87ae","observation_id":"0bb5983b-c7dc-4038-8bcf-54fe2b4133fa","resolution":{"observed_at":"2026-08-05T15:25:35.413399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19922","last_updated":"2025-08-27T14:30:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:38:01.894494Z","submitted_at":"2025-08-27T14:30:08Z","title":"HEAL: A Hypothesis-Based Preference-Aware Analysis Framework"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2508.19922."}