{"as_of":"2026-08-07T18:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c259f957dbc558ed5e3aa998691cae0e765acf7ae04b1e1fd4cf2863a1ebecb5","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:41:59.898754Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07434/citation-record","integrity":"/paper/2506.07434/integrity","json":"/paper/2506.07434/citation-record.json","paper":"/paper/2506.07434"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T05:41:59.723254Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.723254Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:a3d413b2f3854e435eb7d329aa0077ad366168a563ea5a98b41d736aee1ae8d8","observation_id":"f42454d5-f4d2-4ceb-ad89-ed16655ecc5b","resolution":{"observed_at":"2026-08-07T05:41:59.723254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T05:41:59.728663Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.728663Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:968e25e4b5d6f1a2185d23140fba05f0cac66febcc716c6954410f9323f9572c","observation_id":"f2d04461-63eb-4683-b39b-d4ff39bc5ba2","resolution":{"observed_at":"2026-08-07T05:41:59.728663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.733623Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.733623Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:bec9a79200c7bc83c3b207ecd3ab39659616d9dc5015c58d57feed02d2b0c159","observation_id":"e2454226-aa40-439d-94cf-58f199d91b95","resolution":{"observed_at":"2026-08-07T05:41:59.733623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T05:41:59.738804Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.738804Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:741b66949fa53a1ec95ac75afcca53beae99937b4be38d94094bceffd289bcee","observation_id":"6eab885f-f233-43d4-8214-d026879de2c8","resolution":{"observed_at":"2026-08-07T05:41:59.738804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.425327Z","title":null,"venue":null,"work_id":"cb0daaaf-0484-45a1-8d3c-f60c57990441","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.743661Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:699d878eb062680340239f05cd9cf3bd07def945dc72386a0f5ba85267afa680","observation_id":"6c126313-59e3-46f2-898b-59f623c5335b","resolution":{"observed_at":"2026-08-07T05:42:00.429903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.748520Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.748520Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:c4fbf63285a0ac34a0b43ad967140bd2153af3fe965f727ea3bafbfb21100cf0","observation_id":"e263492c-a53e-4a19-8da9-d8a058e9ebe8","resolution":{"observed_at":"2026-08-07T05:41:59.748520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:41:59.754141Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.754141Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:52046852a68f423c514b892244ab9c0d92b447c01ab6f86405429ad6a4872208","observation_id":"69929be8-2c5d-4f29-a7f4-a1d5c50a16da","resolution":{"observed_at":"2026-08-07T05:41:59.754141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02795","last_updated":"2024-10-31T05:39:06Z","snapshot_observed_at":"2026-07-06T19:10:25.534956Z","submitted_at":"2024-09-04T15:11:55Z","title":"Towards a Unified View of Preference Learning for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02795","snapshot_observed_at":"2026-08-07T05:41:59.758542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.758542Z"},"links":{"cited_paper":"/paper/2409.02795","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:83c66e5bead881ffe59b67ee17193a57c7dc2533a1940ab7248e859a90856154","observation_id":"d1c48dca-cb8a-40da-979e-57de75e1eca0","resolution":{"observed_at":"2026-08-07T05:41:59.758542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T05:41:59.763408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.763408Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:67bdd9cea9cce4a4b3b6d6d88a86a6fede25aa1cea54fa223f71248441ca335c","observation_id":"e4aa96fc-ea8e-414f-b248-0a220dd2f454","resolution":{"observed_at":"2026-08-07T05:41:59.763408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.768395Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.768395Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:8609a4763a0c24e741d07ae3dce2759f99814cdc2cb3d2947ecd0abd49860c29","observation_id":"bf14a360-c7d7-4ca5-8200-7361abb00d9a","resolution":{"observed_at":"2026-08-07T05:41:59.768395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.410496Z","title":null,"venue":null,"work_id":"9c4e07fb-f6bb-4ae3-a56d-22c2e4bc93ea","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.773306Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:039436bb765a1c7db77a22819ec8df7c438f86f22131de29a6bbe3d64ddb9622","observation_id":"dcf37842-a86b-4865-9d2e-62087eda24fa","resolution":{"observed_at":"2026-08-07T05:42:00.414961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.395026Z","title":null,"venue":null,"work_id":"3cb2a99b-8f41-4693-bd81-fc81778b343b","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.779254Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:14fc5881e467c4d9bfbcfdea3f236301bb7b284650976a6970b3ebf91094be1a","observation_id":"728195e0-4188-42a7-836a-cbd81a21e6c0","resolution":{"observed_at":"2026-08-07T05:42:00.399434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.783935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.783935Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:5b792b340a27047059750b19f24f2bfca45904e113b7862f0986d7ce53d7575b","observation_id":"ae38a833-d89b-4e7b-966f-acd3521c1e16","resolution":{"observed_at":"2026-08-07T05:41:59.783935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.788661Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.788661Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:9555e982da2e6baae3e6276f5e0e5b2204063b02e9f067e6fdf13eba861389e4","observation_id":"26d64d00-ed8d-4e16-a975-c5d840efa41c","resolution":{"observed_at":"2026-08-07T05:41:59.788661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.793457Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.793457Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:978b7882f76cc93e31327c9ef5d47e7978cd1f2b30d7755ad153ed5b0ea2a0d0","observation_id":"ea847371-9676-4b68-b5cc-1bb76b531e33","resolution":{"observed_at":"2026-08-07T05:41:59.793457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16306","last_updated":"2025-08-03T22:12:55Z","snapshot_observed_at":"2026-07-06T18:35:45.699877Z","submitted_at":"2024-06-24T04:08:35Z","title":"Cascade Reward Sampling for Efficient Decoding-Time Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16306","snapshot_observed_at":"2026-08-07T05:41:59.798320Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.798320Z"},"links":{"cited_paper":"/paper/2406.16306","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:945701ad15cda4e5f57ce935bec253f7d5fc1f7edcb882155673a71edaa67656","observation_id":"b0ca6ada-dfb6-47b6-8910-fc9d13ec4de4","resolution":{"observed_at":"2026-08-07T05:41:59.798320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-07T05:41:59.803056Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.803056Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:1cba57300f018ddda0585588338f5458bdf983b2c24532bff5a0bce2e16f44f0","observation_id":"ddb1f633-567c-4dda-b123-7a64809bc191","resolution":{"observed_at":"2026-08-07T05:41:59.803056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.807985Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.807985Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:de3aa6c952f0d05b85fa7fff5aef0029b19a37af7d599c2bb068ca0f7a5dfbb8","observation_id":"2f06e1fb-6d84-4874-9fae-94f8a8f16659","resolution":{"observed_at":"2026-08-07T05:41:59.807985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.338649Z","title":null,"venue":null,"work_id":"4c8c160f-05b6-4d1c-9df3-f4bd87d876e7","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.812559Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:24a43f0d0e6990a219b0b65a6d1b10b6bd35eb1b4295e6438151970ac1636bb8","observation_id":"04d88e52-dcd1-4a23-a4db-dbe687d393af","resolution":{"observed_at":"2026-08-07T05:42:00.343664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.322183Z","title":null,"venue":null,"work_id":"4acc7bd4-de79-4ba6-a429-23dbc7460a66","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.817521Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:d09adac998183256bd294c9adb45f0cbe32119db6f1fbab3f7804931dccb8635","observation_id":"3c235bbf-c136-439c-8880-3a62de372171","resolution":{"observed_at":"2026-08-07T05:42:00.327360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.822198Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.822198Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:f40986e35e8872d1d56849eb39afef2dfc94d60aae5c2efe6f49d7ea969283a8","observation_id":"b619c84c-ea22-4f36-88f2-510e374b9de2","resolution":{"observed_at":"2026-08-07T05:41:59.822198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-07T05:41:59.826898Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.826898Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:4071bc4710cec7566ceaf0c2ce63e48d0a0181525645b67ada1932769b7b42d0","observation_id":"00cfa11b-6d35-4e7e-b128-ccc94a2bde9c","resolution":{"observed_at":"2026-08-07T05:41:59.826898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.831536Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.831536Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:9ec6eaa28d57c94582d45bce9f9c7693eedbc898bdfff5926ff326ed15edf7c8","observation_id":"da3a15be-3b24-40f3-b24f-ff7ad75c4025","resolution":{"observed_at":"2026-08-07T05:41:59.831536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07672","last_updated":"2025-03-02T06:25:14Z","snapshot_observed_at":"2026-07-06T19:31:00.754487Z","submitted_at":"2024-10-10T07:29:35Z","title":"MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization","version":2},"cited_work":{"arxiv_id":"2410.07672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07672","snapshot_observed_at":"2026-08-07T05:42:00.027393Z","title":"MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization","venue":"cs.CL","work_id":"04370814-2e79-45ba-98b0-fa2f843c1d96","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.836155Z"},"links":{"cited_paper":"/paper/2410.07672","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:21499009b323de60fd72a9e500b23d027c39ef395e9f8b45a299ce33e16b17b5","observation_id":"10244946-515c-4eac-8887-dbf5191fb7c2","resolution":{"observed_at":"2026-08-07T05:42:00.035197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.841106Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.841106Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:8e8ba98c7192b798fddede9c4ace8bca7e46c78c261d78eb239e3ad98ab81486","observation_id":"6afa6bf8-e9d3-4407-b26d-c19045ce25ef","resolution":{"observed_at":"2026-08-07T05:41:59.841106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.287376Z","title":null,"venue":null,"work_id":"aa686c84-ed30-4530-80e6-f038e9deda9e","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.845773Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:0fa743e600509e2489e3733bdc68ec2eda1438eb4b9dd7b91c7c97729410d78c","observation_id":"70609451-2c99-4a11-ada2-fca543dd2f80","resolution":{"observed_at":"2026-08-07T05:42:00.291938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.850453Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.850453Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:970aaa6d242228d6801c626272b50b3bcbdbdd94eb4b382dae0a3f0e2647cfa0","observation_id":"5375d0f2-0ab7-45de-a8a9-108c59f968fc","resolution":{"observed_at":"2026-08-07T05:41:59.850453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.855461Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.855461Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:1dc1bc2f911c466b0fb1f10f3bed9ee737f9f431188858df32d8e7a978193204","observation_id":"98d78969-e2bd-4620-bd8a-ea940cc3af37","resolution":{"observed_at":"2026-08-07T05:41:59.855461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.251613Z","title":null,"venue":null,"work_id":"6c23a572-e215-4dbe-85d6-20be26a81ac8","year":2025},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.859681Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:8a44467e2857138cc66782ade191c9b9c748ce0630e9a85030113c4bb66ee028","observation_id":"a32203e1-f232-4ca3-9054-d26c33800a0b","resolution":{"observed_at":"2026-08-07T05:42:00.256598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:42:00.234701Z","title":null,"venue":null,"work_id":"71e744c5-abde-426e-88fb-44ebc4267305","year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.864330Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:d4ac4bf12b940e4a4ca4be0438f35b1882c196374a0164ee62568d8202ddd199","observation_id":"50457d42-c2c4-4bdf-9aec-af5d02db6c69","resolution":{"observed_at":"2026-08-07T05:42:00.240191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12845","last_updated":"2024-06-18T17:58:28Z","snapshot_observed_at":"2026-08-06T09:12:58.062581Z","submitted_at":"2024-06-18T17:58:28Z","title":"Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12845","snapshot_observed_at":"2026-08-07T05:41:59.868635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.868635Z"},"links":{"cited_paper":"/paper/2406.12845","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:1617fd79a7680b33c6506d1ba5bc3653755ef3d1ecf776d3562244cf8fb7566c","observation_id":"875c2e27-052c-4e7f-bbbd-d4b8646455d2","resolution":{"observed_at":"2026-08-07T05:41:59.868635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01257","last_updated":"2025-03-06T12:13:14Z","snapshot_observed_at":"2026-07-06T19:25:42.156795Z","submitted_at":"2024-10-02T06:05:52Z","title":"HelpSteer2-Preference: Complementing Ratings with Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01257","snapshot_observed_at":"2026-08-07T05:41:59.874401Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.874401Z"},"links":{"cited_paper":"/paper/2410.01257","citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:44cce8e3ad0b93774329f42ab739e98ff8620484a57f4f4edd7006e6ea22b04a","observation_id":"38ed5144-7e39-40df-b130-03924ff07c98","resolution":{"observed_at":"2026-08-07T05:41:59.874401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.879020Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.879020Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:8f50e7b1331aa7a4a8c0f324a143ff24777b6acb1b373b147e2df2787d40f447","observation_id":"9b1f624a-b78e-40e0-92a9-ae8961a70220","resolution":{"observed_at":"2026-08-07T05:41:59.879020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.883540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.883540Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:ba7454576d831e8f096c461c2c9ef50a511fe20dd81562befd9f6e90aa6af5d2","observation_id":"25a722e3-a79e-495b-b7cf-4b0ae3582c2b","resolution":{"observed_at":"2026-08-07T05:41:59.883540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.888508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.888508Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:a362cde56afb92cfea67c8870178864065faa95a434d5b0d0564bd6631851dfb","observation_id":"022ed38c-2672-427e-b021-93c840d06276","resolution":{"observed_at":"2026-08-07T05:41:59.888508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.893439Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.893439Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:c13333f9e1363491b1875f40fa7a81cfbb10b865b6f04875fb3de7d5df3ff2d5","observation_id":"770a7858-670d-4cbb-ba78-232a78c0282e","resolution":{"observed_at":"2026-08-07T05:41:59.893439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:59.898754Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:59.898754Z"},"links":{"citing_paper":"/paper/2506.07434"},"observation_digest":"sha256:4af9f705c15c7602760a10c9d4737c82b839e4cda50856a449b002b9816c9a87","observation_id":"002ea223-2ba5-45dc-8dfe-98b998b3b746","resolution":{"observed_at":"2026-08-07T05:41:59.898754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07434","last_updated":"2025-06-09T05:21:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:31:43.113253Z","submitted_at":"2025-06-09T05:21:22Z","title":"Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2506.07434."}