{"as_of":"2026-08-07T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b16021b0c75f2ce63b405e7881f8f630ddaf0c1a1abb2a1ee82d169f55c61a66","coverage":[{"denominator":240,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:55:42.739229Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09329/citation-record","integrity":"/paper/2506.09329/integrity","json":"/paper/2506.09329/citation-record.json","paper":"/paper/2506.09329"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:33.779711Z","title":"Explanations for commonsenseqa: New dataset and models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.779711Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5c71cf10070c35f98b788f0c68632032a79fbf2de973d05d94c0f6c807fb459b","observation_id":"2984a716-55b6-4c05-b1c8-2b424716993a","resolution":{"observed_at":"2026-08-07T04:55:33.779711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20541","last_updated":"2024-05-30T23:50:20Z","snapshot_observed_at":"2026-07-06T18:23:05.893052Z","submitted_at":"2024-05-30T23:50:20Z","title":"Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20541","snapshot_observed_at":"2026-08-07T04:55:33.838406Z","title":"Perplexed by perplexity: Perplexity-based data pruning with small reference models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.838406Z"},"links":{"cited_paper":"/paper/2405.20541","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:4e5c3273c596f4ce725b50d140b176bfb89e89dc591ede40e4715ceca0576838","observation_id":"3f267181-8541-4f56-8cc2-a05b3561a99d","resolution":{"observed_at":"2026-08-07T04:55:33.838406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:33.926249Z","title":"arxiv dataset, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.926249Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:bfef60499375ba9ca6a30b17c379306be1cc7c3f96f461dc20fd0b9d75392be2","observation_id":"db1cb79b-10f6-44c7-8f30-7c5326d99938","resolution":{"observed_at":"2026-08-07T04:55:33.926249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T04:55:33.990438Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.990438Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9c2d13f29f32ea2e09b6df51726aa6bfae2a85aac0695f6ea49147983dbee592","observation_id":"cb4f1d21-4f1b-402d-8515-1dec66a8baf6","resolution":{"observed_at":"2026-08-07T04:55:33.990438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T04:55:34.066154Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.066154Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:1acd2927767daa0fc1fa7e1464543219ba1cce3535170632190e04dcf1c4b10f","observation_id":"f7fd65e2-7744-48f4-8cae-8451897ae442","resolution":{"observed_at":"2026-08-07T04:55:34.066154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.132829Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.132829Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a8bd29e4b9b146d0e0776cf2d6b042d7f58d7b8ac7dcb99bb72a5f9f8be89367","observation_id":"2a2f7029-2d82-4d25-aec4-2ffc1fea85c2","resolution":{"observed_at":"2026-08-07T04:55:34.132829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.205526Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.205526Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3d7bee5fd60dbad744cf1164b0a9bbafae5f4622168af89ae7045858bb1fc342","observation_id":"6ddee455-f96b-4ce2-bf8e-d8d01ce24816","resolution":{"observed_at":"2026-08-07T04:55:34.205526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T04:55:34.295599Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.295599Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:302a4d051e6a1a37cba5942ae27f9a8d707524a870585a9fde96870cf4d9e243","observation_id":"ae4a5deb-b684-4c43-9b55-2da9714a0fc7","resolution":{"observed_at":"2026-08-07T04:55:34.295599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T04:55:34.409645Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.409645Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:0733543480ed7f80c45fd8e8a60d6db538a0e7713d1f2e0ea114b2bbffc16723","observation_id":"472e8260-1600-4b07-bc77-c0c6e79bd3a3","resolution":{"observed_at":"2026-08-07T04:55:34.409645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.497941Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.497941Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e41a7e76feb9db4c76a4a6dca875cd55390ba6770d70bcbe9437311ca3a6ed33","observation_id":"9141b438-901d-4072-85d8-052d26f42ca4","resolution":{"observed_at":"2026-08-07T04:55:34.497941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10305","last_updated":"2025-04-17T08:34:42Z","snapshot_observed_at":"2026-08-06T06:52:14.558389Z","submitted_at":"2023-09-19T04:13:22Z","title":"Baichuan 2: Open Large-scale Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10305","snapshot_observed_at":"2026-08-07T04:55:34.572378Z","title":"Baichuan 2: Open large-scale language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.572378Z"},"links":{"cited_paper":"/paper/2309.10305","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:8f8104823e3a6c712598bd7f63c472dda64bff68a18f61285561f9eca4f94d79","observation_id":"bc625a8d-77c2-4461-a291-d2866151238f","resolution":{"observed_at":"2026-08-07T04:55:34.572378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.641856Z","title":"PIQA: reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.641856Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:b0db73219c2b411c09539cd8b5a2ddd338fb0d10bec125a499188183ad520dc1","observation_id":"a4795861-b5bd-4e17-ac48-cd90fe38235d","resolution":{"observed_at":"2026-08-07T04:55:34.641856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T04:55:34.712793Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.712793Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:376e6f7cb622aae1b67141b522b4a3261404ff40ef2c49212cc7664c87e16120","observation_id":"f2613a1f-022c-4fcb-ac75-997afd90fee9","resolution":{"observed_at":"2026-08-07T04:55:34.712793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.771786Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.771786Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:de636b57b30fe9ba767fff56a1e1061282b2b6d3ccb6f3a04b54bd7d736e4c8f","observation_id":"cf7bd0d9-897a-407f-8a08-5f12ee0be21f","resolution":{"observed_at":"2026-08-07T04:55:34.771786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.834771Z","title":"On the resemblance and containment of documents","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.834771Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5cdf8f25f55ff8c1fa76cfe1b3172a029d61138580dccc2649ec4c637bacc4bd","observation_id":"243e65c4-9ddc-4074-a351-1794a3c2c60f","resolution":{"observed_at":"2026-08-07T04:55:34.834771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.894603Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.894603Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5672427556f92846d279a546f2249a507e67d4a3aa6104061f71447af3260eb3","observation_id":"9cb5a7d5-bc30-470d-a784-98838ae56b84","resolution":{"observed_at":"2026-08-07T04:55:34.894603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14736","last_updated":"2024-11-11T13:58:11Z","snapshot_observed_at":"2026-08-02T00:30:54.515426Z","submitted_at":"2023-11-21T19:12:18Z","title":"Data Diversity Matters for Robust Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14736","snapshot_observed_at":"2026-08-07T04:55:34.979788Z","title":"Data diversity matters for robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.979788Z"},"links":{"cited_paper":"/paper/2311.14736","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:94e81f727ab14ff9a52435b3daab3c0534d01e3c4da0287427ae4970296a0e80","observation_id":"ca627d7f-b4dc-44e0-b650-d68c428947e6","resolution":{"observed_at":"2026-08-07T04:55:34.979788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.044766Z","title":"Drlc: Reinforcement learning with dense rewards from llm critic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.044766Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:29af4a86967858249627130c8ab6977929fe221469d3fb23ce65b01d9a019770","observation_id":"6833eeb0-05f9-4dac-bc72-f0be0760cb3f","resolution":{"observed_at":"2026-08-07T04:55:35.044766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:55:35.093796Z","title":"Instruction mining: High-quality instruc- tion data selection for large language models.arXiv preprint arXiv:2307.06290, 1(3):6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.093796Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e703b965c70238e3eb0bdc80e988e9ea95dd82795e620b482b8184e3a4e2efc1","observation_id":"dcf1a6d7-877f-4d33-8226-a98385e3554e","resolution":{"observed_at":"2026-08-07T04:55:35.093796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.134788Z","title":"Wit3: Web inventory of transcribed and translated talks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.134788Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:b1945a33ca5130fbee3038a169f8263a9309014236fec2a93fd0ca1901b5b7d9","observation_id":"48a84e31-6eba-420c-a629-95694fd796b3","resolution":{"observed_at":"2026-08-07T04:55:35.134788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.190976Z","title":"Dense reward for free in reinforcement learning from human feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.190976Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c8b7561ff193e9e048821fa7be2ea5739f6c66066b3fe4769bf5aff032a40ebc","observation_id":"86d7480e-1b5e-40eb-ac40-e92c2671b1f0","resolution":{"observed_at":"2026-08-07T04:55:35.190976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09246","last_updated":"2023-05-16T07:52:57Z","snapshot_observed_at":"2026-08-05T06:19:25.316529Z","submitted_at":"2023-05-16T07:52:57Z","title":"Maybe Only 0.5% Data is Needed: A Preliminary Exploration of Low Training Data Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09246","snapshot_observed_at":"2026-08-07T04:55:35.255414Z","title":"Maybe only 0.5% data is needed: A preliminary exploration of low training data instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.255414Z"},"links":{"cited_paper":"/paper/2305.09246","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e900d317dff8d8fd0e107e36513ce1e730f3aa70129157f14623db87c2dbe2e7","observation_id":"f5508cc0-8a67-49c5-9e72-5f3b9356a530","resolution":{"observed_at":"2026-08-07T04:55:35.255414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10466","last_updated":"2022-12-20T17:39:21Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T17:39:21Z","title":"Controllable Text Generation with Language Constraints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10466","snapshot_observed_at":"2026-08-07T04:55:35.310420Z","title":"Controllable text generation with language constraints","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.310420Z"},"links":{"cited_paper":"/paper/2212.10466","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:18fe5ec6c772e745e2871d9203cd9bf0d4407e798c5c0a6025bdf85e5c85be03","observation_id":"c2bc87fc-1d24-4014-87b0-f5b109d3af90","resolution":{"observed_at":"2026-08-07T04:55:35.310420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-07T04:55:35.362349Z","title":"Alpagasus: Training a better alpaca with fewer data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.362349Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:12529dd081b527fc3bef1f88f47402fb2528b992a2274fb5c60fbfcff8ae7518","observation_id":"4fc93f12-58ed-420f-af94-e0141db37032","resolution":{"observed_at":"2026-08-07T04:55:35.362349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.427244Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.427244Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ffeab90cd1e8ac253306589ccb3c8a1ba5712a5e48e284b7f94ec3b269f580d1","observation_id":"e8374c56-37a3-4279-ad72-ec912cf5ccd9","resolution":{"observed_at":"2026-08-07T04:55:35.427244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.481196Z","title":"DoG- instruct: Towards premium instruction-tuning data via text-grounded instruction wrapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.481196Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:eb5131532e2735f6987fede8dfa15c5239214d6b4035a4ca376077be172c9774","observation_id":"3a881804-68d0-4530-bfb3-cc9bd2359f82","resolution":{"observed_at":"2026-08-07T04:55:35.481196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.556877Z","title":"Improving large language models via fine-grained 111 reinforcement learning with minimum editing constraint","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.556877Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:61d80a9c65a08466003763ffca7aa6f978df5f508544b9dff8076afa311707a1","observation_id":"2a12aa9c-f84a-4aa2-9cd0-4835b5f0dbaa","resolution":{"observed_at":"2026-08-07T04:55:35.556877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.620977Z","title":"Low-redundant optimization for large language model alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.620977Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:99fa1d08662b2a32fade23094cc925c50efd4d9f0315dc769f9168f449ac9b34","observation_id":"4d6f2caf-d786-4d3a-81c4-dba3f2d71162","resolution":{"observed_at":"2026-08-07T04:55:35.620977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07343","last_updated":"2024-02-28T12:51:09Z","snapshot_observed_at":"2026-07-06T14:17:58.992600Z","submitted_at":"2022-11-14T13:35:55Z","title":"Replacing Language Model for Style Transfer","version":2},"cited_work":{"arxiv_id":"2211.07343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.07343","snapshot_observed_at":"2026-08-07T04:55:44.355988Z","title":"Replacing Language Model for Style Transfer","venue":"cs.CL","work_id":"7495fc02-e109-435b-9630-9cfe5ed5a007","year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.694409Z"},"links":{"cited_paper":"/paper/2211.07343","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:6dababa50e70aa645086f10e2f73bdb856c166f39e925585edb6f84bd736c852","observation_id":"80803c46-36c0-48d6-889f-552a222edb19","resolution":{"observed_at":"2026-08-07T04:55:44.360440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.762417Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.762417Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:f821a2eb53f9a26f6b04010b683576c4c87d60ac53af3cc4fb260f733e589cdd","observation_id":"eb703fef-2a92-40c8-9583-3552aeafc88b","resolution":{"observed_at":"2026-08-07T04:55:35.762417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.823540Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.823540Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:75427ca31f32a09fdf39dc30a684349a4960671a9851f8af1673827cb52e7b49","observation_id":"7b778db6-1805-49c2-997e-dad6126a2f32","resolution":{"observed_at":"2026-08-07T04:55:35.823540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-07-06T03:45:28.546418Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-07T04:55:35.891868Z","title":"Learning phrase representa- tions using rnn encoder-decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.891868Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ca64cac8cc60cf99d73d5ae1925cdacf3c7760df08eb3f8d6f6229761c5c7f08","observation_id":"311459ef-77b8-4637-859b-a47450733117","resolution":{"observed_at":"2026-08-07T04:55:35.891868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.953346Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.953346Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5ab53203f6ed39fa99230cb0a6f9e0f64b42184d8446e1a0ad4e967373a76e2f","observation_id":"bae9199e-0e62-4fbf-aadf-6df4203faff9","resolution":{"observed_at":"2026-08-07T04:55:35.953346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.019095Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.019095Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:addc89feac00f8be81e02ce0db781c06060eac6aae8ead62175feda3c45a173b","observation_id":"e0423424-6cce-4c0b-801a-cbe6ae3f682c","resolution":{"observed_at":"2026-08-07T04:55:36.019095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00061","last_updated":"2021-07-07T06:07:22Z","snapshot_observed_at":"2026-07-06T11:24:46.448222Z","submitted_at":"2021-06-30T19:00:25Z","title":"All That's 'Human' Is Not Gold: Evaluating Human Evaluation of Generated Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00061","snapshot_observed_at":"2026-08-07T04:55:36.134233Z","title":"All that’s’ human’is not gold: Evaluating human evaluation of generated text","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.134233Z"},"links":{"cited_paper":"/paper/2107.00061","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5fb02f943318369221d4916ae2e07cb83a1b09d55d3ba135bdf9f5ddaba97233","observation_id":"29a15694-57eb-46dc-b94e-a18d5928a149","resolution":{"observed_at":"2026-08-07T04:55:36.134233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.238033Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.238033Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:6cd6d7258bb7f3476eaf530918aa0e5ffd20fd97a760aa40f69c8b1b02199e3d","observation_id":"d4a9d89c-da52-47f0-a837-41137e909365","resolution":{"observed_at":"2026-08-07T04:55:36.238033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.387177Z","title":"The future landscape of large language models in medicine","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.387177Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cae1cf590ba8f45041880c2e94f7c58ca0f1f29a7801f3f02a8159598d6274d0","observation_id":"21c9fbf6-ba16-4326-9e2f-0c82a5569734","resolution":{"observed_at":"2026-08-07T04:55:36.387177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:55:36.542461Z","title":"Training verifiers to solve math word prob- lems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.542461Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cfd968044aa2d2cb088055fd5d4dcd2cc6906d215dbe7a3aaf89220695f9a304","observation_id":"ef90d198-6b0c-4258-a85e-cdeaa7796aa6","resolution":{"observed_at":"2026-08-07T04:55:36.542461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12976","last_updated":"2023-12-20T11:52:41Z","snapshot_observed_at":"2026-08-05T09:43:41.386728Z","submitted_at":"2023-07-24T17:52:46Z","title":"Evaluating the Ripple Effects of Knowledge Editing in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12976","snapshot_observed_at":"2026-08-07T04:55:36.652970Z","title":"Evaluating the ripple effects of knowledge editing in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.652970Z"},"links":{"cited_paper":"/paper/2307.12976","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3ba9a1019c4b50fc6313f02454ed83b212c3e25fc647ca15c234b658e18fa8d6","observation_id":"5da014c8-c844-4ace-b009-5c6e0c6f2402","resolution":{"observed_at":"2026-08-07T04:55:36.652970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.715510Z","title":"Redpajama: An open source recipe to reproduce llama training dataset, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.715510Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2dbd0c31200a9dc5aa1b13e409be9c8d0a63416d40fa364c427afa5f6181be3a","observation_id":"56000ff9-8ca0-450d-9a6f-ce458accef52","resolution":{"observed_at":"2026-08-07T04:55:36.715510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.803603Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.803603Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:0ea766960902a2f1ce22f8eb3206cfb9be0124025977431a939e42c08412d763","observation_id":"f103fa79-936b-48a6-abe1-a63c7af4b37c","resolution":{"observed_at":"2026-08-07T04:55:36.803603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.895228Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.895228Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ae918c5ee73e2e84e9d1c254c601d06868ec804fc0bcda89a9e5b9f58158382a","observation_id":"90f2194c-0d28-45a6-b9dc-84946743b6f0","resolution":{"observed_at":"2026-08-07T04:55:36.895228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.011778Z","title":"Ultrafeedback: Boosting language models with high-quality feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.011778Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9b3ba2f914a48138e35ab09fa1e0c21ede55ab57af0faf0a395fcb9ad16594a4","observation_id":"ed021ca8-dc4c-448c-97f5-7cc5f5219fe0","resolution":{"observed_at":"2026-08-07T04:55:37.011778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.123213Z","title":"Knowl- edge neurons in pretrained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.123213Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d22ff77813e1c40204edd72058e2632df1f2d8955f283649a488726c0133e90e","observation_id":"06bbaec5-b94b-4928-b947-72112cd1f1ff","resolution":{"observed_at":"2026-08-07T04:55:37.123213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.253184Z","title":"Editing factual knowledge in language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.253184Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:8f896d38935108fa4ef86b47e77b05825baf5d78e9741e04e0669109282b1826","observation_id":"285a82bf-21c0-4aa3-9128-acd15a55a0ee","resolution":{"observed_at":"2026-08-07T04:55:37.253184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.420192Z","title":"Bert: Pre- training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.420192Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9aef5fae5ae54075a1d49a7821dfcbc27e1b4ea88d1309646962d3923b84ce0d","observation_id":"1f7ab59e-699c-43a4-a443-7ed6b901c578","resolution":{"observed_at":"2026-08-07T04:55:37.420192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.579671Z","title":"Enhancing chat language models by scaling high-quality instructional conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.579671Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:4065c467a0d5ded047c4fcf0d151e238c2b5dda6f32f113b00a35efab3ecdccd","observation_id":"d2bb9c16-8a0e-46ed-80da-cfd566084634","resolution":{"observed_at":"2026-08-07T04:55:37.579671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-07T04:55:37.750155Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.750155Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ef03cf0766dd042a63f97a19459a9f8046c46caeae0fccdc3d9154a5c505615f","observation_id":"0137709e-846f-4ca1-b11d-d3229c43b3ec","resolution":{"observed_at":"2026-08-07T04:55:37.750155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T04:55:37.923690Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.923690Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:df18a39b3e610aa6ca9f53704a453d10c27c546392c6b13fc3b893448ee6f238","observation_id":"1eeede9d-3cf9-4718-b778-117133eeae85","resolution":{"observed_at":"2026-08-07T04:55:37.923690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.091691Z","title":"Glm: General language model pretraining with autoregressive blank infilling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.091691Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:dfa812ff23d4f30877bf3badfb28bbd8750ba86321bce9126f8ee3e30fb3e55d","observation_id":"3d846989-825f-4387-9fb5-8017ae6e716c","resolution":{"observed_at":"2026-08-07T04:55:38.091691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.245201Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.245201Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e570c7bd4cb28dfce52967a8161408bdc5a1cced18b1e98e4efd7c5a105e6943","observation_id":"94750fad-64cb-41c8-a149-6fe7389653da","resolution":{"observed_at":"2026-08-07T04:55:38.245201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.319172Z","title":"Length- controlled alpacaeval: A simple way to debias automatic evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.319172Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e1e76621da0e7468cda00c1499eafd0e79a0976e817d815f4eff2745af9ea5fa","observation_id":"88326315-d97e-440e-bab5-8670052f5ef2","resolution":{"observed_at":"2026-08-07T04:55:38.319172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.532163Z","title":"Fact-checking the output of large language models via token-level uncertainty quantification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.532163Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:f2344523c9c6e11ffd39b3cf474c0bb4ffef97635689fe80a3a87edae8fc205d","observation_id":"c0c4a996-b02b-436b-b6bf-e7557988e64a","resolution":{"observed_at":"2026-08-07T04:55:38.532163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.690711Z","title":"Hierarchical neural story generation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.690711Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:f0ae98af158f0163272120fd32fedd92d8069970190e774d596b65056d6b6bfd","observation_id":"75ea9cfe-0741-4625-847a-1ea5d49c56ba","resolution":{"observed_at":"2026-08-07T04:55:38.690711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.11006","last_updated":"2020-03-02T12:12:43Z","snapshot_observed_at":"2026-08-04T04:04:57.045893Z","submitted_at":"2019-12-23T18:08:33Z","title":"Data-Free Adversarial Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.11006","snapshot_observed_at":"2026-08-07T04:55:38.892082Z","title":"Data-free adversarial distillation","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.892082Z"},"links":{"cited_paper":"/paper/1912.11006","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d95fb836d396d6786168a2917bebd45a2b92ba7ea9a5efbd4127296b96907cca","observation_id":"99594ee3-0f6e-4faa-b7e4-7a21323074c8","resolution":{"observed_at":"2026-08-07T04:55:38.892082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.059708Z","title":"Gptscore: Evaluate as you desire","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.059708Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d4bdd81c4820f5c60b24d8d0e124d3331f1fab645c93ef62ea243e2c5d1bdae3","observation_id":"1527546f-9b1d-4030-ac77-7fc2bc4d7c9f","resolution":{"observed_at":"2026-08-07T04:55:39.059708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.136611Z","title":"Preference learning and ranking by pairwise comparison","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.136611Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3c210aefe2fd011ff8b3ee30cc6df229024223f1ee4933b711e9793216d94d5e","observation_id":"dc021117-b897-4423-bbb1-ab96af9c2935","resolution":{"observed_at":"2026-08-07T04:55:39.136611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-07T04:55:39.303687Z","title":"Scaling synthetic data creation with 1,000,000,000 personas","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.303687Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:8c9ab89b4c32c42d975f9f15b52c98b1ffd951864b6b744eb902a9b83470b6a5","observation_id":"806fc54d-e1b9-4b59-9b4b-40a701927a5f","resolution":{"observed_at":"2026-08-07T04:55:39.303687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.386153Z","title":"Koala: A dialogue model for academic research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.386153Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:035d2f0a2a66cf8aad5444e7f6c42c05d242db157db4962b6eb81f0a6a3cca01","observation_id":"45258c39-e762-4c0e-9870-47c535fa60f4","resolution":{"observed_at":"2026-08-07T04:55:39.386153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.471185Z","title":"Did aristotle use a laptop? A question answering benchmark with implicit rea- soning strategies","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.471185Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7cfe69083bff43e25ae6bceac02515f0213b44755423edf5e6dd16b5bac1a7b6","observation_id":"c395c387-ca5e-4b6f-9322-8e9065136efc","resolution":{"observed_at":"2026-08-07T04:55:39.471185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15056","last_updated":"2023-07-19T14:10:55Z","snapshot_observed_at":"2026-08-07T05:52:37.011839Z","submitted_at":"2023-03-27T09:59:48Z","title":"ChatGPT Outperforms Crowd-Workers for Text-Annotation Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15056","snapshot_observed_at":"2026-08-07T04:55:39.571857Z","title":"Chatgpt outperforms crowd- workers for text-annotation tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.571857Z"},"links":{"cited_paper":"/paper/2303.15056","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:39bb03b8ec5757cde9ec91a58c55e19a04fc971705e82ea0b292381060b40169","observation_id":"05ffb229-30b1-4835-97db-4bc9ddd22642","resolution":{"observed_at":"2026-08-07T04:55:39.571857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.649815Z","title":"SAMSum corpus: A human-annotated dialogue dataset for abstractive summarization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.649815Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3da04c75f59695a62cd7d0d53a3444f41b575ce3b274461c68192a161f38becc","observation_id":"a597135c-ec96-4b60-8f72-8079c0c7de82","resolution":{"observed_at":"2026-08-07T04:55:39.649815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.744866Z","title":"English gigaword","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.744866Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7dcb2176783204f3ab75322f63848f74355879b467b0663ba6b17920623135f6","observation_id":"4b054aa4-b404-47a1-9c83-d2591fb12aba","resolution":{"observed_at":"2026-08-07T04:55:39.744866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T04:55:39.813545Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.813545Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:facdda3e04cdde07eda674de6d97d91cbc6d7c52ff1b3e74b8109631044f94e7","observation_id":"5bf6af9f-735a-4f6d-bb65-7038a8c7026c","resolution":{"observed_at":"2026-08-07T04:55:39.813545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15717","last_updated":"2023-05-25T05:00:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T05:00:12Z","title":"The False Promise of Imitating Proprietary LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15717","snapshot_observed_at":"2026-08-07T04:55:39.919359Z","title":"The false promise of imitating proprietary llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.919359Z"},"links":{"cited_paper":"/paper/2305.15717","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3015c00076e07ba759bcc663b6cb28cb2217974e9f12b4690d040cc9372d3b52","observation_id":"67e14756-5e5a-4a91-b91d-d0c912ee003d","resolution":{"observed_at":"2026-08-07T04:55:39.919359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:55:40.067581Z","title":"Deepseek-r1: Incentivizing rea- soning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.067581Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2f08742bd07b4f3eb8d46b50fc7dd0b2dbe2b3919feb6b809097fceaeaa1fc0e","observation_id":"17e89c8a-7a3a-467e-92e7-67759058212c","resolution":{"observed_at":"2026-08-07T04:55:40.067581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.217742Z","title":"Beyond imita- tion: Leveraging fine-grained quality signals for alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.217742Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:465c3d9b3b0d92c107862db0ea17d1d60d29c9eab8d266eb006b6532bfaea504","observation_id":"a1c3bdf8-4bdc-444b-ba66-8bc874dd732a","resolution":{"observed_at":"2026-08-07T04:55:40.217742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.344439Z","title":"Coopera- tive inverse reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.344439Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:196c3e8dff2b908f2539b2e668f54a00260f5ab460c0147790c6bba526ae961d","observation_id":"7c130163-e5d2-404b-b541-1bd4e4c5ed9d","resolution":{"observed_at":"2026-08-07T04:55:40.344439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.428933Z","title":"Aging with grace: Lifelong model editing with discrete key- value adaptors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.428933Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:edae6cc77b99c099797373af7c5dfded095106f96fea73714c2b8ca09b7075e5","observation_id":"2a29c6f4-e4a9-45d9-9aaa-af8afe755c70","resolution":{"observed_at":"2026-08-07T04:55:40.428933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.544821Z","title":"Does localization inform editing? surprising differences in causality-based localization vs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.544821Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:89f9330a54318b631701af1575fcaa6dee7ad4207af1907a19d65546a5e526a5","observation_id":"6da72c2a-db4f-40a8-8c63-0693d739ca3b","resolution":{"observed_at":"2026-08-07T04:55:40.544821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.625109Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.625109Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:319699d0d525e7652350d632a50edda843782a116729db5fc9e12ad93dfaba77","observation_id":"26507359-384b-4a0d-96e1-0992e7bf13a5","resolution":{"observed_at":"2026-08-07T04:55:40.625109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.743384Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.743384Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:37b52848ae8d6612395c0ea54167ca04de7c7556bdb89a3e76e6d860ddf89fec","observation_id":"c7e206f8-3635-444a-b363-ff65ccab6c83","resolution":{"observed_at":"2026-08-07T04:55:40.743384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.833002Z","title":"Knowledge distil- lation with adversarial samples supporting decision boundary","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.833002Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cb955b397b23d17b3875a729a127f0eb0a419861f98c1dc4f38d0b7cd365f6f2","observation_id":"d7a15b53-fe4c-4178-897d-94d96d60c1cc","resolution":{"observed_at":"2026-08-07T04:55:40.833002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.937312Z","title":"Orpo: Monolithic preference optimiza- tion without reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.937312Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7f69b542a630c8c6ecdb2fd8abf888816126dea81cbeb1eb5e473149f64961bf","observation_id":"7e6670d9-1673-4f20-884d-4131418befcc","resolution":{"observed_at":"2026-08-07T04:55:40.937312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.059879Z","title":"Parameter- efficient transfer learning for nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.059879Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:0042efb26b7eb731f4cb729e5c85c06cb598e7934c2d2fa40eada0d43df77074","observation_id":"0087c7e8-a8ad-4ebe-b022-d24ee74472cd","resolution":{"observed_at":"2026-08-07T04:55:41.059879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.200362Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.200362Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:011d6b6f8443c5be4fa7537a10c4e09ad8c4b894592e322e0299fee420c611b6","observation_id":"402a4af6-40ad-40e3-a551-ea01e5a81b92","resolution":{"observed_at":"2026-08-07T04:55:41.200362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.313569Z","title":"Is chatgpt better than human annotators? potential and limitations of chatgpt in explaining implicit hate speech","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.313569Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:6672951698aa78bfd225c5164ff9f1b69395073049019deb6a5b63f03b032241","observation_id":"ee0fa57b-89d2-4bf9-b945-d8b416985796","resolution":{"observed_at":"2026-08-07T04:55:41.313569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.513883Z","title":"Deep q-networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.513883Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:67f106d204820823293e7f6ca0cf51a6556e18c01819b03ae6699d7c7a47e1f0","observation_id":"ee95b239-2885-4582-8cd6-4481d5800d58","resolution":{"observed_at":"2026-08-07T04:55:41.513883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.661806Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.661806Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:6fe69a7c93fab52eea65c1436435e5f8c6cb336eb7cacc38f0b591a5fff3aff6","observation_id":"7daef58a-0866-472a-995f-316f8004916c","resolution":{"observed_at":"2026-08-07T04:55:41.661806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.747410Z","title":"Smith, Iz Beltagy, and Han- naneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.747410Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:6c8955ce36bd7ff760d01a6d582e07f2eddedea3d43685388b076a0b05d10e95","observation_id":"1abe27ca-14dd-4c0e-8082-b16488d5c3ce","resolution":{"observed_at":"2026-08-07T04:55:41.747410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.824542Z","title":"Aligner: Achieving efficient alignment through weak-to-strong correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.824542Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e7d724273629019c324699c20a9263d0a63e1bf2eae81c590ba8a1e3d8cd277f","observation_id":"180d9a92-bf39-47c3-beb0-9ec2378a5c96","resolution":{"observed_at":"2026-08-07T04:55:41.824542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.891033Z","title":"Mistral 7b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.891033Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2d59297f482b757352eb9a0f2f981bf05daca5b0786f0ec1412b94b818b13b24","observation_id":"4476b5a5-3f25-4d18-b90f-72717c8a72c8","resolution":{"observed_at":"2026-08-07T04:55:41.891033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.993198Z","title":"What disease does this patient have? a large-scale open domain ques- tion answering dataset from medical exams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.993198Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c96ae7b4a84aeeb8cd6144193e6f7181fa5998722f019837120a3d7d477ca845","observation_id":"1b7b75c7-ae68-4aa3-9b3a-c2a82a818f46","resolution":{"observed_at":"2026-08-07T04:55:41.993198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.122707Z","title":"Plus disease in retinopathy of prematurity: im- proving diagnosis by ranking disease severity and using quantitative image analy- sis","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.122707Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5e48b298740c94c26dd2a81ee78044db5ad00b38e50cdaf3b79c80d519249b0c","observation_id":"122b1fbb-215f-463c-b615-4a683574074e","resolution":{"observed_at":"2026-08-07T04:55:42.122707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T04:55:42.209573Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.209573Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7e42d03d76614b47556c61fb26bcc1815356b2be21a0385e53f0687f584c276f","observation_id":"20d8c7ec-1a6b-4cbc-b948-e40b86c96ebf","resolution":{"observed_at":"2026-08-07T04:55:42.209573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.300537Z","title":"A survey of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.300537Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:32f6efdcc6ddee8908324087ed6f9edf75ddd317482cb0ba0b94a25a55c48698","observation_id":"99a690e2-d9ff-46a8-83b2-0e764f46df61","resolution":{"observed_at":"2026-08-07T04:55:42.300537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.373458Z","title":"QASC: A dataset for question answering via sentence composition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.373458Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:78dfd351548e0a02a86e05446dc719276d5c99659bcb88382994a33cd6da394a","observation_id":"7d79b45b-d7eb-497d-961b-2158e8f2b86f","resolution":{"observed_at":"2026-08-07T04:55:42.373458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.435240Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.435240Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:b67a9cabe913bb1630b57f22fd07eb05c2c61cdff42dd4a8952128e6d5e7c5dd","observation_id":"fccded32-3950-43d9-ae9e-e1a1d997972a","resolution":{"observed_at":"2026-08-07T04:55:42.435240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.491049Z","title":"MAWPS: A math word problem repository","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.491049Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:72f9b0bf0c7de2ea0247692abc11e8b836dd6261326dca1b55fc8a2df6200b17","observation_id":"1037a898-9a40-4c2b-a389-d9ed6a1b4821","resolution":{"observed_at":"2026-08-07T04:55:42.491049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.554902Z","title":"Openassistant conversations-democratizing large language model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.554902Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ee2f3e79ba2d36dfbdecf9fbad7289913ad98a0483640c2d3e794c15919b2435","observation_id":"f79c7443-f797-4bc8-9e2e-e91697403498","resolution":{"observed_at":"2026-08-07T04:55:42.554902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.671056Z","title":"Spoc: Search-based pseudocode to code","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.671056Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c10b529f39a4bd8741a2213cc3243557bb703609b3bca8bb14e36bc111304b2f","observation_id":"755e83e5-26cb-425e-92d1-4a0bbda2db33","resolution":{"observed_at":"2026-08-07T04:55:42.671056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16745","last_updated":"2024-01-30T04:50:28Z","snapshot_observed_at":"2026-07-06T17:22:15.248410Z","submitted_at":"2024-01-30T04:50:28Z","title":"MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16745","snapshot_observed_at":"2026-08-07T04:55:42.704868Z","title":"Mt-eval: A multi-turn capabilities evaluation benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.704868Z"},"links":{"cited_paper":"/paper/2401.16745","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c93fdf44e4b30a21ed7931afa39ebd07967db680e7f5846671a6388339d8e6d8","observation_id":"372e1cc8-c5a1-4a4b-b150-799272fb5cfa","resolution":{"observed_at":"2026-08-07T04:55:42.704868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.709802Z","title":"Large language models in law: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.709802Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:60f4d5ce47489a40465af40fdf668a3a70ceafc50e1070f25c5d3dae8f2d4075","observation_id":"dfbe63b4-05e6-4cb6-b276-20b88d796c00","resolution":{"observed_at":"2026-08-07T04:55:42.709802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.713868Z","title":"Ds-1000: A natural and reliable benchmark for data science code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.713868Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:712bf3e5d3efdb9d8cb5078d6a6bae9be1aacd8aab69e8623756a5b89fc31929","observation_id":"db55201a-1d75-436c-ab20-2d0a6f6d4370","resolution":{"observed_at":"2026-08-07T04:55:42.713868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.718727Z","title":"RLAIF vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.718727Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ba8cedd88ce5391621e7b1409a50a72d436fb4530f8ce8a7aebbe8b6f7aed6c0","observation_id":"94a113b0-53e8-43f2-a4fd-ce0854cdf8a7","resolution":{"observed_at":"2026-08-07T04:55:42.718727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-07-06T07:15:51.575438Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-07T04:55:42.722920Z","title":"Scalable agent alignment via reward modeling: a research direction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.722920Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a0cc9a2b583e4e169ebfd8bea39b04e3c9322248c199478cbe98da64cb854d5a","observation_id":"4fc3d327-5031-45a9-bc38-86ab82cea280","resolution":{"observed_at":"2026-08-07T04:55:42.722920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.727112Z","title":"Zero-shot relation extraction via reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.727112Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e87f4b6fcfa91629f4a7aa0d5cb1c42b9a8ecceb21da1a439af93bc7528e9d7d","observation_id":"7d2b17f9-d8ae-44a0-89d7-61cf01e0f55f","resolution":{"observed_at":"2026-08-07T04:55:42.727112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.731509Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.731509Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ad8e0c55e062a1f7d658b6cb01c15dfcaaf4d371144e2ad53fe417ccf94cfbfd","observation_id":"b1f96cdb-4c54-4951-9213-17ec4f5c7fdc","resolution":{"observed_at":"2026-08-07T04:55:42.731509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-07T04:55:42.735264Z","title":"Cmmlu: Measuring massive multitask language un- derstanding in chinese","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.735264Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9c520561744e821fc0200c5652823d86b0a0c090bb2476dcbb902d2f2bd8e872","observation_id":"8ce389d0-653d-4a00-8892-d18212bab4e2","resolution":{"observed_at":"2026-08-07T04:55:42.735264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13064","last_updated":"2024-02-20T15:00:35Z","snapshot_observed_at":"2026-08-06T08:24:00.729497Z","submitted_at":"2024-02-20T15:00:35Z","title":"Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13064","snapshot_observed_at":"2026-08-07T04:55:42.739229Z","title":"Synthetic data (almost) from scratch: Generalized instruction tuning for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.739229Z"},"links":{"cited_paper":"/paper/2402.13064","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e0a8e95f5713fc9caf5377257b9e1d56c27e7d6b3798c6f3f282010b8ac911f3","observation_id":"dcb59c4d-3e81-407a-8581-e3209625dafb","resolution":{"observed_at":"2026-08-07T04:55:42.739229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":240},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 240 outbound references and 0 inbound Pith citation observations for arXiv:2506.09329."}