{"as_of":"2026-08-04T15:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c2d94958d6ea21eb46ab6df9fb57c8a9c91180d5639bc5f97f3e2b16fbd9bee","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:36:17.029024Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13315/citation-record","integrity":"/paper/2607.13315/integrity","json":"/paper/2607.13315/citation-record.json","paper":"/paper/2607.13315"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T05:36:12.034774Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.034774Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0c2dee0b2725411c27580fa682ea224f1015b4ba337ea88884b78cdc7a7213b8","observation_id":"3b11c6ea-5363-4d49-8ca2-652dbba94092","resolution":{"observed_at":"2026-08-02T05:36:12.034774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:12.098187Z","title":"Apertus: Democratizing open and compliant llms for global language environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.098187Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:fbbad160d0dc9b693832bf54e2f0f5fde39a05c1d0522b6271e129174bc98782","observation_id":"7ef4aba8-3a77-4195-988c-971851eefba3","resolution":{"observed_at":"2026-08-02T05:36:12.098187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-02T05:36:12.170895Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.170895Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:a4c81ea7678a307aa47eca95b307047c878b3b808038b178c7ef6621ba23f022","observation_id":"b862e81c-3465-4979-b439-26aac3f8b66e","resolution":{"observed_at":"2026-08-02T05:36:12.170895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01911","last_updated":"2023-05-09T12:21:58Z","snapshot_observed_at":"2026-07-06T14:58:18.255439Z","submitted_at":"2023-03-03T13:23:42Z","title":"Investigating the Translation Performance of a Large Multilingual Language Model: the Case of BLOOM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01911","snapshot_observed_at":"2026-08-02T05:36:12.280540Z","title":"Investigating the translation performance of a large multilingual language model: the case of bloom.arXiv preprint arXiv:2303.01911, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.280540Z"},"links":{"cited_paper":"/paper/2303.01911","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:4d710c9b2f0da827d767e3b764fdeba8230feb90a14cc6cb117946cd5b6ef3e1","observation_id":"5ee7f332-c4b0-479f-a78b-aa5893c4681c","resolution":{"observed_at":"2026-08-02T05:36:12.280540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:12.396636Z","title":"BLOOM (revision 4ab0472), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.396636Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:8886e2d137c1ebb619e19fc8210ce8cd11212ffb6612ea273188c1ffc57894e8","observation_id":"bd78940f-8849-44fc-b349-50df09e3cddc","resolution":{"observed_at":"2026-08-02T05:36:12.396636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16512","last_updated":"2024-06-25T11:54:23Z","snapshot_observed_at":"2026-08-02T22:26:32.484692Z","submitted_at":"2024-03-25T07:55:29Z","title":"LLMs Are Few-Shot In-Context Low-Resource Language Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16512","snapshot_observed_at":"2026-08-02T05:36:12.506030Z","title":"Llms are few-shot in-context low- resource language learners.arXiv preprint arXiv:2403.16512, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.506030Z"},"links":{"cited_paper":"/paper/2403.16512","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:41023a91c86682169c5d0ad71daa9f5f4c97bdbcc7ec4961f9450e94a439a6df","observation_id":"b0898f9b-d7f8-4cd1-9760-022d9ee9aa8a","resolution":{"observed_at":"2026-08-02T05:36:12.506030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:12.616269Z","title":"Meta-learning via lan- guage model in-context tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.616269Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:f3466fdc79fbaf9b8c591579c1f204250697bb8e5188bea5a72242f31a9ccc4a","observation_id":"b26122b2-55de-4fe1-a2be-f27e8b042cf2","resolution":{"observed_at":"2026-08-02T05:36:12.616269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08688","last_updated":"2023-12-15T01:42:20Z","snapshot_observed_at":"2026-08-02T05:42:38.996354Z","submitted_at":"2023-12-14T07:05:42Z","title":"TigerBot: An Open Multilingual Multitask LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08688","snapshot_observed_at":"2026-08-02T05:36:12.725533Z","title":"Tigerbot: An open multilingual multitask llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.725533Z"},"links":{"cited_paper":"/paper/2312.08688","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:05d1625ce8daf69c1cc7cc7221c177e3d2cb4737b98e12799568f1e289002e25","observation_id":"4e2bc3b5-cf0c-4357-aaab-bbc7062d216d","resolution":{"observed_at":"2026-08-02T05:36:12.725533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-02T05:36:12.800685Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge.arXiv preprint arXiv:1803.05457, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.800685Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:198c74af6a891d98e9eb6d723a4518625a1198ac97937e64cf491f7a90b61485","observation_id":"03de064c-8d93-4a80-b715-038590cd68cb","resolution":{"observed_at":"2026-08-02T05:36:12.800685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12907","last_updated":"2023-05-22T10:40:36Z","snapshot_observed_at":"2026-08-02T17:20:52.419840Z","submitted_at":"2023-05-22T10:40:36Z","title":"Meta-in-context learning in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12907","snapshot_observed_at":"2026-08-02T05:36:12.877028Z","title":"Wang, and Eric Schulz","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.877028Z"},"links":{"cited_paper":"/paper/2305.12907","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:97ffb0507e045689fbad13c23a91406dd8416ebd7c96d34b742fdd5851a8fbf4","observation_id":"b09b8675-8c74-4349-af80-5e706d9d14ae","resolution":{"observed_at":"2026-08-02T05:36:12.877028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-02T05:36:12.981324Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities.arXiv preprint arXiv:2507.06261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:12.981324Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:6e5529df95f1c8cc2407880db0b3542da8f924695ae42cfddefb2509adeeda8e","observation_id":"8f372cca-0619-4d06-b64b-7472d8dc7dbe","resolution":{"observed_at":"2026-08-02T05:36:12.981324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.056728Z","title":"Okapi: Instruction-tuned large language models in multiple languages with reinforcement learning from human feedback.arXiv e-prints, pages arXiv–2307, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.056728Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:c4cc0e51e7f597452d81b3313146a6addac8eb5f4aee65b02ae05d6a58da749f","observation_id":"7f125744-e2a6-4b51-b6a8-640a9b30b4c5","resolution":{"observed_at":"2026-08-02T05:36:13.056728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.165258Z","title":"Evaluating and mitigating linguistic discrimination in large language models: Perspectives on safety equity and knowledge equity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.165258Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:4d7bb3db4b10a8c3d3e9fec7d845880288e6f7e61e33949707107abe03eacaea","observation_id":"791f37b8-4910-46a7-87b1-ca620e11334f","resolution":{"observed_at":"2026-08-02T05:36:13.165258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.243452Z","title":"Rlhf workflow: From reward modeling to online rlhf,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.243452Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:a132590d6946378dc0f9a31eb50bce30e55c7c7d8b2724639c833f61be7f74e8","observation_id":"fe344923-69f3-4e72-9945-ed44a6d066f4","resolution":{"observed_at":"2026-08-02T05:36:13.243452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-02T05:36:13.423156Z","title":"Length-controlled alpacaeval: A simple way to debias automatic evaluators.arXiv preprint arXiv:2404.04475, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.423156Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0854473f8a57a1ec915c7209d42a27c83281109741bad450c5d0d8bd58c03905","observation_id":"8e545401-af02-4696-91e8-24cd4ca7da99","resolution":{"observed_at":"2026-08-02T05:36:13.423156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-02T05:36:13.496199Z","title":"Kto: Model alignment as prospect theoretic optimization.arXiv preprint arXiv:2402.01306, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.496199Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:9ef4d80f9263adf3e6f3201cf045d0833895e748f5a061b1d7335061c8bd4718","observation_id":"01f70ae9-1127-4a5f-a0cd-59b72d21835e","resolution":{"observed_at":"2026-08-02T05:36:13.496199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.588028Z","title":"On the convergence theory of gradient- based model-agnostic meta-learning algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.588028Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:208b5e52349d245441a5791fe8a1f63da499a847630e8d01ee9bf1c0517d1a85","observation_id":"668aa081-a40f-440a-96a7-313f2f862fcf","resolution":{"observed_at":"2026-08-02T05:36:13.588028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.661052Z","title":"Model-agnostic meta-learning for fast adap- tation of deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.661052Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:64a7264d2826a6d64dcd98796ee04c6258d2222864967daf67754d6d8ad70bee","observation_id":"8c9e2753-2239-49c6-adcb-4f2bf0e3433c","resolution":{"observed_at":"2026-08-02T05:36:13.661052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.713861Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.713861Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:8a74df82e01999063c158ec619ee359b212fc7375d9cf559fa510791e87354bd","observation_id":"02e4f11c-e8b8-419a-8c58-fc8201182734","resolution":{"observed_at":"2026-08-02T05:36:13.713861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-02T05:36:13.771522Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.771522Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:f275fef930c964be732cdbc4dbc1935dd1d90f0d1b04b0dffd450e404aec9f52","observation_id":"73f270be-dc13-4393-8342-9a27eb0bb313","resolution":{"observed_at":"2026-08-02T05:36:13.771522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.829866Z","title":"Measuring massive multitask language understanding.Proceedings of the International Conference on Learning Representations (ICLR), 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.829866Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0a8ee68e5eb4398a52794190f166091fa815694a8e7afa7f753e0a2c2309b871","observation_id":"b3c3f426-240c-48eb-8b8a-99a6995c99b8","resolution":{"observed_at":"2026-08-02T05:36:13.829866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.890232Z","title":"Llms as in-context meta-learners for model and hyperparameter selection, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.890232Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:9c6cba8749a96f526d4924d15f6b822fa52da275cb3b26db3f11564c814afa49","observation_id":"47c8e219-4039-439a-992d-f199e86ac3e5","resolution":{"observed_at":"2026-08-02T05:36:13.890232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:13.955285Z","title":"Meta-learning in neural networks: A survey.IEEE transactions on pattern analysis and machine intelligence, 44 (9):5149–5169, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.955285Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:6068efc5305a788333d448e36bc40acf19d9bf881a29882fec3cde9e737e3d9e","observation_id":"dbfbb7a2-e660-4d35-b145-72e6c138010c","resolution":{"observed_at":"2026-08-02T05:36:13.955285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15076","last_updated":"2023-10-20T22:49:24Z","snapshot_observed_at":"2026-07-06T15:32:31.593213Z","submitted_at":"2023-05-24T11:56:20Z","title":"Meta-Learning Online Adaptation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15076","snapshot_observed_at":"2026-08-02T05:36:14.009107Z","title":"Meta-learning online adaptation of language models.arXiv preprint arXiv:2305.15076, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.009107Z"},"links":{"cited_paper":"/paper/2305.15076","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:58baf2c2c33469aa0e144ac23b732975b42765894d9a0783d8194aeee8be5a7d","observation_id":"fff61118-b1c4-45d7-af18-0b0e5857ba3b","resolution":{"observed_at":"2026-08-02T05:36:14.009107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09642","last_updated":"2025-02-24T06:38:13Z","snapshot_observed_at":"2026-08-02T22:39:09.633860Z","submitted_at":"2025-02-10T09:32:08Z","title":"Krutrim LLM: Multilingual Foundational Model for over a Billion People","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09642","snapshot_observed_at":"2026-08-02T05:36:14.074298Z","title":"Krutrim llm: Multilingual foundational model for over a billion people, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.074298Z"},"links":{"cited_paper":"/paper/2502.09642","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:27b3f55f9f80644f2060fd411a0450527a592711acb80ad1d61b75c5499a17d6","observation_id":"a78282be-9c25-4e96-849c-dd5c4ee31059","resolution":{"observed_at":"2026-08-02T05:36:14.074298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.171078Z","title":"Mistral–a journey towards reproducible language model training, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.171078Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:c6cdeebbac777042d761f0fd5f4f1df6949eb603016cdc9d2afcd425baf663dc","observation_id":"54d02ecb-abea-446a-9d2d-7b20c16653a7","resolution":{"observed_at":"2026-08-02T05:36:14.171078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01771","last_updated":"2024-06-03T20:25:12Z","snapshot_observed_at":"2026-07-06T18:24:48.141409Z","submitted_at":"2024-06-03T20:25:12Z","title":"LLMs Beyond English: Scaling the Multilingual Capability of LLMs with Cross-Lingual Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01771","snapshot_observed_at":"2026-08-02T05:36:14.237858Z","title":"Llms beyond english: Scaling the multilingual capability of llms with cross-lingual feedback.arXiv preprint arXiv:2406.01771, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.237858Z"},"links":{"cited_paper":"/paper/2406.01771","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:6e3981f5cf308ad3d121d53663802d890801f5cdaf71319b957ec99d22d6e885","observation_id":"1a16c7e4-f4fd-4c27-b473-80f1851748b3","resolution":{"observed_at":"2026-08-02T05:36:14.237858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.331522Z","title":"Improving in-context learning of multilingual generative language models with cross-lingual alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.331522Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:ffe6b5099a9dd7360f2205f8bcd32638ff102828480dba8a2dd0743bcd9d52c1","observation_id":"e4f11dc6-c188-4784-973f-3377241a6687","resolution":{"observed_at":"2026-08-02T05:36:14.331522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.401895Z","title":"Meta in-context learning makes large language models better zero and few-shot relation extractors,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.401895Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:d7898b578c4689794f8fb09f9517a6db932eb994dd79f1fc3963505b5da4a09a","observation_id":"0171f048-b64a-4755-bc3f-90c030d0cdea","resolution":{"observed_at":"2026-08-02T05:36:14.401895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.547872Z","title":"Congrad: Conflicting gradient filtering for multilingual preference align- ment","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.547872Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:1880636767f61e7634cef3fcdc8edcd40f6bababaec7fee7b844f785039b26da","observation_id":"0bc005ac-2cdc-4506-adbd-650d3e3d796d","resolution":{"observed_at":"2026-08-02T05:36:14.547872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17807","last_updated":"2024-04-27T07:06:39Z","snapshot_observed_at":"2026-07-06T18:06:24.289614Z","submitted_at":"2024-04-27T07:06:39Z","title":"Meta In-Context Learning Makes Large Language Models Better Zero and Few-Shot Relation Extractors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17807","snapshot_observed_at":"2026-08-02T05:36:14.454651Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.454651Z"},"links":{"cited_paper":"/paper/2404.17807","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:9a73c31b305e1a59458943ad2723f4a6f43ca7c77114ee3636125943c5c93d77","observation_id":"84a4f034-7b6d-41f7-aa98-db68561fbf1b","resolution":{"observed_at":"2026-08-02T05:36:14.454651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06914","last_updated":"2024-03-12T15:52:14Z","snapshot_observed_at":"2026-07-06T17:42:45.397241Z","submitted_at":"2024-03-11T17:03:04Z","title":"MEND: Meta dEmonstratioN Distillation for Efficient and Effective In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06914","snapshot_observed_at":"2026-08-02T05:36:14.741718Z","title":"Mend: Meta demonstration distillation for efficient and effective in-context learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.741718Z"},"links":{"cited_paper":"/paper/2403.06914","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:d538bbd73c13e029cd5dacac8bad8555d825203db6cd15110f2ba3a89aabb870","observation_id":"eaef0e02-cb26-4cc7-ada6-c149aa068731","resolution":{"observed_at":"2026-08-02T05:36:14.741718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.679312Z","title":"Language-emphasized cross-lingual in-context learning for multilingual llm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.679312Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:8e5795dc7afbf0184a76139623b7b49ff7ee18678ba4fe3b35902a5e5d039acc","observation_id":"76694aae-860f-42e7-be5f-642ed2147cfa","resolution":{"observed_at":"2026-08-02T05:36:14.679312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.898909Z","title":"Simpo: Simple preference optimization with a reference-free reward.Advances in Neural Information Processing Systems, 37:124198–124235, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.898909Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:7e076da17529fcbe18a39aa11dfac3b6a72b35a44dfe057310d9d3247f6186a8","observation_id":"b254970c-5506-4496-9f17-1c2abf0b110f","resolution":{"observed_at":"2026-08-02T05:36:14.898909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-02T05:36:14.832439Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.832439Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:bd8c28caa436d3fd2644a18994921a8f051ed5c833debf51976994a5aaacbce3","observation_id":"85326a5a-047e-468c-9dc8-1f0d1bed32e0","resolution":{"observed_at":"2026-08-02T05:36:14.832439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.065872Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.065872Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0b6e9213b3bbc308413999c58c3d2df1fe583c3946fc1a59b34f4e29667f6309","observation_id":"db68de96-c3ce-40e6-ad59-890f6cd89f8c","resolution":{"observed_at":"2026-08-02T05:36:15.065872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:14.990916Z","title":"Reward model learning vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:14.990916Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:f0d5bb1000dfcc9458713b9f36c239d1ed12aa83b4cd7507d7ba35134b421a54","observation_id":"85053ee8-46ce-4576-a0ce-3a84d8fc576c","resolution":{"observed_at":"2026-08-02T05:36:14.990916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.179840Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.179840Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0a4f0cbc1dadc8b24ffb88ca25a661263a7bdb5530d7f3f6a8fa0cf42f73a8f6","observation_id":"fee721f8-c723-4745-9e3e-ed26574b3300","resolution":{"observed_at":"2026-08-02T05:36:15.179840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12358","last_updated":"2024-08-12T21:13:35Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:37:02Z","title":"From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12358","snapshot_observed_at":"2026-08-02T05:36:15.114550Z","title":"From r to Q*: Your language model is secretly a q-function.arXiv preprint arXiv:2404.12358, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.114550Z"},"links":{"cited_paper":"/paper/2404.12358","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:49bd1c47ff87e4bc9ff04d21d44e4126620cbb60b2aa7f384d4cb28ae0172634","observation_id":"9447292d-4435-4b0e-b53c-93b3d597264b","resolution":{"observed_at":"2026-08-02T05:36:15.114550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.311747Z","title":"Right now, wrong then: Non-stationary direct preference optimization under preference drift","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.311747Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:be76e17bb3d7c5da1b22e0edbbbede5b231a0a0349c683115ad794ca413b8a00","observation_id":"8fdeeca5-15ed-4667-8713-5cde168f5f0f","resolution":{"observed_at":"2026-08-02T05:36:15.311747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.239541Z","title":"Maml-en-llm: Model agnostic meta-training of llms for improved in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.239541Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:1df5ac835c60441765f7d2ccbcd2baf2b9a2ce84b6a08827658a9d67485444a1","observation_id":"ade80df4-469e-43cb-9b3f-1d019dda5e2c","resolution":{"observed_at":"2026-08-02T05:36:15.239541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00030","last_updated":"2025-07-07T20:24:43Z","snapshot_observed_at":"2026-07-06T20:44:35.837721Z","submitted_at":"2025-02-24T22:43:21Z","title":"RSPO: Regularized Self-Play Alignment of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00030","snapshot_observed_at":"2026-08-02T05:36:15.423449Z","title":"Game-theoretic regularized self-play alignment of large language models.arXiv preprint arXiv:2503.00030, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.423449Z"},"links":{"cited_paper":"/paper/2503.00030","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:56be483333395d2eb8dc71848f6cebc141a05ba504b65d36f144561c6fb55a32","observation_id":"c6df849d-a624-4467-ab32-2e4767dd5460","resolution":{"observed_at":"2026-08-02T05:36:15.423449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.370686Z","title":"Spo: Self preference optimization with self regularization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.370686Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0b1d735ce53b72b3af7b4d5038409458fff652f8dd89fa7365581afe6e53823b","observation_id":"50742d01-a050-4cb1-896c-44018ef59ed5","resolution":{"observed_at":"2026-08-02T05:36:15.370686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-02T05:36:15.680171Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.680171Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:6d91c68983dba5c14a865f8908cb7565f4d1e2ce05ef3e5f9106ae59dc1abf87","observation_id":"9bf61e01-390f-44f2-9695-48ccde926366","resolution":{"observed_at":"2026-08-02T05:36:15.680171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.507286Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.507286Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:d5fdb2e93206b73c5cef3f297fbf28932bda8e5b8ec43744debbebb62aa673d6","observation_id":"3ea7d0a3-5654-46c4-87c5-8ea13b546c1e","resolution":{"observed_at":"2026-08-02T05:36:15.507286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-02T05:36:15.952924Z","title":"Gemma: Open models based on gemini research and technology.arXiv preprint arXiv:2403.08295, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.952924Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:c54546ded1fa0705bd5d2efc1012f11b2af55d4879b507e98de9296039c6bb85","observation_id":"b2b73175-2180-49dc-80c2-bde577431d60","resolution":{"observed_at":"2026-08-02T05:36:15.952924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:15.870422Z","title":"Dai, Anja Hauth, Katie Millican, David Silver, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:15.870422Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:2903d048c53905914698c08433209058df57aa3a66262ff82ca31b7f7ccc3de7","observation_id":"30b0e66a-0b28-468c-aa2a-64046902667b","resolution":{"observed_at":"2026-08-02T05:36:15.870422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-02T05:36:16.059522Z","title":"Gemma 3 technical report.arXiv preprint arXiv:2503.19786, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.059522Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:9c395b493200572cf23e5ae80de06a41b1b39303a2d8729c9a922490cfe68f95","observation_id":"be385503-c9e8-400e-a301-a16f09f45290","resolution":{"observed_at":"2026-08-02T05:36:16.059522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T05:36:16.008896Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.008896Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:bea662860e9736c7eda2ba0fef3a24c51618312517947449909ce2ef99b535cd","observation_id":"46fce1d2-d56d-4d1e-a029-1263bf01a586","resolution":{"observed_at":"2026-08-02T05:36:16.008896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-02T05:36:16.195603Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.195603Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:89a99fae17171584a4ee84639821606d008c8937df5d4ba2808ac9eadb9c7ece","observation_id":"3e965813-8f3b-4596-a684-13ebae63d99e","resolution":{"observed_at":"2026-08-02T05:36:16.195603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08928","last_updated":"2024-10-17T17:58:53Z","snapshot_observed_at":"2026-07-06T19:31:53.397265Z","submitted_at":"2024-10-11T15:53:24Z","title":"Towards Multilingual LLM Evaluation for European Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08928","snapshot_observed_at":"2026-08-02T05:36:16.111549Z","title":"Towards multilingual llm evaluation for european languages.arXiv preprint arXiv:2410.08928, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.111549Z"},"links":{"cited_paper":"/paper/2410.08928","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:cf321ef8c219083481318efc3977341e3fd8551c619992bdaa800a0e1b5bc2b8","observation_id":"f569277c-d9ca-4bcb-9e9d-9225b711a8c0","resolution":{"observed_at":"2026-08-02T05:36:16.111549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:16.347062Z","title":"Performance unfairness of large language models in cross-language fact-checking.Information Processing & Management, 63 (4):104616, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.347062Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:f3afaf607e321edb6c5f3c586d9ecbd905f83a9d5cf4161491682a3084ebb38a","observation_id":"51333ff6-c5d5-4990-a3aa-21fc841a6dd3","resolution":{"observed_at":"2026-08-02T05:36:16.347062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:16.260193Z","title":"Matching networks for one shot learning.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.260193Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:5c2d8e2e04660d652670d4f2e2e4837be561dc32d03fea6e20e9e1ef7f56b3af","observation_id":"1df22fd9-8897-4e5a-961d-870a776e0235","resolution":{"observed_at":"2026-08-02T05:36:16.260193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:16.483653Z","title":"Pangea: A fully open multilingual multimodal llm for 39 languages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.483653Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:cbdfcbbb70546dd61195e79c45f1122fa9b14eaaaab28219393695609cb090fb","observation_id":"684223ad-b5e2-423b-8895-23f299205330","resolution":{"observed_at":"2026-08-02T05:36:16.483653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16216","last_updated":"2026-05-16T18:30:31Z","snapshot_observed_at":"2026-08-02T12:01:06.084117Z","submitted_at":"2024-07-23T06:45:52Z","title":"Reinforcement Learning for LLM Post-Training: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16216","snapshot_observed_at":"2026-08-02T05:36:16.410995Z","title":"A comprehensive survey of llm alignment techniques: Rlhf, rlaif, ppo, dpo and more, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.410995Z"},"links":{"cited_paper":"/paper/2407.16216","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:e6208c430ae61907bb24535518a9bc599371b76bece9fc76a5ded846e23390ba","observation_id":"8da3d815-7164-449f-9afb-35f55a83bc06","resolution":{"observed_at":"2026-08-02T05:36:16.410995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-02T05:36:16.597690Z","title":"Hellaswag: Can a machine really finish your sentence?arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.597690Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:44bb7cf754de7c779b428bc21b25e657e52289b7d938a4448293f91deab8391d","observation_id":"f7751a00-c185-43d9-b02d-8aa291d2a240","resolution":{"observed_at":"2026-08-02T05:36:16.597690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:16.543048Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.543048Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:cde10b3eaa5f9794ec72c9e625a1db78a49c45db26623a97fcafe8d96324ed7a","observation_id":"f39a01b4-4e6e-45ee-80e2-bcef15ad409b","resolution":{"observed_at":"2026-08-02T05:36:16.543048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:16.873054Z","title":"anycross-lingual preprocessing dominates target-only adaptation by a log(RSFTµτ /σ2) factor in adaptation step count","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.873054Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:ad9b620049278855417939dabca1a0ba879d7ba5d454d55eed05701fa7018958","observation_id":"896c10fe-1119-449a-a3de-99e6bfe48471","resolution":{"observed_at":"2026-08-02T05:36:16.873054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:16.686669Z","title":"Ziegler, Nisan Stiennon, Jeffrey Wu, Tom B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.686669Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:0a4be1fe4a609b72d45b9d9b6f5750b5457e7e32fc42423ae759b29e8f4d2ccb","observation_id":"b1d58992-f54d-4c64-be46-62eb162275c0","resolution":{"observed_at":"2026-08-02T05:36:16.686669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:36:17.029024Z","title":"H Impact Statement and Limitations This work proposes a meta-learning approach for LLM preference learning, designed to mitigate the unequal performance across different languages","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:17.029024Z"},"links":{"citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:a52f9408cd7729a725d3a5b48f96a448b1d090f8c4818be60096be819613d9f8","observation_id":"11f66626-ed33-4858-8b14-f6b3857ae188","resolution":{"observed_at":"2026-08-02T05:36:17.029024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-02T05:36:16.761846Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:16.761846Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:8dd30ba3cbf7d69f1c7d8b70d87ff44361f251e4a2273bfc845da03aad850d99","observation_id":"a538b06c-c7a3-4e7e-b90d-e18ec285db67","resolution":{"observed_at":"2026-08-02T05:36:16.761846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-04T06:46:45.395897Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-02T05:36:13.318358Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T05:36:13.318358Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2607.13315"},"observation_digest":"sha256:b8e62569316ef12ca6d2a46729928cdcd894d58d7c81b59e5156144380dfa6f7","observation_id":"7a0a1743-c795-41af-bc21-7d20c71987f4","resolution":{"observed_at":"2026-08-02T05:36:13.318358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13315","last_updated":"2026-07-21T18:05:20Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T06:42:30.450999Z","submitted_at":"2026-07-14T22:38:39Z","title":"Meta-Learning Preferences for Multilingual LLM Alignment"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2607.13315."}