Pith. sign in

Paper Citation Record · LEDGER

Meta-Learning Preferences for Multilingual LLM Alignment

As of 4 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2607.13315.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.13315 v2

Coverage vector

measured 62 of 62 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T05:36:17.029024Z

measured 62 of 62 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-04T06:34:03.388597+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

62 of 62 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved62
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3b11c6ea-5363-4d49-8ca2-652dbba94092 · outbound

This paper cites GPT-4 Technical Report.

Meta-Learning Preferences for Multilingual LLM Alignment GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.034774Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.034774Z digest=sha256:0c2dee0b2725411c27580fa682ea224f1015b4ba337ea88884b78cdc7a7213b8

Observation 7ef4aba8-3a77-4195-988c-971851eefba3 · outbound

This paper cites Apertus: Democratizing open and compliant llms for global language environments, 2025.

Meta-Learning Preferences for Multilingual LLM Alignment Apertus: Democratizing open and compliant llms for global language environments, 2025

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.098187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.098187Z digest=sha256:fbbad160d0dc9b693832bf54e2f0f5fde39a05c1d0522b6271e129174bc98782

Observation b862e81c-3465-4979-b439-26aac3f8b66e · outbound

This paper cites Qwen Technical Report.

Meta-Learning Preferences for Multilingual LLM Alignment Qwen Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.170895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.170895Z digest=sha256:a4c81ea7678a307aa47eca95b307047c878b3b808038b178c7ef6621ba23f022

Observation 5ee7f332-c4b0-479f-a78b-aa5893c4681c · outbound

This paper cites Investigating the Translation Performance of a Large Multilingual Language Model: the Case of BLOOM.

Meta-Learning Preferences for Multilingual LLM Alignment Investigating the Translation Performance of a Large Multilingual Language Model: the Case of BLOOM

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.280540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.280540Z digest=sha256:4d710c9b2f0da827d767e3b764fdeba8230feb90a14cc6cb117946cd5b6ef3e1

Observation bd78940f-8849-44fc-b349-50df09e3cddc · outbound

This paper cites BLOOM (revision 4ab0472), 2022.

Meta-Learning Preferences for Multilingual LLM Alignment BLOOM (revision 4ab0472), 2022

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.396636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.396636Z digest=sha256:8886e2d137c1ebb619e19fc8210ce8cd11212ffb6612ea273188c1ffc57894e8

Observation b0898f9b-d7f8-4cd1-9760-022d9ee9aa8a · outbound

This paper cites LLMs Are Few-Shot In-Context Low-Resource Language Learners.

Meta-Learning Preferences for Multilingual LLM Alignment LLMs Are Few-Shot In-Context Low-Resource Language Learners

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.506030Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.506030Z digest=sha256:41023a91c86682169c5d0ad71daa9f5f4c97bdbcc7ec4961f9450e94a439a6df

Observation b26122b2-55de-4fe1-a2be-f27e8b042cf2 · outbound

This paper cites Meta-learning via lan- guage model in-context tuning.

Meta-Learning Preferences for Multilingual LLM Alignment Meta-learning via lan- guage model in-context tuning

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.616269Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.616269Z digest=sha256:f3466fdc79fbaf9b8c591579c1f204250697bb8e5188bea5a72242f31a9ccc4a

Observation 4e2bc3b5-cf0c-4357-aaab-bbc7062d216d · outbound

This paper cites TigerBot: An Open Multilingual Multitask LLM.

Meta-Learning Preferences for Multilingual LLM Alignment TigerBot: An Open Multilingual Multitask LLM

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.725533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.725533Z digest=sha256:05d1625ce8daf69c1cc7cc7221c177e3d2cb4737b98e12799568f1e289002e25

Observation 03de064c-8d93-4a80-b715-038590cd68cb · outbound

This paper cites Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge.

Meta-Learning Preferences for Multilingual LLM Alignment Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.800685Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.800685Z digest=sha256:198c74af6a891d98e9eb6d723a4518625a1198ac97937e64cf491f7a90b61485

Observation b09b8675-8c74-4349-af80-5e706d9d14ae · outbound

This paper cites Meta-in-context learning in large language models.

Meta-Learning Preferences for Multilingual LLM Alignment Meta-in-context learning in large language models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.877028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.877028Z digest=sha256:97ffb0507e045689fbad13c23a91406dd8416ebd7c96d34b742fdd5851a8fbf4

Observation 8f372cca-0619-4d06-b64b-7472d8dc7dbe · outbound

This paper cites Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities.

Meta-Learning Preferences for Multilingual LLM Alignment Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:12.981324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:12.981324Z digest=sha256:6e5529df95f1c8cc2407880db0b3542da8f924695ae42cfddefb2509adeeda8e

Observation 7f125744-e2a6-4b51-b6a8-640a9b30b4c5 · outbound

This paper cites Okapi: Instruction-tuned large language models in multiple languages with reinforcement learning from human feedback.arXiv e-prints, pages arXiv–2307, 2023.

Meta-Learning Preferences for Multilingual LLM Alignment Okapi: Instruction-tuned large language models in multiple languages with reinforcement learning from human feedback.arXiv e-prints, pages arXiv–2307, 2023

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.056728Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.056728Z digest=sha256:c4cc0e51e7f597452d81b3313146a6addac8eb5f4aee65b02ae05d6a58da749f

Observation 791f37b8-4910-46a7-87b1-ca620e11334f · outbound

This paper cites Evaluating and mitigating linguistic discrimination in large language models: Perspectives on safety equity and knowledge equity.

Meta-Learning Preferences for Multilingual LLM Alignment Evaluating and mitigating linguistic discrimination in large language models: Perspectives on safety equity and knowledge equity

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.165258Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.165258Z digest=sha256:4d7bb3db4b10a8c3d3e9fec7d845880288e6f7e61e33949707107abe03eacaea

Observation fe344923-69f3-4e72-9945-ed44a6d066f4 · outbound

This paper cites Rlhf workflow: From reward modeling to online rlhf,.

Meta-Learning Preferences for Multilingual LLM Alignment Rlhf workflow: From reward modeling to online rlhf,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.243452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.243452Z digest=sha256:a132590d6946378dc0f9a31eb50bce30e55c7c7d8b2724639c833f61be7f74e8

Observation 8e545401-af02-4696-91e8-24cd4ca7da99 · outbound

This paper cites Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators.

Meta-Learning Preferences for Multilingual LLM Alignment Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.423156Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.423156Z digest=sha256:0854473f8a57a1ec915c7209d42a27c83281109741bad450c5d0d8bd58c03905

Observation 01f70ae9-1127-4a5f-a0cd-59b72d21835e · outbound

This paper cites KTO: Model Alignment as Prospect Theoretic Optimization.

Meta-Learning Preferences for Multilingual LLM Alignment KTO: Model Alignment as Prospect Theoretic Optimization

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.496199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.496199Z digest=sha256:9ef4d80f9263adf3e6f3201cf045d0833895e748f5a061b1d7335061c8bd4718

Observation 668aa081-a40f-440a-96a7-313f2f862fcf · outbound

This paper cites On the convergence theory of gradient- based model-agnostic meta-learning algorithms.

Meta-Learning Preferences for Multilingual LLM Alignment On the convergence theory of gradient- based model-agnostic meta-learning algorithms

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.588028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.588028Z digest=sha256:208b5e52349d245441a5791fe8a1f63da499a847630e8d01ee9bf1c0517d1a85

Observation 8c9e2753-2239-49c6-adcb-4f2bf0e3433c · outbound

This paper cites Model-agnostic meta-learning for fast adap- tation of deep networks.

Meta-Learning Preferences for Multilingual LLM Alignment Model-agnostic meta-learning for fast adap- tation of deep networks

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.661052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.661052Z digest=sha256:64a7264d2826a6d64dcd98796ee04c6258d2222864967daf67754d6d8ad70bee

Observation 02e4f11c-e8b8-419a-8c58-fc8201182734 · outbound

This paper cites A general theoretical paradigm to understand learning from human preferences.

Meta-Learning Preferences for Multilingual LLM Alignment A general theoretical paradigm to understand learning from human preferences

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.713861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.713861Z digest=sha256:8a74df82e01999063c158ec619ee359b212fc7375d9cf559fa510791e87354bd

Observation 73f270be-dc13-4393-8342-9a27eb0bb313 · outbound

This paper cites Measuring Massive Multitask Language Understanding.

Meta-Learning Preferences for Multilingual LLM Alignment Measuring Massive Multitask Language Understanding

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.771522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.771522Z digest=sha256:f275fef930c964be732cdbc4dbc1935dd1d90f0d1b04b0dffd450e404aec9f52

Observation b3c3f426-240c-48eb-8b8a-99a6995c99b8 · outbound

This paper cites Measuring massive multitask language understanding.Proceedings of the International Conference on Learning Representations (ICLR), 2021.

Meta-Learning Preferences for Multilingual LLM Alignment Measuring massive multitask language understanding.Proceedings of the International Conference on Learning Representations (ICLR), 2021

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.829866Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.829866Z digest=sha256:0a8ee68e5eb4398a52794190f166091fa815694a8e7afa7f753e0a2c2309b871

Observation 47c8e219-4039-439a-992d-f199e86ac3e5 · outbound

This paper cites Llms as in-context meta-learners for model and hyperparameter selection, 2025.

Meta-Learning Preferences for Multilingual LLM Alignment Llms as in-context meta-learners for model and hyperparameter selection, 2025

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.890232Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.890232Z digest=sha256:9c6cba8749a96f526d4924d15f6b822fa52da275cb3b26db3f11564c814afa49

Observation dbfbb7a2-e660-4d35-b145-72e6c138010c · outbound

This paper cites Meta-learning in neural networks: A survey.IEEE transactions on pattern analysis and machine intelligence, 44 (9):5149–5169, 2021.

Meta-Learning Preferences for Multilingual LLM Alignment Meta-learning in neural networks: A survey.IEEE transactions on pattern analysis and machine intelligence, 44 (9):5149–5169, 2021

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.955285Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.955285Z digest=sha256:6068efc5305a788333d448e36bc40acf19d9bf881a29882fec3cde9e737e3d9e

Observation fff61118-b1c4-45d7-af18-0b0e5857ba3b · outbound

This paper cites Meta-Learning Online Adaptation of Language Models.

Meta-Learning Preferences for Multilingual LLM Alignment Meta-Learning Online Adaptation of Language Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.009107Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.009107Z digest=sha256:58baf2c2c33469aa0e144ac23b732975b42765894d9a0783d8194aeee8be5a7d

Observation a78282be-9c25-4e96-849c-dd5c4ee31059 · outbound

This paper cites Krutrim LLM: Multilingual Foundational Model for over a Billion People.

Meta-Learning Preferences for Multilingual LLM Alignment Krutrim LLM: Multilingual Foundational Model for over a Billion People

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.074298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.074298Z digest=sha256:27b3f55f9f80644f2060fd411a0450527a592711acb80ad1d61b75c5499a17d6

Observation 54d02ecb-abea-446a-9d2d-7b20c16653a7 · outbound

This paper cites Mistral–a journey towards reproducible language model training, 2021.

Meta-Learning Preferences for Multilingual LLM Alignment Mistral–a journey towards reproducible language model training, 2021

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.171078Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.171078Z digest=sha256:c6cdeebbac777042d761f0fd5f4f1df6949eb603016cdc9d2afcd425baf663dc

Observation 1a16c7e4-f4fd-4c27-b473-80f1851748b3 · outbound

This paper cites LLMs Beyond English: Scaling the Multilingual Capability of LLMs with Cross-Lingual Feedback.

Meta-Learning Preferences for Multilingual LLM Alignment LLMs Beyond English: Scaling the Multilingual Capability of LLMs with Cross-Lingual Feedback

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.237858Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.237858Z digest=sha256:6e3981f5cf308ad3d121d53663802d890801f5cdaf71319b957ec99d22d6e885

Observation e4f11dc6-c188-4784-973f-3377241a6687 · outbound

This paper cites Improving in-context learning of multilingual generative language models with cross-lingual alignment.

Meta-Learning Preferences for Multilingual LLM Alignment Improving in-context learning of multilingual generative language models with cross-lingual alignment

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.331522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.331522Z digest=sha256:ffe6b5099a9dd7360f2205f8bcd32638ff102828480dba8a2dd0743bcd9d52c1

Observation 0171f048-b64a-4755-bc3f-90c030d0cdea · outbound

This paper cites Meta in-context learning makes large language models better zero and few-shot relation extractors,.

Meta-Learning Preferences for Multilingual LLM Alignment Meta in-context learning makes large language models better zero and few-shot relation extractors,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.401895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.401895Z digest=sha256:d7898b578c4689794f8fb09f9517a6db932eb994dd79f1fc3963505b5da4a09a

Observation 0bc005ac-2cdc-4506-adbd-650d3e3d796d · outbound

This paper cites Congrad: Conflicting gradient filtering for multilingual preference align- ment.

Meta-Learning Preferences for Multilingual LLM Alignment Congrad: Conflicting gradient filtering for multilingual preference align- ment

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.547872Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.547872Z digest=sha256:1880636767f61e7634cef3fcdc8edcd40f6bababaec7fee7b844f785039b26da

Observation 84a4f034-7b6d-41f7-aa98-db68561fbf1b · outbound

This paper cites Meta In-Context Learning Makes Large Language Models Better Zero and Few-Shot Relation Extractors.

Meta-Learning Preferences for Multilingual LLM Alignment Meta In-Context Learning Makes Large Language Models Better Zero and Few-Shot Relation Extractors

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.454651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.454651Z digest=sha256:9a73c31b305e1a59458943ad2723f4a6f43ca7c77114ee3636125943c5c93d77

Observation eaef0e02-cb26-4cc7-ada6-c149aa068731 · outbound

This paper cites MEND: Meta dEmonstratioN Distillation for Efficient and Effective In-Context Learning.

Meta-Learning Preferences for Multilingual LLM Alignment MEND: Meta dEmonstratioN Distillation for Efficient and Effective In-Context Learning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.741718Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.741718Z digest=sha256:d538bbd73c13e029cd5dacac8bad8555d825203db6cd15110f2ba3a89aabb870

Observation 76694aae-860f-42e7-be5f-642ed2147cfa · outbound

This paper cites Language-emphasized cross-lingual in-context learning for multilingual llm.

Meta-Learning Preferences for Multilingual LLM Alignment Language-emphasized cross-lingual in-context learning for multilingual llm

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.679312Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.679312Z digest=sha256:8e5795dc7afbf0184a76139623b7b49ff7ee18678ba4fe3b35902a5e5d039acc

Observation b254970c-5506-4496-9f17-1c2abf0b110f · outbound

This paper cites Simpo: Simple preference optimization with a reference-free reward.Advances in Neural Information Processing Systems, 37:124198–124235, 2024.

Meta-Learning Preferences for Multilingual LLM Alignment Simpo: Simple preference optimization with a reference-free reward.Advances in Neural Information Processing Systems, 37:124198–124235, 2024

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.898909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.898909Z digest=sha256:7e076da17529fcbe18a39aa11dfac3b6a72b35a44dfe057310d9d3247f6186a8

Observation 85326a5a-047e-468c-9dc8-1f0d1bed32e0 · outbound

This paper cites DeepSeek-V3 Technical Report.

Meta-Learning Preferences for Multilingual LLM Alignment DeepSeek-V3 Technical Report

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.832439Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.832439Z digest=sha256:bd8c28caa436d3fd2644a18994921a8f051ed5c833debf51976994a5aaacbce3

Observation db68de96-c3ce-40e6-ad59-890f6cd89f8c · outbound

This paper cites Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022.

Meta-Learning Preferences for Multilingual LLM Alignment Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.065872Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.065872Z digest=sha256:0b6e9213b3bbc308413999c58c3d2df1fe583c3946fc1a59b34f4e29667f6309

Observation 85053ee8-46ce-4576-a0ce-3a84d8fc576c · outbound

This paper cites Reward model learning vs.

Meta-Learning Preferences for Multilingual LLM Alignment Reward model learning vs

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:14.990916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:14.990916Z digest=sha256:f0d5bb1000dfcc9458713b9f36c239d1ed12aa83b4cd7507d7ba35134b421a54

Observation fee721f8-c723-4745-9e3e-ed26574b3300 · outbound

This paper cites Direct preference optimization: Your language model is secretly a reward model.

Meta-Learning Preferences for Multilingual LLM Alignment Direct preference optimization: Your language model is secretly a reward model

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.179840Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.179840Z digest=sha256:0a4f0cbc1dadc8b24ffb88ca25a661263a7bdb5530d7f3f6a8fa0cf42f73a8f6

Observation 9447292d-4435-4b0e-b53c-93b3d597264b · outbound

This paper cites From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function.

Meta-Learning Preferences for Multilingual LLM Alignment From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.114550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.114550Z digest=sha256:49bd1c47ff87e4bc9ff04d21d44e4126620cbb60b2aa7f384d4cb28ae0172634

Observation 8fdeeca5-15ed-4667-8713-5cde168f5f0f · outbound

This paper cites Right now, wrong then: Non-stationary direct preference optimization under preference drift.

Meta-Learning Preferences for Multilingual LLM Alignment Right now, wrong then: Non-stationary direct preference optimization under preference drift

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.311747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.311747Z digest=sha256:be76e17bb3d7c5da1b22e0edbbbede5b231a0a0349c683115ad794ca413b8a00

Observation ade80df4-469e-43cb-9b3f-1d019dda5e2c · outbound

This paper cites Maml-en-llm: Model agnostic meta-training of llms for improved in-context learning.

Meta-Learning Preferences for Multilingual LLM Alignment Maml-en-llm: Model agnostic meta-training of llms for improved in-context learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.239541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.239541Z digest=sha256:1df5ac835c60441765f7d2ccbcd2baf2b9a2ce84b6a08827658a9d67485444a1

Observation c6df849d-a624-4467-ab32-2e4767dd5460 · outbound

This paper cites RSPO: Regularized Self-Play Alignment of Large Language Models.

Meta-Learning Preferences for Multilingual LLM Alignment RSPO: Regularized Self-Play Alignment of Large Language Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.423449Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.423449Z digest=sha256:56be483333395d2eb8dc71848f6cebc141a05ba504b65d36f144561c6fb55a32

Observation 50742d01-a050-4cb1-896c-44018ef59ed5 · outbound

This paper cites Spo: Self preference optimization with self regularization.

Meta-Learning Preferences for Multilingual LLM Alignment Spo: Self preference optimization with self regularization

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.370686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.370686Z digest=sha256:0b1d735ce53b72b3af7b4d5038409458fff652f8dd89fa7365581afe6e53823b

Observation 9bf61e01-390f-44f2-9695-48ccde926366 · outbound

This paper cites Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.

Meta-Learning Preferences for Multilingual LLM Alignment Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.680171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.680171Z digest=sha256:6d91c68983dba5c14a865f8908cb7565f4d1e2ce05ef3e5f9106ae59dc1abf87

Observation 3ea7d0a3-5654-46c4-87c5-8ea13b546c1e · outbound

This paper cites Hashimoto.

Meta-Learning Preferences for Multilingual LLM Alignment Hashimoto

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.507286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.507286Z digest=sha256:d5fdb2e93206b73c5cef3f297fbf28932bda8e5b8ec43744debbebb62aa673d6

Observation b2b73175-2180-49dc-80c2-bde577431d60 · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

Meta-Learning Preferences for Multilingual LLM Alignment Gemma: Open Models Based on Gemini Research and Technology

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.952924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.952924Z digest=sha256:c54546ded1fa0705bd5d2efc1012f11b2af55d4879b507e98de9296039c6bb85

Observation 30b0e66a-0b28-468c-aa2a-64046902667b · outbound

This paper cites Dai, Anja Hauth, Katie Millican, David Silver, et al.

Meta-Learning Preferences for Multilingual LLM Alignment Dai, Anja Hauth, Katie Millican, David Silver, et al

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:15.870422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:15.870422Z digest=sha256:2903d048c53905914698c08433209058df57aa3a66262ff82ca31b7f7ccc3de7

Observation be385503-c9e8-400e-a301-a16f09f45290 · outbound

This paper cites Gemma 3 Technical Report.

Meta-Learning Preferences for Multilingual LLM Alignment Gemma 3 Technical Report

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.059522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.059522Z digest=sha256:9c395b493200572cf23e5ae80de06a41b1b39303a2d8729c9a922490cfe68f95

Observation 46fce1d2-d56d-4d1e-a029-1263bf01a586 · outbound

This paper cites Gemma 2: Improving Open Language Models at a Practical Size.

Meta-Learning Preferences for Multilingual LLM Alignment Gemma 2: Improving Open Language Models at a Practical Size

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.008896Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.008896Z digest=sha256:bea662860e9736c7eda2ba0fef3a24c51618312517947449909ce2ef99b535cd

Observation 3e965813-8f3b-4596-a684-13ebae63d99e · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Meta-Learning Preferences for Multilingual LLM Alignment Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.195603Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.195603Z digest=sha256:89a99fae17171584a4ee84639821606d008c8937df5d4ba2808ac9eadb9c7ece

Observation f569277c-d9ca-4bcb-9e9d-9225b711a8c0 · outbound

This paper cites Towards Multilingual LLM Evaluation for European Languages.

Meta-Learning Preferences for Multilingual LLM Alignment Towards Multilingual LLM Evaluation for European Languages

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.111549Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.111549Z digest=sha256:cf321ef8c219083481318efc3977341e3fd8551c619992bdaa800a0e1b5bc2b8

Observation 51333ff6-c5d5-4990-a3aa-21fc841a6dd3 · outbound

This paper cites Performance unfairness of large language models in cross-language fact-checking.Information Processing & Management, 63 (4):104616, 2026.

Meta-Learning Preferences for Multilingual LLM Alignment Performance unfairness of large language models in cross-language fact-checking.Information Processing & Management, 63 (4):104616, 2026

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.347062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.347062Z digest=sha256:f3afaf607e321edb6c5f3c586d9ecbd905f83a9d5cf4161491682a3084ebb38a

Observation 1df22fd9-8897-4e5a-961d-870a776e0235 · outbound

This paper cites Matching networks for one shot learning.Advances in neural information processing systems, 29, 2016.

Meta-Learning Preferences for Multilingual LLM Alignment Matching networks for one shot learning.Advances in neural information processing systems, 29, 2016

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.260193Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.260193Z digest=sha256:5c2d8e2e04660d652670d4f2e2e4837be561dc32d03fea6e20e9e1ef7f56b3af

Observation 684223ad-b5e2-423b-8895-23f299205330 · outbound

This paper cites Pangea: A fully open multilingual multimodal llm for 39 languages.

Meta-Learning Preferences for Multilingual LLM Alignment Pangea: A fully open multilingual multimodal llm for 39 languages

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.483653Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.483653Z digest=sha256:cbdfcbbb70546dd61195e79c45f1122fa9b14eaaaab28219393695609cb090fb

Observation 8da3d815-7164-449f-9afb-35f55a83bc06 · outbound

This paper cites Reinforcement Learning for LLM Post-Training: A Survey.

Meta-Learning Preferences for Multilingual LLM Alignment Reinforcement Learning for LLM Post-Training: A Survey

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.410995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.410995Z digest=sha256:e6208c430ae61907bb24535518a9bc599371b76bece9fc76a5ded846e23390ba

Observation f7751a00-c185-43d9-b02d-8aa291d2a240 · outbound

This paper cites HellaSwag: Can a Machine Really Finish Your Sentence?.

Meta-Learning Preferences for Multilingual LLM Alignment HellaSwag: Can a Machine Really Finish Your Sentence?

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.597690Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.597690Z digest=sha256:44bb7cf754de7c779b428bc21b25e657e52289b7d938a4448293f91deab8391d

Observation f39a01b4-4e6e-45ee-80e2-bcef15ad409b · outbound

This paper cites an unresolved cited work.

Meta-Learning Preferences for Multilingual LLM Alignment Unresolved cited work

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.543048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.543048Z digest=sha256:cde10b3eaa5f9794ec72c9e625a1db78a49c45db26623a97fcafe8d96324ed7a

Observation 896c10fe-1119-449a-a3de-99e6bfe48471 · outbound

This paper cites anycross-lingual preprocessing dominates target-only adaptation by a log(RSFTµτ /σ2) factor in adaptation step count.

Meta-Learning Preferences for Multilingual LLM Alignment anycross-lingual preprocessing dominates target-only adaptation by a log(RSFTµτ /σ2) factor in adaptation step count

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.873054Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.873054Z digest=sha256:ad9b620049278855417939dabca1a0ba879d7ba5d454d55eed05701fa7018958

Observation b1d58992-f54d-4c64-be46-62eb162275c0 · outbound

This paper cites Ziegler, Nisan Stiennon, Jeffrey Wu, Tom B.

Meta-Learning Preferences for Multilingual LLM Alignment Ziegler, Nisan Stiennon, Jeffrey Wu, Tom B

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.686669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.686669Z digest=sha256:0a4be1fe4a609b72d45b9d9b6f5750b5457e7e32fc42423ae759b29e8f4d2ccb

Observation 11f66626-ed33-4858-8b14-f6b3857ae188 · outbound

This paper cites H Impact Statement and Limitations This work proposes a meta-learning approach for LLM preference learning, designed to mitigate the unequal performance across different languages.

Meta-Learning Preferences for Multilingual LLM Alignment H Impact Statement and Limitations This work proposes a meta-learning approach for LLM preference learning, designed to mitigate the unequal performance across different languages

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:17.029024Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:17.029024Z digest=sha256:a52f9408cd7729a725d3a5b48f96a448b1d090f8c4818be60096be819613d9f8

Observation a538b06c-c7a3-4e7e-b90d-e18ec285db67 · outbound

This paper cites Fine-Tuning Language Models from Human Preferences.

Meta-Learning Preferences for Multilingual LLM Alignment Fine-Tuning Language Models from Human Preferences

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:16.761846Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:16.761846Z digest=sha256:8dd30ba3cbf7d69f1c7d8b70d87ff44361f251e4a2273bfc845da03aad850d99

Observation 7a0a1743-c795-41af-bc21-7d20c71987f4 · outbound

This paper cites RLHF Workflow: From Reward Modeling to Online RLHF.

Meta-Learning Preferences for Multilingual LLM Alignment RLHF Workflow: From Reward Modeling to Online RLHF

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-02T05:36:13.318358Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:36:13.318358Z digest=sha256:b8e62569316ef12ca6d2a46729928cdcd894d58d7c81b59e5156144380dfa6f7

Pith citing papers

No inbound Pith citation observations are available.