Pith. sign in

Paper Citation Record · LEDGER

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning

As of 12 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2608.04322.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.04322 v1

Coverage vector

measured 59 of 59 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-08T19:50:15.253942Z

measured 59 of 59 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

59 of 59 outbound references displayed

  • verified exact3
  • verified fuzzy27
  • unresolved29
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ede7eb1e-2ebd-4b11-b03c-cdeda2ed7aba · outbound

This paper cites Building efficient llm pipeline for human mobility prediction,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Building efficient llm pipeline for human mobility prediction,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.157857Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.009085Z digest=sha256:61733dd4c89ac5f44ebd7ccc7d343f8d8ff13df14ee75366d6d3fcc3cdc81f88

Observation 2d3f0f8b-18d4-4182-b285-44266bc2cb77 · outbound

This paper cites Bridging cross-domain time series: Efficient federated anomaly detection with sharded llms,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Bridging cross-domain time series: Efficient federated anomaly detection with sharded llms,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.146282Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.015816Z digest=sha256:ddf4b8a49f65f44930a70e287c75eb4c98abb7b0ddc5c88302676af3b3b16082

Observation 5d2e7d07-8b7f-4ff6-9f8a-5e97ddfd1b91 · outbound

This paper cites Llm-based agents for tool learning: A survey: W. xu et al.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Llm-based agents for tool learning: A survey: W. xu et al

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.135204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.022144Z digest=sha256:b2512c68985b0e2e73d43d9b54992a3d8a2658f2a5e949df63b74d774f909470

Observation c0d9f272-7e66-42bc-95b5-6a0f33dcefe9 · outbound

This paper cites The Llama 3 Herd of Models.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning The Llama 3 Herd of Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.029741Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.029741Z digest=sha256:b9d2cb779638c558ee2dc861a93b9b4e221b427897d0c3d33e50e60c6ca72f1a

Observation 8c4b4fba-5046-4de3-876f-f0654a22b7e8 · outbound

This paper cites GPT-4 Technical Report.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning GPT-4 Technical Report

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.035326Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.035326Z digest=sha256:2da3b83295c455bf8b2c83fd55a51e1423fba4a87888966cd8b4ba8f2f27ef33

Observation 97372d2a-2e31-4503-846b-75016a9de8a3 · outbound

This paper cites Fine-tuning aligned language models compromises safety, even when users do not intend to!.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Fine-tuning aligned language models compromises safety, even when users do not intend to!

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.123946Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.041847Z digest=sha256:f8eaded973602feff0f15ce521bdbbf8af8a8c7f699a9db987d4409f4ddf263f

Observation 0287c279-0082-472c-89f2-e46aae1685dc · outbound

This paper cites DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-08T19:50:15.602753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.046836Z digest=sha256:784a93adbde228a780ee9cbef1dde61edf7612c434cdc836dca0cf0235046979

Observation f82586f1-c961-46f9-b575-70ffd598de90 · outbound

This paper cites Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.112466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.052063Z digest=sha256:302e5dab9c3995028e99d65c7f63093ed6615ffd0d2b8ef58bb0516ff17678e5

Observation a1a7f071-8163-4f7b-8354-4c25523fe0c1 · outbound

This paper cites Token-Level Adversarial Prompt Detection Based on Perplexity Measures and Contextual Information.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Token-Level Adversarial Prompt Detection Based on Perplexity Measures and Contextual Information

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.056191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.056191Z digest=sha256:d18595d249cc9ae9445f885371c8e63eae241159d93ac4f5cf73f08cd1718cb3

Observation 282e8089-3475-4bd4-a3a1-d5ff724a041a · outbound

This paper cites Rain: Your lan- guage models can align themselves without finetuning,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Rain: Your lan- guage models can align themselves without finetuning,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.099998Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.060982Z digest=sha256:645366868c2016e23bd34d050df3b76182f06eb46d2410770aabff64f3279adf

Observation bb8e0288-2564-4a1a-a35c-8fd606399a92 · outbound

This paper cites Exploring the limits of transfer learning with a unified text- to-text transformer,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Exploring the limits of transfer learning with a unified text- to-text transformer,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.086836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.066047Z digest=sha256:3c6eb734fd4eb5ac14f025d82bbae82993d15de4fddc5dff10685f949477ff90

Observation 99cc662a-38de-4887-abb6-c439eb293ad7 · outbound

This paper cites Data to defense: The role of curation in aligning large language models against safety compromise,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Data to defense: The role of curation in aligning large language models against safety compromise,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.074277Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.070181Z digest=sha256:07d3ac68c8dfadffbc95598030033362f2cac0f21d0c633d9920856d17ec7729

Observation a2b2f045-40ce-4126-8495-f822fbc3cef2 · outbound

This paper cites Do as i do (safely): Mitigating task-specific fine-tuning risks in large language models,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Do as i do (safely): Mitigating task-specific fine-tuning risks in large language models,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.061823Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.074317Z digest=sha256:9f2a8aba786c1c5c86b81313dde9cbac64662e1e237ff41a31ccdc2622d7156e

Observation 49728abb-74f6-4903-819a-16874fc50af7 · outbound

This paper cites Self-distillation bridges distribution gap in language model fine-tuning,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Self-distillation bridges distribution gap in language model fine-tuning,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.048290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.078251Z digest=sha256:7c6218add7919390075044bae87d8c9906d78d8deffa9151f0cc784a2a3563b0

Observation e2f9a78f-cb20-4b03-bf11-f48aaff53758 · outbound

This paper cites Gr-sap: Generative replay for safety alignment preservation during fine-tuning,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Gr-sap: Generative replay for safety alignment preservation during fine-tuning,

Reference 15

Resolution
verified exact
raw_fallback, observed 2026-08-08T19:50:15.574314Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.081893Z digest=sha256:3a31d18a35c6ecd2b006a394e51fdf5fc3cafc81234a635be38200d4e601d209

Observation 856de00e-ac12-446d-ad60-e4535f873b10 · outbound

This paper cites Aegis2. 0: A diverse ai safety dataset and risks taxonomy for alignment of llm guardrails,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Aegis2. 0: A diverse ai safety dataset and risks taxonomy for alignment of llm guardrails,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.036137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.085726Z digest=sha256:3ff4943453c87f944a56f4fc4a2a7e23e6ffe5af627d878dcf5dfa07dd921287

Observation bb6143f5-def2-4cf7-9eed-c72cf85f80a8 · outbound

This paper cites Beavertails: Towards improved safety alignment of llm via a human-preference dataset,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Beavertails: Towards improved safety alignment of llm via a human-preference dataset,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.089677Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.089677Z digest=sha256:8ad1da200c76564960c4e32b8a44fed242dc59c685f7a60ca8396a87b3a074d4

Observation 52085dd5-c107-49f4-a7c0-a47c03b4d58c · outbound

This paper cites Seal: Safety-enhanced aligned llm fine-tuning via bilevel data selection,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Seal: Safety-enhanced aligned llm fine-tuning via bilevel data selection,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.016374Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.093336Z digest=sha256:f52d64a6b6045b8e30779dad930de848f4fe1a482657df6c9a8bedbc7943839c

Observation bb2c16bd-77a1-493e-a106-132c1f1b1a4c · outbound

This paper cites How to fine-tune safely on a budget: Model adaptation using minimal resources,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning How to fine-tune safely on a budget: Model adaptation using minimal resources,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:16.004373Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.097400Z digest=sha256:cc914bfac5bba0d7f5d9f1b7165f423eb119894894de631d880b0295674c29e1

Observation efc88d86-58f0-4edf-8127-e9de532ab98c · outbound

This paper cites Sft doesn’t always hurt general capa- bilities: Revisiting domain-specific fine-tuning in llms,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Sft doesn’t always hurt general capa- bilities: Revisiting domain-specific fine-tuning in llms,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.991154Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.101067Z digest=sha256:17bc764e0a0740a6b6ebf99bce8b69cbb39c6f3636f16aec5273d70608927696

Observation 10067674-662b-4d9f-80a9-3ad601bc34d4 · outbound

This paper cites Robust estimation of a location parameter,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Robust estimation of a location parameter,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.104566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.104566Z digest=sha256:f4a4261c494293f67cdc32d87b68896b87adb9abb6d142a156cf0ec57ed8ce4f

Observation 10fac990-baec-4717-a253-bc93f4c1951a · outbound

This paper cites Refusal in language models is mediated by a single direction,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Refusal in language models is mediated by a single direction,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.108314Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.108314Z digest=sha256:4e97f6a8da8121ea8cb19c61d72dab1ff657cf805b30fc9db56e23ab1f569f8a

Observation 04c92b93-e049-41ab-9bbb-31d60e0a7c6b · outbound

This paper cites On the role of attention heads in large language model safety,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning On the role of attention heads in large language model safety,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.964302Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.112168Z digest=sha256:a9160bbca8002f605c32dff4eeaea849a7443ef616b443c23707047ff6adcb85

Observation bf6a8b26-ca37-46e9-a627-d9468adaf58d · outbound

This paper cites Detoxifying large language models via knowledge editing,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Detoxifying large language models via knowledge editing,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.116100Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.116100Z digest=sha256:9ee8f74072dbc13ffecc65a85066674c8221180081c1523b4995faf3afb2427c

Observation 3fc71a3f-41c6-40bb-b87d-2526b71024ac · outbound

This paper cites Qwen2.5 technical report,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Qwen2.5 technical report,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.119651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.119651Z digest=sha256:69764e0ff57f214b23bfd6710806712ef30914130c2987990faf0f36cb9e73b4

Observation 6e41c3ac-c160-4933-ae47-0e801c8f2c4a · outbound

This paper cites Mistral 7B.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Mistral 7B

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.128956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.128956Z digest=sha256:af8667f377105e0d7f1b5aff8769e0cfbec107b8518e1987c9e7ca45b6aaa729

Observation 16bc581b-92a1-4641-bcf0-38af3c2ca40f · outbound

This paper cites Lora: Low-rank adaptation of large language models.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Lora: Low-rank adaptation of large language models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.133391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.133391Z digest=sha256:ee5cda64b2484f0c4bb7419f892b28a200977b8c3c6ab2ddfebcd25ae330f93b

Observation b74c4885-775a-4251-b399-a5081eb2f955 · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Training Verifiers to Solve Math Word Problems

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.137395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.137395Z digest=sha256:96a57d7226ce027fdb7ea6b3feea5bd4343539343bf1982a168b702e1e45cc49

Observation 2520fb44-43b5-4ea2-9354-7bd347ebbc87 · outbound

This paper cites Measuring Mathematical Problem Solving With the MATH Dataset.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Measuring Mathematical Problem Solving With the MATH Dataset

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.141589Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.141589Z digest=sha256:6be4815f039636b8ddefb14895e3ff27cfc73786835e455ed42df53a1750ba88

Observation eafbabfa-15c1-4d67-b42b-2aec46879386 · outbound

This paper cites Hellaswag: Can a machine really finish your sentence?.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Hellaswag: Can a machine really finish your sentence?

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.927442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.145728Z digest=sha256:9a619208a3fa9a1accae56edf176d74a9e07d4f1935f872484f4957a81dcf923

Observation ee5fd9e2-2378-45e6-ad49-cb831ba52253 · outbound

This paper cites Winogrande: An adversarial winograd schema challenge at scale,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Winogrande: An adversarial winograd schema challenge at scale,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.912820Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.149927Z digest=sha256:96b224513a09257d83b8ce9ae92c815f1aa085f54e1b1767ec065f0d4eea1101

Observation 89afc98b-2b23-4325-98ef-aeb02bb0c663 · outbound

This paper cites What disease does this patient have? a large-scale open domain question answering dataset from medical exams,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning What disease does this patient have? a large-scale open domain question answering dataset from medical exams,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.153854Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.153854Z digest=sha256:824911f4a39960bcc517dc675dd36a4006fd3cce316167dbe4bc182ef099365d

Observation 54e2bc5b-5ea6-4b7e-80e7-3bf9232663eb · outbound

This paper cites Magicoder: Empow- ering code generation with oss-instruct,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Magicoder: Empow- ering code generation with oss-instruct,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.788995Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.157641Z digest=sha256:d30dac59893d529aaa9dea607e3b6cf71d87150a84418e6162c7011fbf4e2405

Observation 4f27a165-e706-4775-b889-9cf1309dd501 · outbound

This paper cites Multilingual Contextualization of Large Language Models for Document-Level Machine Translation.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Multilingual Contextualization of Large Language Models for Document-Level Machine Translation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.161704Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.161704Z digest=sha256:8e5cef7b7f26c3e36a6bf3c3022cc634d2eb56c4216a8a42ab6f3c00d2898541

Observation c1b7f325-168c-40ba-b6fe-cdc58d6f2c37 · outbound

This paper cites Improving alignment and robustness with circuit breakers,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Improving alignment and robustness with circuit breakers,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.776548Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.165694Z digest=sha256:e4bd7127ba729ee1f34dab3ff624bd2c0f930b16d79d51e438fbf44fd9546a5d

Observation 1310ed45-023d-4a06-a01f-8f5df5bbfc86 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Evaluating Large Language Models Trained on Code

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.169586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.169586Z digest=sha256:c5838f5fc3bc59fc3c629c677fc8e6037a6dc1af7dc86481389dd78902825c36

Observation 9289b51d-c48d-4b98-99c0-3b0954c77665 · outbound

This paper cites Comet-22: Unbabel-ist 2022 submission for the metrics shared task,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Comet-22: Unbabel-ist 2022 submission for the metrics shared task,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.173479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.173479Z digest=sha256:7f4e05e315f32790c0719189c32c3fb7e9942abf3065b7d6f7ac0728c3e056a1

Observation b1f4950e-e1cc-4f39-bcf9-6d21fc1ad03b · outbound

This paper cites Keeping llms aligned after fine-tuning: The crucial role of prompt templates,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Keeping llms aligned after fine-tuning: The crucial role of prompt templates,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.755390Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.177301Z digest=sha256:92c4e3dcb76ceff604a41f03e38c21e8b99f5417764a744893c98ecb47d8fdf1

Observation 8cfa8100-aad8-4f9a-9fd5-d52c2df098a6 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.180920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.180920Z digest=sha256:5ee828eb22e02e384cb703706998ca6818aadaca677f2020cbaf6988ac3a5866

Observation 69bb505a-fcc7-4ce2-beef-2f2e1f9a5537 · outbound

This paper cites Long Is More for Alignment: A Simple but Tough-to-Beat Baseline for Instruction Fine-Tuning.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Long Is More for Alignment: A Simple but Tough-to-Beat Baseline for Instruction Fine-Tuning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.184715Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.184715Z digest=sha256:4d487c3f197b16604ede5bedd4a35f611b7f364bf344c32e992e334802377b38

Observation 54a37acd-daa6-41f9-b947-67cf6ae4100d · outbound

This paper cites Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.188479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.188479Z digest=sha256:146fc14474679fc3ab5e2a23b89ecafb37b49d9843760d94439a1ecbb5883da0

Observation e1b61469-20ae-4026-b92e-d5e0fcd6ffcc · outbound

This paper cites Qwen3Guard Technical Report.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Qwen3Guard Technical Report

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.192300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.192300Z digest=sha256:76e33d9fcac94e26452db1ce9605c28de3294a5d9756463a51278b084031e49e

Observation 50ad6453-1e80-44a4-a106-8ab206d0176a · outbound

This paper cites Sentence-bert: Sentence embeddings using siamese bert-networks,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Sentence-bert: Sentence embeddings using siamese bert-networks,

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.196272Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.196272Z digest=sha256:e676bdf3fb6daa1d7679e8c9da08f5e4e1f1400f52a102a66aa9625cd3525cb6

Observation d4d37f24-17c6-4c0f-ad53-57ccff928826 · outbound

This paper cites Safety alignment should be made more than just a few tokens deep,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Safety alignment should be made more than just a few tokens deep,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.726043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.199840Z digest=sha256:7c7e54e7e5fa22e2daae4fa29bf1dc41d2b87fa44d06ff17515bac90942cc6c2

Observation 3ffffe55-5aa0-42f3-bfbd-8fff0073dcb2 · outbound

This paper cites XSTest: A test suite for identifying exaggerated safety behaviours in large language models,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning XSTest: A test suite for identifying exaggerated safety behaviours in large language models,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.711865Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.203683Z digest=sha256:f402158647b064e79811ac796ab05014c14386ef31dd22e2c596e9760bc25be9

Observation f4d99faf-93ae-4fc5-aeb4-fb364d86aad1 · outbound

This paper cites Understanding and mitigating over-refusal for large language models via safety repre- sentation,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Understanding and mitigating over-refusal for large language models via safety repre- sentation,

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.207361Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.207361Z digest=sha256:588f048464f6a2af0a0a5f23b3c2ace3019d65eb81fa1bfc9c9f7a52019fe2b5

Observation 33d16471-aab7-42a6-8382-bcbd2c3dba12 · outbound

This paper cites Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMs.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMs

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.211198Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.211198Z digest=sha256:8013e6225fd2320ba6716048dd9d67334f9cbb118213f9e9fc6ba29ce2daddd6

Observation 45ddc7bc-f261-4441-b39d-4d6388fab244 · outbound

This paper cites Lima: Less is more for alignment,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Lima: Less is more for alignment,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.214962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.214962Z digest=sha256:0767d2dd0670bd9296c14c7106a2afbcfd4d29c350724ec45f945202631ddd72

Observation 07c1fedf-96c5-43ef-9fc5-89fe4228b569 · outbound

This paper cites LIMO: Less is More for Reasoning.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning LIMO: Less is More for Reasoning

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.218577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.218577Z digest=sha256:4233421f0e4e2e8c9f560998f698adf1b087c3e0ee704559f6c8c622b4982b05

Observation d2b259ac-8cb2-40dd-b823-be0175f804db · outbound

This paper cites s1: Simple test-time scaling,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning s1: Simple test-time scaling,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.223370Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.223370Z digest=sha256:de9b76038d77fbfe2e247b79d31f227f6fa53d74ccef3fdaa0b2753954fca78b

Observation 4d49cc6e-f695-41fd-83a6-424c0e8ccd0f · outbound

This paper cites Hint Tuning: Less Data Makes Better Reasoners.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Hint Tuning: Less Data Makes Better Reasoners

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-08T19:50:15.311031Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.227049Z digest=sha256:8589140b8cc50215a2c81a190e3ced826309c5e15d01290a4eba7b9f50adebed

Observation cf5225a8-e380-4600-b76c-751e2b839a28 · outbound

This paper cites Redagent: an autonomous agent for context-aware red teaming of llm jailbreaks,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Redagent: an autonomous agent for context-aware red teaming of llm jailbreaks,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.683177Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.231170Z digest=sha256:d318fb40b3b90bab483a199ae3b302c5db57309d497f193212cfdac227dfc3dc

Observation 8cfc0a3c-be0c-4900-b766-c6bf5c558ffd · outbound

This paper cites A multi- stage adversarial framework for compact and effective jailbreaking of large language models,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning A multi- stage adversarial framework for compact and effective jailbreaking of large language models,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.671733Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.234828Z digest=sha256:303b48048763c5f6471cf14bd103d7e3d6f31bbb17b0288f2002cbff48c6aec9

Observation 4780560a-8ddb-41e2-b206-a2d8b37a5bb7 · outbound

This paper cites Do we really need curated malicious data for safety alignment in multi-modal large language models?.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Do we really need curated malicious data for safety alignment in multi-modal large language models?

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.660027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.238486Z digest=sha256:3198cfb746b68b06e877105163448f685f167711be1224c83d369a241c6f3700

Observation 7fe74e83-2e95-43ec-9480-94b123eadfe4 · outbound

This paper cites Why LLM Safety Guardrails Collapse After Fine-tuning: A Similarity Analysis Between Alignment and Fine-tuning Datasets.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Why LLM Safety Guardrails Collapse After Fine-tuning: A Similarity Analysis Between Alignment and Fine-tuning Datasets

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.242121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.242121Z digest=sha256:812b20c7f119c586fdee648ee0a7a95ab8262111b8e9e7d2eebf7c91dab27596

Observation 838fbc03-bb5e-41dd-9b5c-50d51258a7a6 · outbound

This paper cites Safechain: Safety of language models with long chain- of-thought reasoning capabilities,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Safechain: Safety of language models with long chain- of-thought reasoning capabilities,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.647907Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.246208Z digest=sha256:5ab8be631fdf4329b570a988ae0b95e70529f55618d0396dac04844a2b6402c9

Observation c7aa985f-b60f-4c15-88ee-45169301cad7 · outbound

This paper cites Star-1: Safer alignment of reasoning llms with 1k data,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Star-1: Safer alignment of reasoning llms with 1k data,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:50:15.636372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-08T19:50:15.249936Z digest=sha256:8e5e9cadc02f5a58309119a82f5bf735e64f972c73ee60fa9ac81d9ea6db9f17

Observation 44acff21-1932-49b3-86ca-c71167c466ff · outbound

This paper cites Unsafechain: Enhancing reasoning model safety via hard cases,.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Unsafechain: Enhancing reasoning model safety via hard cases,

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.253942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.253942Z digest=sha256:1e8bf67c4c8b025676c50f8d45d3b13e446524f46a2501bceea8055ad2e51e9a

Observation 4863d180-36a8-43dc-b549-4aedada1668c · outbound

This paper cites Qwen2.5 Technical Report.

DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning Qwen2.5 Technical Report

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-08T19:50:15.123673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:50:15.123673Z digest=sha256:3ecc616c319feab6db4549ec1608225b03cbdba12fe3c8adb024b73975d1a381

Pith citing papers

No inbound Pith citation observations are available.