{"as_of":"2026-08-10T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa5d6b6a6172f464a4bf5926523862e05e73cf78da2ebef6db1e9af148140f1e","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:50:15.253942Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04322/citation-record","integrity":"/paper/2608.04322/integrity","json":"/paper/2608.04322/citation-record.json","paper":"/paper/2608.04322"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.153981Z","title":"Building efficient llm pipeline for human mobility prediction,","venue":null,"work_id":"ecfaf2b7-606b-4f6c-ba16-a1882ef17924","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.009085Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:7bf8a21c4466a6ca3535568e1b315ca434098ef3d3cf647d1eecd64965f8ec86","observation_id":"ede7eb1e-2ebd-4b11-b03c-cdeda2ed7aba","resolution":{"observed_at":"2026-08-08T19:50:16.157857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.142320Z","title":"Bridging cross-domain time series: Efficient federated anomaly detection with sharded llms,","venue":null,"work_id":"c0f9ad45-69f5-4536-b2d1-078b0e4d2c07","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.015816Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:da5cf73662f90fdc737be5c7a035e4fefd427a70e53feb39735147c20c90aa71","observation_id":"2d3f0f8b-18d4-4182-b285-44266bc2cb77","resolution":{"observed_at":"2026-08-08T19:50:16.146282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.131301Z","title":"Llm-based agents for tool learning: A survey: W. xu et al","venue":null,"work_id":"36e2f307-356e-450d-b0d4-7dd50f4bec7e","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.022144Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:9f9928c0599af2e8de800004681ac591fae5b6980dc56db4db9683bdf1f0225a","observation_id":"5d2e7d07-8b7f-4ff6-9f8a-5e97ddfd1b91","resolution":{"observed_at":"2026-08-08T19:50:16.135204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T19:50:15.029741Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.029741Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:b9d2cb779638c558ee2dc861a93b9b4e221b427897d0c3d33e50e60c6ca72f1a","observation_id":"c0d9f272-7e66-42bc-95b5-6a0f33dcefe9","resolution":{"observed_at":"2026-08-08T19:50:15.029741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T19:50:15.035326Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.035326Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:2da3b83295c455bf8b2c83fd55a51e1423fba4a87888966cd8b4ba8f2f27ef33","observation_id":"8c4b4fba-5046-4de3-876f-f0654a22b7e8","resolution":{"observed_at":"2026-08-08T19:50:15.035326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.119776Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to!","venue":null,"work_id":"8a4797c2-6358-43f5-b4ed-cfd0e63b0845","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.041847Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:a70929db34f261c427e26f5903da4fc39019c54ea70c313708e263e5e049439e","observation_id":"97372d2a-2e31-4503-846b-75016a9de8a3","resolution":{"observed_at":"2026-08-08T19:50:16.123946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00160","last_updated":"2026-05-29T09:04:27Z","snapshot_observed_at":"2026-08-02T07:42:30.512493Z","submitted_at":"2026-05-29T09:04:27Z","title":"DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2606.00160","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.00160","snapshot_observed_at":"2026-08-08T19:50:15.598439Z","title":"DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning","venue":"cs.CR","work_id":"ff8199bc-dd76-4180-8116-f7c2c3801605","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.046836Z"},"links":{"cited_paper":"/paper/2606.00160","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:24b9203327065e55a7f6e231029b5b8097dbacd0fc9054997be91a5a1eb6fe1b","observation_id":"0287c279-0082-472c-89f2-e46aae1685dc","resolution":{"observed_at":"2026-08-08T19:50:15.602753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.108371Z","title":"Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions,","venue":null,"work_id":"4f0fde47-ce68-4908-b16a-edda48df4ccd","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.052063Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:63ebb944ac78519c32d2d828efc8ab8138ef6428bba15d51933336b7a8d70665","observation_id":"f82586f1-c961-46f9-b575-70ffd598de90","resolution":{"observed_at":"2026-08-08T19:50:16.112466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11509","last_updated":"2024-02-18T06:04:27Z","snapshot_observed_at":"2026-08-10T07:10:22.134647Z","submitted_at":"2023-11-20T03:17:21Z","title":"Token-Level Adversarial Prompt Detection Based on Perplexity Measures and Contextual Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11509","snapshot_observed_at":"2026-08-08T19:50:15.056191Z","title":"Token-level adversarial prompt detection based on perplexity measures and contextual information,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.056191Z"},"links":{"cited_paper":"/paper/2311.11509","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:d18595d249cc9ae9445f885371c8e63eae241159d93ac4f5cf73f08cd1718cb3","observation_id":"a1a7f071-8163-4f7b-8354-4c25523fe0c1","resolution":{"observed_at":"2026-08-08T19:50:15.056191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.095488Z","title":"Rain: Your lan- guage models can align themselves without finetuning,","venue":null,"work_id":"4be86792-5954-471d-b2bd-8f56329653a3","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.060982Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:1be1637b6b2f84e4a800ce201e492944b307a47fb1b02ec0ecbdd57adaf4a818","observation_id":"282e8089-3475-4bd4-a3a1-d5ff724a041a","resolution":{"observed_at":"2026-08-08T19:50:16.099998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.082575Z","title":"Exploring the limits of transfer learning with a unified text- to-text transformer,","venue":null,"work_id":"516d16be-0ec5-4bd3-8035-7e34378f5097","year":2020},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.066047Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:d3f9bdd1e200dab1ede09c2c1371092be3823cd3b55a458cfdb63c322131c12d","observation_id":"bb8e0288-2564-4a1a-a35c-8fd606399a92","resolution":{"observed_at":"2026-08-08T19:50:16.086836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.069999Z","title":"Data to defense: The role of curation in aligning large language models against safety compromise,","venue":null,"work_id":"84061b23-7267-4b51-b99a-16a0e62fe573","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.070181Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:c47ae9e5e6ec0ed000c7f76908131d72fe8d5cb3bd700a3ada36529be409c992","observation_id":"99cc662a-38de-4887-abb6-c439eb293ad7","resolution":{"observed_at":"2026-08-08T19:50:16.074277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.056978Z","title":"Do as i do (safely): Mitigating task-specific fine-tuning risks in large language models,","venue":null,"work_id":"da9e87ab-5279-42d4-80d8-24d921e7757b","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.074317Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:55716cf5dfff54a05d327f671ce53a2ab39c9477e226cdfb3d1a626a962dccf7","observation_id":"a2b2f045-40ce-4126-8495-f822fbc3cef2","resolution":{"observed_at":"2026-08-08T19:50:16.061823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.043984Z","title":"Self-distillation bridges distribution gap in language model fine-tuning,","venue":null,"work_id":"a51afb30-e21f-44d7-bb80-4a1876a87920","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.078251Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:f850523be69d3fdd0bcdae2ccd70e47ee9e5cd77b40a1bc2df878498347c1c00","observation_id":"49728abb-74f6-4903-819a-16874fc50af7","resolution":{"observed_at":"2026-08-08T19:50:16.048290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.10243","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.568759Z","title":"Gr-sap: Generative replay for safety alignment preservation during fine-tuning,","venue":null,"work_id":"1606b757-4a70-4ad5-a240-1c53c9ac0371","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.081893Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:91d7754af21df644be653cc5c8502b35e60368fabc9873def84d8841f18269a5","observation_id":"e2f9a78f-cb20-4b03-bf11-f48aaff53758","resolution":{"observed_at":"2026-08-08T19:50:15.574314Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.031957Z","title":"Aegis2. 0: A diverse ai safety dataset and risks taxonomy for alignment of llm guardrails,","venue":null,"work_id":"9241766c-51a2-4fd8-8c93-e6da993f2eb9","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.085726Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:792e90a5fb646a6e785a86a8bc3a2c986c2fb58e41ef74bf4756e61acfa396c0","observation_id":"856de00e-ac12-446d-ad60-e4535f873b10","resolution":{"observed_at":"2026-08-08T19:50:16.036137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.089677Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.089677Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:8ad1da200c76564960c4e32b8a44fed242dc59c685f7a60ca8396a87b3a074d4","observation_id":"bb6143f5-def2-4cf7-9eed-c72cf85f80a8","resolution":{"observed_at":"2026-08-08T19:50:15.089677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:16.012313Z","title":"Seal: Safety-enhanced aligned llm fine-tuning via bilevel data selection,","venue":null,"work_id":"0968d09b-7cbe-4cc5-9d5c-70df4afd8404","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.093336Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:aba7c06bb42ffa011802d2c3341d4a4952269911d503fb173046c0252e37e670","observation_id":"52085dd5-c107-49f4-a7c0-a47c03b4d58c","resolution":{"observed_at":"2026-08-08T19:50:16.016374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.999719Z","title":"How to fine-tune safely on a budget: Model adaptation using minimal resources,","venue":null,"work_id":"5adeade8-fe2c-4cab-afb7-f27e6c3a7bd5","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.097400Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:b87aaff1a02218502f0ea953a6514b3b5ef2920022e1a7fb0a7245397df60264","observation_id":"bb2c16bd-77a1-493e-a106-132c1f1b1a4c","resolution":{"observed_at":"2026-08-08T19:50:16.004373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.986833Z","title":"Sft doesn’t always hurt general capa- bilities: Revisiting domain-specific fine-tuning in llms,","venue":null,"work_id":"9a870283-810e-4bb0-b6cd-4d9e9108033c","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.101067Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:219a420f7c81d5d3190eab465d4420cf1aab39e3eb518a9d2b05ea6595d192b9","observation_id":"efc88d86-58f0-4edf-8127-e9de532ab98c","resolution":{"observed_at":"2026-08-08T19:50:15.991154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.104566Z","title":"Robust estimation of a location parameter,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.104566Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:f4a4261c494293f67cdc32d87b68896b87adb9abb6d142a156cf0ec57ed8ce4f","observation_id":"10067674-662b-4d9f-80a9-3ad601bc34d4","resolution":{"observed_at":"2026-08-08T19:50:15.104566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.108314Z","title":"Refusal in language models is mediated by a single direction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.108314Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:4e97f6a8da8121ea8cb19c61d72dab1ff657cf805b30fc9db56e23ab1f569f8a","observation_id":"10fac990-baec-4717-a253-bc93f4c1951a","resolution":{"observed_at":"2026-08-08T19:50:15.108314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.959691Z","title":"On the role of attention heads in large language model safety,","venue":null,"work_id":"552bed40-da04-472c-9ced-58e09c228d6b","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.112168Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:3817664960b48bf90b268f7e068f510406f05a7e5c44eea83f5d113f4efbcac6","observation_id":"04c92b93-e049-41ab-9bbb-31d60e0a7c6b","resolution":{"observed_at":"2026-08-08T19:50:15.964302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.116100Z","title":"Detoxifying large language models via knowledge editing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.116100Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:9ee8f74072dbc13ffecc65a85066674c8221180081c1523b4995faf3afb2427c","observation_id":"bf6a8b26-ca37-46e9-a627-d9468adaf58d","resolution":{"observed_at":"2026-08-08T19:50:15.116100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.119651Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.119651Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:69764e0ff57f214b23bfd6710806712ef30914130c2987990faf0f36cb9e73b4","observation_id":"3fc71a3f-41c6-40bb-b87d-2526b71024ac","resolution":{"observed_at":"2026-08-08T19:50:15.119651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T19:50:15.128956Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.128956Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:af8667f377105e0d7f1b5aff8769e0cfbec107b8518e1987c9e7ca45b6aaa729","observation_id":"6e41c3ac-c160-4933-ae47-0e801c8f2c4a","resolution":{"observed_at":"2026-08-08T19:50:15.128956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.133391Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.133391Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:ee5cda64b2484f0c4bb7419f892b28a200977b8c3c6ab2ddfebcd25ae330f93b","observation_id":"16bc581b-92a1-4641-bcf0-38af3c2ca40f","resolution":{"observed_at":"2026-08-08T19:50:15.133391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T19:50:15.137395Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.137395Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:96a57d7226ce027fdb7ea6b3feea5bd4343539343bf1982a168b702e1e45cc49","observation_id":"b74c4885-775a-4251-b399-a5081eb2f955","resolution":{"observed_at":"2026-08-08T19:50:15.137395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-08T19:50:15.141589Z","title":"Measuring mathematical problem solving with the math dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.141589Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:6be4815f039636b8ddefb14895e3ff27cfc73786835e455ed42df53a1750ba88","observation_id":"2520fb44-43b5-4ea2-9354-7bd347ebbc87","resolution":{"observed_at":"2026-08-08T19:50:15.141589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.922679Z","title":"Hellaswag: Can a machine really finish your sentence?","venue":null,"work_id":"43a2f788-244e-497d-801a-98a9786dd6cd","year":2019},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.145728Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:5ee1b31e1372cc56b7e09397c885504c66bb6d33ea89c7da67edcce3188dad99","observation_id":"eafbabfa-15c1-4d67-b42b-2aec46879386","resolution":{"observed_at":"2026-08-08T19:50:15.927442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.908627Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":"4e187e4c-de64-4399-88dd-e9bdfdbb88be","year":2020},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.149927Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:12c3b8592a8062126083e28331afbd6463555ce66d705991fa12c09c196cbe0c","observation_id":"ee5fd9e2-2378-45e6-ad49-cb831ba52253","resolution":{"observed_at":"2026-08-08T19:50:15.912820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.153854Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.153854Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:824911f4a39960bcc517dc675dd36a4006fd3cce316167dbe4bc182ef099365d","observation_id":"89afc98b-2b23-4325-98ef-aeb02bb0c663","resolution":{"observed_at":"2026-08-08T19:50:15.153854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.784853Z","title":"Magicoder: Empow- ering code generation with oss-instruct,","venue":null,"work_id":"125d73f5-417d-4601-943e-b86d9d1e49dc","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.157641Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:a1f733e172bdcd0f5e7589dc7b7d3733e816d398fc9a7f344c9f87b3dbde05cb","observation_id":"54e2bc5b-5ea6-4b7e-80e7-3bf9232663eb","resolution":{"observed_at":"2026-08-08T19:50:15.788995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12140","last_updated":"2025-08-28T14:32:15Z","snapshot_observed_at":"2026-08-07T16:01:45.740217Z","submitted_at":"2025-04-16T14:52:22Z","title":"Multilingual Contextualization of Large Language Models for Document-Level Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12140","snapshot_observed_at":"2026-08-08T19:50:15.161704Z","title":"Multi- lingual contextualization of large language models for document-level machine translation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.161704Z"},"links":{"cited_paper":"/paper/2504.12140","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:8e5cef7b7f26c3e36a6bf3c3022cc634d2eb56c4216a8a42ab6f3c00d2898541","observation_id":"4f27a165-e706-4775-b889-9cf1309dd501","resolution":{"observed_at":"2026-08-08T19:50:15.161704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.772351Z","title":"Improving alignment and robustness with circuit breakers,","venue":null,"work_id":"e24c6a2c-4b84-4791-bf5d-e69a6bf434bc","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.165694Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:3dc471dad0bc56fd541ad72e72735765f63d4b0f3c410cdb3d3f5bd627ae05c5","observation_id":"c1b7f325-168c-40ba-b6fe-cdc58d6f2c37","resolution":{"observed_at":"2026-08-08T19:50:15.776548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T19:50:15.169586Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.169586Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:c5838f5fc3bc59fc3c629c677fc8e6037a6dc1af7dc86481389dd78902825c36","observation_id":"1310ed45-023d-4a06-a01f-8f5df5bbfc86","resolution":{"observed_at":"2026-08-08T19:50:15.169586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.173479Z","title":"Comet-22: Unbabel-ist 2022 submission for the metrics shared task,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.173479Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:7f4e05e315f32790c0719189c32c3fb7e9942abf3065b7d6f7ac0728c3e056a1","observation_id":"9289b51d-c48d-4b98-99c0-3b0954c77665","resolution":{"observed_at":"2026-08-08T19:50:15.173479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.751144Z","title":"Keeping llms aligned after fine-tuning: The crucial role of prompt templates,","venue":null,"work_id":"42374108-48d2-4025-94ce-e8ebcaf5b6ea","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.177301Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:7f57bbfc97996608665d0eeedc35ee3e08add74d75a3eea0c637eb0ccef75493","observation_id":"b1f4950e-e1cc-4f39-bcf9-6d21fc1ad03b","resolution":{"observed_at":"2026-08-08T19:50:15.755390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-08T19:50:15.180920Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.180920Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:5ee828eb22e02e384cb703706998ca6818aadaca677f2020cbaf6988ac3a5866","observation_id":"8cfa8100-aad8-4f9a-9fd5-d52c2df098a6","resolution":{"observed_at":"2026-08-08T19:50:15.180920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04833","last_updated":"2024-06-04T17:20:01Z","snapshot_observed_at":"2026-08-08T18:55:36.672628Z","submitted_at":"2024-02-07T13:32:11Z","title":"Long Is More for Alignment: A Simple but Tough-to-Beat Baseline for Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04833","snapshot_observed_at":"2026-08-08T19:50:15.184715Z","title":"Long is more for alignment: A simple but tough-to-beat baseline for instruction fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.184715Z"},"links":{"cited_paper":"/paper/2402.04833","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:68152a6d74284bd30e6496e3e31dfa9bc4792e554eb17efd3328f84828c2e6ce","observation_id":"69bb505a-fcc7-4ce2-beef-2f2e1f9a5537","resolution":{"observed_at":"2026-08-08T19:50:15.184715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.188479Z","title":"Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.188479Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:146fc14474679fc3ab5e2a23b89ecafb37b49d9843760d94439a1ecbb5883da0","observation_id":"54a37acd-daa6-41f9-b947-67cf6ae4100d","resolution":{"observed_at":"2026-08-08T19:50:15.188479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14276","last_updated":"2025-10-16T04:00:18Z","snapshot_observed_at":"2026-07-06T22:32:47.087967Z","submitted_at":"2025-10-16T04:00:18Z","title":"Qwen3Guard Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.14276","snapshot_observed_at":"2026-08-08T19:50:15.192300Z","title":"Qwen3guard technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.192300Z"},"links":{"cited_paper":"/paper/2510.14276","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:76e33d9fcac94e26452db1ce9605c28de3294a5d9756463a51278b084031e49e","observation_id":"e1b61469-20ae-4026-b92e-d5e0fcd6ffcc","resolution":{"observed_at":"2026-08-08T19:50:15.192300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.196272Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.196272Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:e676bdf3fb6daa1d7679e8c9da08f5e4e1f1400f52a102a66aa9625cd3525cb6","observation_id":"50ad6453-1e80-44a4-a106-8ab206d0176a","resolution":{"observed_at":"2026-08-08T19:50:15.196272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.721473Z","title":"Safety alignment should be made more than just a few tokens deep,","venue":null,"work_id":"2f5cc4dd-e69a-427d-9816-5baf6afbb725","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.199840Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:4a5e25390e490c55971e245cfbb71316763eae0ff26265e8be44b6f7ad8cb18c","observation_id":"d4d37f24-17c6-4c0f-ad53-57ccff928826","resolution":{"observed_at":"2026-08-08T19:50:15.726043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.707202Z","title":"XSTest: A test suite for identifying exaggerated safety behaviours in large language models,","venue":null,"work_id":"3488bbc2-cf3f-4e7f-9a91-b41f8ebf6e4e","year":2024},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.203683Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:1fff442c85fdc544b7040a665649481b4407dde5e29b6d3227e8ced9b962f8ec","observation_id":"3ffffe55-5aa0-42f3-bfbd-8fff0073dcb2","resolution":{"observed_at":"2026-08-08T19:50:15.711865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.207361Z","title":"Understanding and mitigating over-refusal for large language models via safety repre- sentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.207361Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:588f048464f6a2af0a0a5f23b3c2ace3019d65eb81fa1bfc9c9f7a52019fe2b5","observation_id":"f4d99faf-93ae-4fc5-aeb4-fb364d86aad1","resolution":{"observed_at":"2026-08-08T19:50:15.207361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16831","last_updated":"2026-05-16T02:05:58Z","snapshot_observed_at":"2026-08-06T13:03:08.046974Z","submitted_at":"2025-05-22T16:02:10Z","title":"Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16831","snapshot_observed_at":"2026-08-08T19:50:15.211198Z","title":"Un- learning isn’t deletion: Investigating reversibility of machine unlearning in llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.211198Z"},"links":{"cited_paper":"/paper/2505.16831","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:98007841e5bbfaf81dee268cd64429c83517ce48d26ce9b6efdebea8a0284ca3","observation_id":"33d16471-aab7-42a6-8382-bcbd2c3dba12","resolution":{"observed_at":"2026-08-08T19:50:15.211198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.214962Z","title":"Lima: Less is more for alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.214962Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:0767d2dd0670bd9296c14c7106a2afbcfd4d29c350724ec45f945202631ddd72","observation_id":"45ddc7bc-f261-4441-b39d-4d6388fab244","resolution":{"observed_at":"2026-08-08T19:50:15.214962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-08T19:50:15.218577Z","title":"Limo: Less is more for reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.218577Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:4233421f0e4e2e8c9f560998f698adf1b087c3e0ee704559f6c8c622b4982b05","observation_id":"07c1fedf-96c5-43ef-9fc5-89fe4228b569","resolution":{"observed_at":"2026-08-08T19:50:15.218577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.223370Z","title":"s1: Simple test-time scaling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.223370Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:de9b76038d77fbfe2e247b79d31f227f6fa53d74ccef3fdaa0b2753954fca78b","observation_id":"d2b259ac-8cb2-40dd-b823-be0175f804db","resolution":{"observed_at":"2026-08-08T19:50:15.223370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08665","last_updated":"2026-06-03T08:11:51Z","snapshot_observed_at":"2026-07-06T23:20:52.521341Z","submitted_at":"2026-05-09T04:07:16Z","title":"Hint Tuning: Less Data Makes Better Reasoners","version":2},"cited_work":{"arxiv_id":"2605.08665","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08665","snapshot_observed_at":"2026-08-08T19:50:15.304578Z","title":"Hint Tuning: Less Data Makes Better Reasoners","venue":"cs.CL","work_id":"f845c240-f5f1-4f8a-8302-fcd914c7f9fc","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.227049Z"},"links":{"cited_paper":"/paper/2605.08665","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:94774fcd0c51a6fbd5e12c921fda71d1a215ca454d8c9e4a768c9da45f640b4f","observation_id":"4d49cc6e-f695-41fd-83a6-424c0e8ccd0f","resolution":{"observed_at":"2026-08-08T19:50:15.311031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.679187Z","title":"Redagent: an autonomous agent for context-aware red teaming of llm jailbreaks,","venue":null,"work_id":"89aa1d60-d4f4-42a8-ac4c-5ddac1db3d8f","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.231170Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:97889d5a7c516a30087e854501df190a3d767773f0beab2c7245bcdbc55735f0","observation_id":"cf5225a8-e380-4600-b76c-751e2b839a28","resolution":{"observed_at":"2026-08-08T19:50:15.683177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.667754Z","title":"A multi- stage adversarial framework for compact and effective jailbreaking of large language models,","venue":null,"work_id":"3048d659-62ed-4a86-a5a8-a46bdffa1ee5","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.234828Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:87e748d3011273d73ed4801527411cb6704ac4fb74de86f88013573cfef57e7f","observation_id":"8cfc0a3c-be0c-4900-b766-c6bf5c558ffd","resolution":{"observed_at":"2026-08-08T19:50:15.671733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.656099Z","title":"Do we really need curated malicious data for safety alignment in multi-modal large language models?","venue":null,"work_id":"309de209-54af-4ebd-83a7-6a855a8a464d","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.238486Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:7932f3269d4a1e39a431f6efc6bb6a2a4678cd0e57821789b8f5b68a9a6b508e","observation_id":"4780560a-8ddb-41e2-b206-a2d8b37a5bb7","resolution":{"observed_at":"2026-08-08T19:50:15.660027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05346","last_updated":"2025-06-05T17:59:55Z","snapshot_observed_at":"2026-08-07T10:18:48.845047Z","submitted_at":"2025-06-05T17:59:55Z","title":"Why LLM Safety Guardrails Collapse After Fine-tuning: A Similarity Analysis Between Alignment and Fine-tuning Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05346","snapshot_observed_at":"2026-08-08T19:50:15.242121Z","title":"Why llm safety guardrails collapse after fine-tuning: A similarity analysis between alignment and fine-tuning datasets,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.242121Z"},"links":{"cited_paper":"/paper/2506.05346","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:812b20c7f119c586fdee648ee0a7a95ab8262111b8e9e7d2eebf7c91dab27596","observation_id":"7fe74e83-2e95-43ec-9480-94b123eadfe4","resolution":{"observed_at":"2026-08-08T19:50:15.242121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.643907Z","title":"Safechain: Safety of language models with long chain- of-thought reasoning capabilities,","venue":null,"work_id":"b9eb17a3-f234-43fd-8e0b-9c3ac468095b","year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.246208Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:09889d351c414049066b4851c58b26eb6731f679a27a47ce57b47fb266480135","observation_id":"838fbc03-bb5e-41dd-9b5c-50d51258a7a6","resolution":{"observed_at":"2026-08-08T19:50:15.647907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.632338Z","title":"Star-1: Safer alignment of reasoning llms with 1k data,","venue":null,"work_id":"282e9605-7a98-4159-ad55-c3dfa8a9992f","year":2026},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.249936Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:bc714bbe4bdf365ddcdbe37e09b21fe5581e5aec6aa3a48c76e477c7cfcb1a40","observation_id":"c7aa985f-b60f-4c15-88ee-45169301cad7","resolution":{"observed_at":"2026-08-08T19:50:15.636372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:50:15.253942Z","title":"Unsafechain: Enhancing reasoning model safety via hard cases,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.253942Z"},"links":{"citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:1e8bf67c4c8b025676c50f8d45d3b13e446524f46a2501bceea8055ad2e51e9a","observation_id":"44acff21-1932-49b3-86ca-c71167c466ff","resolution":{"observed_at":"2026-08-08T19:50:15.253942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-08T19:50:15.123673Z","title":"Available: https://arxiv.org/abs/2412.15115","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T19:50:15.123673Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.04322"},"observation_digest":"sha256:3ecc616c319feab6db4549ec1608225b03cbdba12fe3c8adb024b73975d1a381","observation_id":"4863d180-36a8-43dc-b549-4aedada1668c","resolution":{"observed_at":"2026-08-08T19:50:15.123673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04322","last_updated":"2026-08-05T01:05:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T02:39:54.853744Z","submitted_at":"2026-08-05T01:05:13Z","title":"DataRx: Missingness-Aware Sampling for Safer Large Language Model Task-Specific Fine-Tuning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":3,"verified_fuzzy":27},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2608.04322."}