Pith. sign in

Paper Citation Record · LEDGER

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models

As of 1 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2606.25442.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.25442 v1

Coverage vector

measured 59 of 59 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-25T21:09:19.727723Z

measured 59 of 59 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-01T06:32:01.292127+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

59 of 59 outbound references displayed

  • verified exact5
  • verified fuzzy0
  • unresolved32
  • parse uncertain1
  • malformed identifier0
  • metadata mismatch21

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ef2b4891-04f4-4c96-a460-7e69a64d9593 · outbound

This paper cites A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment

Reference 1

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.706686Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:69312ca81e431d7b7fe616db60ddc0d0670ed47674c5672453ff17e8be16fd35

Observation 38dfe6e5-ba1c-4977-afac-63d06655746c · outbound

This paper cites Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:40:06.724811Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:5e3bbc5474cfc7171511f61c83b9d4caffa752bb898a4b0ffdfe2bd177d5e54d

Observation 00540679-92bc-4eb7-90b0-b319da0f40a2 · outbound

This paper cites A comprehensive survey on the trustworthiness of large language models in healthcare.arXiv preprint arXiv:2502.15871, 4.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models A comprehensive survey on the trustworthiness of large language models in healthcare.arXiv preprint arXiv:2502.15871, 4

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:40:06.719993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:b3291c5cab7d702cf0fbe99e699aca501a72f0afbfa16e24acef8a59dcb73081

Observation ee84a894-fcc4-4c2f-8167-c6393d390948 · outbound

This paper cites Learning to Conceal Risk: Controllable Multi-turn Red Teaming for LLMs in the Financial Domain.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Learning to Conceal Risk: Controllable Multi-turn Red Teaming for LLMs in the Financial Domain

Reference 4

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.714835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:6c0a63febd843f3f3e1fc708e37a8a6e8be59fa7784a4055da0976b8a203bbce

Observation 2b841dd2-ce3d-42d2-bb37-1935f1511398 · outbound

This paper cites A Survey on Large Language Models for Critical Societal Domains: Finance, Healthcare, and Law.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models A Survey on Large Language Models for Critical Societal Domains: Finance, Healthcare, and Law

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.717399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:a1ce048ed4ea383caf0812dd625b9dcbcd71c22acebfef43b47028d1240e2624

Observation 16bbce05-05dd-469f-a85c-eaa325940e29 · outbound

This paper cites Finetuned Language Models Are Zero-Shot Learners.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Finetuned Language Models Are Zero-Shot Learners

Reference 6

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.727529Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:39c697587d6137c36967e252a4350d2a80d1482dfe21b531dfea5ee5b025ddb5

Observation 30042e0e-8060-4138-b776-f01763a18085 · outbound

This paper cites Advances in neural information processing systems , volume=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Advances in neural information processing systems , volume=

Reference 7

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:6433cf244fb3e61008fa243ee95e16d69cda93e69f6ad2c09c4243ded2bd9b91

Observation 063af3bb-64f1-4ef0-9510-da9ca0dc6c30 · outbound

This paper cites Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback

Reference 8

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.730995Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:ec68a95091c9e4a2fdf3aa417e07fd948e977c43ba1a21c8d44155c97ce637f5

Observation 33869db0-c45f-4fc3-8ac6-24afb875e31e · outbound

This paper cites Advances in neural information processing systems , volume=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Advances in neural information processing systems , volume=

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:73b944a947c4574458388cb78364cb06bd4c81930b16067c6d0f591a2025f092

Observation 0eb0da7c-0746-4fe1-bd1b-b1ec72a2ccec · outbound

This paper cites Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:40:06.734341Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:2639eee1b6750ce7279c5bfae564be8a1b4113f4236f9a2cd67621557c6a270f

Observation 9ed7fa22-9d02-43eb-8973-42746823784a · outbound

This paper cites Advances in neural information processing systems , volume=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Advances in neural information processing systems , volume=

Reference 11

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:533e29955470fc9980f8a6c19749d2111c7eec1bcf51d89622d129fc37d40ff3

Observation b12d7ace-971e-4ab8-b91e-aeaccb56cfc6 · outbound

This paper cites 2023 , number =.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2023 , number =

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:6e7f541c8e1873caefeee625e4d789b3f2b00fc89dbda05e3901f4a8906f791e

Observation 7802f74d-0b69-40cc-901c-f6c0a5117119 · outbound

This paper cites 2021 , url =.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2021 , url =

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:ce8b3b1d4c0abe5204c26edc65c9778a4a0b41432a68b7faac683fdb66df7d1b

Observation 424f573e-5625-465f-a56e-6103c5d7eb40 · outbound

This paper cites an unresolved cited work.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:e6b2571dba957c18f45760d18977e04a3e3ba51a5587f2b00fcdf886f4efde66

Observation ac2c9878-a75b-4fe0-b6e8-1624c4d210da · outbound

This paper cites 2021 , url =.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2021 , url =

Reference 15

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:4e1ed0df92bc22b3e8607ac640b7b0f001479163323bccf027ea93fd568e8c2f

Observation 31646f2f-037b-4c44-82c5-fe895853b948 · outbound

This paper cites Constitutional AI: Harmlessness from AI Feedback.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Constitutional AI: Harmlessness from AI Feedback

Reference 16

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.715693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T07:38:15.114855+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:a0757702f68b23617dc997c8ca2ad6239f65324e4fcf2d553812c7a4448fc644

Observation 8e26d784-e1d1-4784-a47d-feedb03f575d · outbound

This paper cites Deliberative Alignment: Reasoning Enables Safer Language Models.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Deliberative Alignment: Reasoning Enables Safer Language Models

Reference 17

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.722457Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:41fcf7aba373e5f84b4d213ff5b3668a05d174bea8fdec7b6ca56afd50ebcca5

Observation 0c2cfc4a-c5e1-42aa-8778-d54b4fe00fc1 · outbound

This paper cites On-Policy Context Distillation for Language Models.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models On-Policy Context Distillation for Language Models

Reference 18

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.711996Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:554550df05d4992a13145fc67d15df2538cf05cfe9b7e6a5c1fcfe1f58b30ee6

Observation 5e1ced3a-7f5d-4991-a6c0-bcdb79932f1e · outbound

This paper cites Universal and Transferable Adversarial Attacks on Aligned Language Models.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Universal and Transferable Adversarial Attacks on Aligned Language Models

Reference 19

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.675593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:ba8b5fcd7c4eb7f94f19902d1487b122d782509bcd22da447fd214a7fbd81dc5

Observation e10b7495-3954-4e47-a9bb-616d289a5e6e · outbound

This paper cites Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable

Reference 20

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.693837Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:1bdef0d6b399d22cde8f10bed04692046af3d3e3ee15eff3c19002e2dc7442cd

Observation 8ee96c02-868e-42c1-8bdd-ef45521edad6 · outbound

This paper cites Proceedings of ICLR , year=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Proceedings of ICLR , year=

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:3102dffd321228d3478cbc0bbc0bf13975ffddbd40d5d13c6693b815d897dd3d

Observation c39c5b70-4939-4ee7-86e7-2ddfe1e12ba7 · outbound

This paper cites The twelfth international conference on learning representations , year=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models The twelfth international conference on learning representations , year=

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:328c3f08f2fee8472c0d49e2ea46c09c89a81d0d82d87b09bc3c1a259790bd15

Observation 66bc25e0-c54f-4271-b3f3-88da543a8dfa · outbound

This paper cites 2025 , month =.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2025 , month =

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:96e9de904d72916881f84873ba656fd9d984419de15b40fa8937f4c082a9c8be

Observation a0cd011e-8d8b-4e24-a5cf-6bea362d161d · outbound

This paper cites 2024 , eprint=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2024 , eprint=

Reference 24

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:61d5178799a4e3856047784fb2c2519b6cf17f05ed7ed73c2621b7ddfe23bf65

Observation ab8c767b-04bb-4f45-a8c8-973efd854090 · outbound

This paper cites 2024 , eprint=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2024 , eprint=

Reference 25

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:8f73e67d806524700cc94cac0ef31a9a3a56fcd17c8dc6a56e1344b605803bf2

Observation 9dd28c2e-5b09-47c3-9cee-e94441678bbf · outbound

This paper cites 2025 , eprint=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2025 , eprint=

Reference 26

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:5d3bc79e239b9f994c0a7009985867da831050c2b46186a10e164819911c44a2

Observation fbc3ed8f-f90e-4dd9-9fdc-e053bf2fa2ef · outbound

This paper cites MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark

Reference 27

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.699084Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:3efd0bceba1a6542564b155af3d617f364f1e672d48b976daadca48cb78f6723

Observation b2b9d4d1-78bb-43ad-a298-0b44dac91934 · outbound

This paper cites 2023 , eprint=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2023 , eprint=

Reference 28

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:3a5890dfe12d7c5ac9f190093a6468cb2c16cddd67273644a1a290ad8a749b7e

Observation 52df4b8f-95b3-4843-b44f-151ceebbe86a · outbound

This paper cites Let's Verify Step by Step.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Let's Verify Step by Step

Reference 29

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.701504Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:9cd6be6d72160757f5436b7f7dab9bc95e8149c21f6009bc51d58201dbe84db2

Observation f31f60cf-3d9a-457e-be1f-7e86f176ce46 · outbound

This paper cites XSTest: A test suite for identifying exaggerated safety behaviours in large language models.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models XSTest: A test suite for identifying exaggerated safety behaviours in large language models

Reference 30

Resolution
verified exact
doi, observed 2026-06-25T21:18:24.202555Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:9b5b5c771cae83a4d1de8b185954cda667ba730713d172e303ba61b964f159a5

Observation 6a3b0c63-c3a4-4c76-b368-32fbc6508cd2 · outbound

This paper cites Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=

Reference 31

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:5e18360b03ec560b4564ee9eecbd05d8dec85a3f94b7d3b56cb1d1c9ae68a98f

Observation e58cc4d2-add5-44a0-8e57-a1917d85d278 · outbound

This paper cites Advances in Neural Information Processing Systems , volume=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Advances in Neural Information Processing Systems , volume=

Reference 32

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:12cb8d4a4427f1dac8f8330829e627022e6666db14c1982865ce33a541a6bbb3

Observation ae156d65-22ee-4fa7-a915-5116aeb5f20f · outbound

This paper cites Don’t let the claw grip your hand: A security analysis and defense framework for OpenClaw.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Don’t let the claw grip your hand: A security analysis and defense framework for OpenClaw

Reference 33

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.670026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:83b9492105b54c40e9e044f5becfe14c7f212b3660c80a325453ae135942c809

Observation c9a31ea6-4098-4c20-b102-8913135f6e15 · outbound

This paper cites IEEE Transactions on Pattern Analysis and Machine Intelligence , year=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models IEEE Transactions on Pattern Analysis and Machine Intelligence , year=

Reference 34

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:763209a821bdf71b2e37bf91d679cb54947f613d8f071ac252f46ac4e1080fd9

Observation 39b53d08-9530-4e02-a025-20c1613b9827 · outbound

This paper cites Proceedings of the 26th annual international conference on machine learning , pages=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Proceedings of the 26th annual international conference on machine learning , pages=

Reference 35

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:e9382ed718a80f0451c8f2e565c86973f0c9771ba2ab14d22c23f3d45086a16f

Observation ebde2d01-7dd4-4c44-b1b9-86b91501ab39 · outbound

This paper cites an unresolved cited work.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Unresolved cited work

Reference 36

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:9bfb5955cb3f4bf42bf33792c17006b8c3ef59715d8c0cf7e9ce8bd465ffd4ab

Observation ac0dbfff-3d16-4027-9c79-e09c893b51e6 · outbound

This paper cites an unresolved cited work.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Unresolved cited work

Reference 37

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:922948fd7a79c57c585e6d1abc2112a8ea0d8e35b4311e30e5364fa37e8c7eac

Observation e6b0741c-e2bd-49ea-86e1-b48c43f2d4d4 · outbound

This paper cites Six Musts and Six Don'ts.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Six Musts and Six Don'ts

Reference 38

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:bedac0af0f130ac73712c4020d3626c61d2ac5fde5f975b828aef4063786ba15

Observation 1199e169-126d-4f67-84be-b8161cb526aa · outbound

This paper cites an unresolved cited work.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Unresolved cited work

Reference 39

Resolution
parse uncertain
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:90cc9b82b01995505f4c6193be7d31ccc14830584a1e8506efe53a2b7f5263e1

Observation 5ef722e4-291e-4598-b0ab-a91b14451974 · outbound

This paper cites ArXiv , year=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models ArXiv , year=

Reference 40

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:f85a2938ee67d6b5bb0d5ea6533a853369b64f9674dec6a78de51c6f8d967f67

Observation a1575c0b-db97-42d4-a424-7ccff2530cb6 · outbound

This paper cites AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning

Reference 41

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.672952Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:e58b7b630bc1c26505b070695a628ad7b37950df6535266570cfbaaece71c18b

Observation 5300cfbe-bb71-417c-a802-6545904e7933 · outbound

This paper cites Mitigating the safety alignment tax with null-space constrained policy optimization.arXiv preprint arXiv:2512.11391.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Mitigating the safety alignment tax with null-space constrained policy optimization.arXiv preprint arXiv:2512.11391

Reference 42

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:40:06.703822Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:ec8916f14e36b93dfb52c5fbe4dded6fc44f17fdf8415f5f60a8f97f2992e9b8

Observation a240646d-925d-4c5d-8573-fc7eca196ad5 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 43

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.689192Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:3189dc61d57bb96a722c962739bd664de84990c994e766be0bb376848d15fcc7

Observation 9b5ea55a-911f-4b47-aa53-578cc0a2dbb6 · outbound

This paper cites Qwen3Guard Technical Report.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Qwen3Guard Technical Report

Reference 44

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.686892Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:2e3a491f411f843fada14e38778061e3fc71ccfbc04f7e0389b172ffc5e56d0a

Observation 0d4eab1e-2d4b-43b0-981f-b8180462b169 · outbound

This paper cites GPT-4o System Card.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models GPT-4o System Card

Reference 45

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.691468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:91da9d654388e616a65b3972ab71b40fd89ff7af723ef2a12c5b36d9bcbf88b3

Observation 5424a20c-1c24-40d1-9f2d-1354db667f49 · outbound

This paper cites Advances in neural information processing systems , volume=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Advances in neural information processing systems , volume=

Reference 46

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:c9bfb756baacf5ea0254a8c29514ee4bca089cb64bf1bfcb4842ef181916dcc3

Observation 36b75ef0-39c3-4866-96ea-7963ec50229a · outbound

This paper cites CARES: Comprehensive Evaluation of Safety and Adversarial Robustness in Medical LLMs.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models CARES: Comprehensive Evaluation of Safety and Adversarial Robustness in Medical LLMs

Reference 47

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.696508Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:00dec2d5b6f2995a3615de771909e0cbc2775210309952fc4ef2756675d6ad33

Observation 520ee891-6745-4005-90f6-9693777cd455 · outbound

This paper cites Applied Sciences , volume=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Applied Sciences , volume=

Reference 48

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:0645b36ebb9675344e732b4deb2c1cfb7e3b4233cf76f9352299e13825119183

Observation 7ac1b6bf-d013-413f-8a74-311da2741bd9 · outbound

This paper cites Conference on health, inference, and learning , pages=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Conference on health, inference, and learning , pages=

Reference 49

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:61ec4363add40e482173150fa50aceabdbb26758c07034d2f3ab99548c1de65b

Observation c9371e08-57b8-40ce-b1ce-9aaf00f74c1e · outbound

This paper cites The Thirty-ninth Annual Conference on Neural Information Processing Systems Datasets and Benchmarks Track , year=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models The Thirty-ninth Annual Conference on Neural Information Processing Systems Datasets and Benchmarks Track , year=

Reference 50

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:4ab78d74de5871cd19ce5ed90843fe33913724d01bad60c5182270f1a7c74127

Observation 336bcbc7-9e21-49cf-8bc1-50df8dd86755 · outbound

This paper cites TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law

Reference 51

Resolution
metadata mismatch
arxiv_id, observed 2026-07-28T02:23:16.096771Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:5f5714dae6c54089f8ad69c62ef800a252c053159fc0f3814a7d3ff7a4f9a6e6

Observation 376865d9-67da-4068-b0ca-abcb4744e035 · outbound

This paper cites Lexam: Benchmarking legal reasoning on 340 law exams.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Lexam: Benchmarking legal reasoning on 340 law exams

Reference 52

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T19:40:06.680858Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:79e3a7ccac4ea6aace5ef238447af9a7bf9d23948c4dd1b8ebb3390acd1c5429

Observation 67f19427-f5e0-441e-b2e8-8d8d7016ce46 · outbound

This paper cites FinanceBench: A New Benchmark for Financial Question Answering.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models FinanceBench: A New Benchmark for Financial Question Answering

Reference 53

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T19:40:06.684250Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:b3297924acdfe88db3d5f87a9e6f79f3d60da9af749fb809dc8b0d9064fc6dfd

Observation b635e296-c506-4f49-82fb-bdda3f0854f7 · outbound

This paper cites an unresolved cited work.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models Unresolved cited work

Reference 54

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:efdf08d5649b0ab0a475431d5a563112e072e90335795a14af43929e2957f544

Observation cbbc50e2-44d1-4fc9-a53e-dc720838c09c · outbound

This paper cites 2025 , url=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2025 , url=

Reference 55

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:9a11b4a23ef679eaa5b65d4de236f9124e997d0e869bf7dbbaaf52d1c0d9d5b0

Observation 4a6e2df9-644e-499a-a87c-90ac22b74fb1 · outbound

This paper cites 2025 , eprint=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2025 , eprint=

Reference 56

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:da77b502f3bf896e70ab71a4cca430cb278ae24fbacfa81e084642d44aeaa202

Observation f51f8ef4-1671-4044-bc7a-8aa6f0157764 · outbound

This paper cites 2026 , journal =.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2026 , journal =

Reference 57

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:a9ae359d2e8b26fc8df891a47d7b0996229f57470484409ad61e479a01b952e6

Observation 7ac1baa8-2446-4e9d-a865-9dd4ab8c0a6d · outbound

This paper cites 2026 , eprint=.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2026 , eprint=

Reference 58

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:d54446d50f7c1133c7879521eed140fe2ece45fab2d3b0d2e3ddd7b5aa8e79d1

Observation cedabc4c-819e-46f1-84bb-7b2fe63782fd · outbound

This paper cites 2024 , month = jul, doi =.

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models 2024 , month = jul, doi =

Reference 59

Resolution
unresolved
no resolver link, observed 2026-06-25T21:09:19.727723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-25T21:09:19.727723Z digest=sha256:74de402f39564b59d08778404dcc74b924edced396dd580fffa17878842b431e

Pith citing papers

No inbound Pith citation observations are available.