Pith. sign in

Paper Citation Record · LEDGER

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring

As of 8 August 2026, this Paper Citation Record lists 91 of 91 outbound references and 1 inbound Pith citation observation for arXiv:2502.05242.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.05242 v3

Coverage vector

measured 91 of 91 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-08T21:06:56.135403Z

measured 92 of 92 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T23:01:59.215909Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T23:02:04.281602Z

Reference resolution

91 of 91 outbound references displayed

  • verified exact7
  • verified fuzzy14
  • unresolved69
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation f3e8f967-b44d-4ec1-bfce-2738e74c1b1f · outbound

This paper cites Generative AI Text Classification using Ensemble LLM Approaches.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Generative AI Text Classification using Ensemble LLM Approaches

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.774507Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.774507Z digest=sha256:3ba16567c4e7ac52ad8f6fe47d31fdcc57d5a4ad5b51c7a3791a36c4a54d9a4a

Observation e63ebdc5-3aad-4860-8b8c-4fcc8b8591fb · outbound

This paper cites GPT-4 Technical Report.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring GPT-4 Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.779567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.779567Z digest=sha256:8a7becdf2dc08270dc6b2d29ce0b97d5c12056e7da84bba53b1a7e3295fffe0e

Observation a0e013a8-1d8a-4685-8774-759eba133331 · outbound

This paper cites The Internal State of an LLM Knows When It's Lying.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The Internal State of an LLM Knows When It's Lying

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.783768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.783768Z digest=sha256:a28784fc8452b74b33c9ff1e53864261299f345d45d2df9b678a863f285fe71f

Observation 457ddc55-500e-4a0c-be87-d9b5acc5e94d · outbound

This paper cites Transparency and explainability of ai systems: ethical guidelines in practice.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Transparency and explainability of ai systems: ethical guidelines in practice

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.788132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.788132Z digest=sha256:70bb8a0ec6449b286548a1f345b50f44be20f30bdce67c00c86fe7063f760079

Observation b937a963-1c1c-4573-bf94-74451f211016 · outbound

This paper cites Spectrally-normalized margin bounds for neural networks.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Spectrally-normalized margin bounds for neural networks

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.792115Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.792115Z digest=sha256:9c8ba2dafa8bd51f961db205148f0f14d32e7587fc84452430d0cfc689607e90

Observation dd51a220-ef09-4d7a-aed8-ca8c6dcd3fca · outbound

This paper cites Language models can explain neurons in language models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Language models can explain neurons in language models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.796051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.796051Z digest=sha256:347b6ba09485cce51389b6c9e235e251cf332a07feacf9da4c318b9dac052d76

Observation eff633a2-2ed4-4a3e-9fb4-c940d9671e89 · outbound

This paper cites High-Dimension Human Value Representation in Large Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring High-Dimension Human Value Representation in Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.800491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.800491Z digest=sha256:c1636175e79963b723c8f798ecbd71104346a3815180614f666f100e0ac9564a

Observation 8f4e9428-e1ba-410b-b894-69a5806bac97 · outbound

This paper cites Internlm2 technical report, 2024.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Internlm2 technical report, 2024

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.804422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.804422Z digest=sha256:6db0f65a37623c9f58bd270b6faea2c2cfa6acadfe5ff8509e441bed264dbe24

Observation b4f9efca-d4c3-4300-863c-4cf5ea4377c2 · outbound

This paper cites Redunet: A white-box deep network from the principle of maximizing rate reduction.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Redunet: A white-box deep network from the principle of maximizing rate reduction

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.808319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.808319Z digest=sha256:02d22f02f5701b193504163f36798aa5a01190cc0a97747b5ce277d9e91a0708

Observation ae97825f-34b0-4041-aa53-5e11bac06f2d · outbound

This paper cites SelfIE: Self-Interpretation of Large Language Model Embeddings.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring SelfIE: Self-Interpretation of Large Language Model Embeddings

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.812069Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.812069Z digest=sha256:868be87f044a731c485df8a0a17e44133cbe263c7b692df561647c8254b328c5

Observation 65862f5e-6e05-4c89-8962-8c35adb1434c · outbound

This paper cites A simple framework for contrastive learning of visual representations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring A simple framework for contrastive learning of visual representations

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.815963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.815963Z digest=sha256:f6e06f6d2809b0e534823118912873d3f920d6b0a7fe9e677eaeac1390969b5e

Observation b0d84af8-53d5-4908-8fbe-29a7d337e092 · outbound

This paper cites Reasoning Models Don't Always Say What They Think.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Reasoning Models Don't Always Say What They Think

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.819737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.819737Z digest=sha256:866a9f19042caf0eba3c3f593cbb1dfd0e118e60f4c7021a329432782a6431f6

Observation b3eb7f9c-41eb-4d33-8e1b-1c3bb0803fbc · outbound

This paper cites Token Prediction as Implicit Classification to Identify LLM-Generated Text.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Token Prediction as Implicit Classification to Identify LLM-Generated Text

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.907064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.823842Z digest=sha256:db58ff6d62874f786fc97b10eac5f15f20c12e3b777df11ef3210774617d62c7

Observation 5939e0aa-5dd2-4819-87c4-6cee38a1f6ef · outbound

This paper cites Measuring generalization with optimal transport.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Measuring generalization with optimal transport

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.827723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.827723Z digest=sha256:511d3d329d98a4a94e446ef3b8556c03d825e55f17dae9fbc5d712431a123d14

Observation 501c34ff-aac9-4645-b297-50d7bd509842 · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Training Verifiers to Solve Math Word Problems

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.831386Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.831386Z digest=sha256:0b89daf4268b48401bb3f9f0b8c0040912b552db7a08a2bf0d3d678b06e971b1

Observation 6f210b8b-a74b-4846-8cc4-0969bdab1572 · outbound

This paper cites Opencompass: A universal evaluation platform for foundation models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Opencompass: A universal evaluation platform for foundation models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.835382Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.835382Z digest=sha256:ec46cd28a12cfe95548b038b9e18114f2a1134350c2885f802ed5bd4e08db9a2

Observation a558fa4f-2a39-4149-80df-bd468a5a5042 · outbound

This paper cites Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.839319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.839319Z digest=sha256:80add8c2fcabddbf5d2b97f0907bdcb0679f8a4a9f521e4a4162d7e63e9ec67d

Observation a712fe56-9fc0-4031-9daf-03316b48d32b · outbound

This paper cites Enhancing Chat Language Models by Scaling High-quality Instructional Conversations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Enhancing Chat Language Models by Scaling High-quality Instructional Conversations

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.843649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.843649Z digest=sha256:57cf928eb209b2b36e6cf90caec6c3c23965f7f82649497f7e751f46d5a1b5e0

Observation 5e02df84-da1c-4178-a019-39ed782397c8 · outbound

This paper cites The Llama 3 Herd of Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The Llama 3 Herd of Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.848017Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.848017Z digest=sha256:3365be50ad01be10d14e74d9685ee8f2247a33774eb6c393dc967601691f679e

Observation 80e24131-ca75-4d12-947c-9c2e86df1e54 · outbound

This paper cites Scaling and evaluating sparse autoencoders.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Scaling and evaluating sparse autoencoders

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.852430Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.852430Z digest=sha256:e1510f1260b66ac6e2ba8dc4ff6be7199292ca8c093b9193756e1aa92b981d17

Observation 0b6e1392-4cdc-4298-9c06-0f4bd94eaef8 · outbound

This paper cites Patchscopes: A Unifying Framework for Inspecting Hidden Representations of Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Patchscopes: A Unifying Framework for Inspecting Hidden Representations of Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.856894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.856894Z digest=sha256:83d2ab6c9e3ee47111dfcb91bee6b3f2517bc8d3819e6a43039f85ff54a4e65d

Observation 0187d06a-8394-441e-9bb2-d9e927e54d26 · outbound

This paper cites Alignment faking in large language models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Alignment faking in large language models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.861230Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.861230Z digest=sha256:eadddc824e5523ee82fb80f9f7e6cc92ac884e9252f803dd8911580690e1fa48

Observation b469aef6-7e91-495f-ad40-23df6a2e9795 · outbound

This paper cites Dimensionality reduction by learning an invariant mapping.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Dimensionality reduction by learning an invariant mapping

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.865542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.865542Z digest=sha256:e4bdccfe35ec129ce237dd847f575febc3a20082cdd9959c96ac4c4b201d0304

Observation b0fa4ebb-603c-496e-b878-aafe3fdfd14b · outbound

This paper cites Masked autoencoders are scalable vision learners.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Masked autoencoders are scalable vision learners

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.869642Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.869642Z digest=sha256:cf080dca72e40576755e408a39341509a98545acb254aea3f6ef5c66be13b7d0

Observation e4bcd3c8-ce88-43ee-8aff-f1ca7ead4c4c · outbound

This paper cites Momentum contrast for unsupervised visual representation learning.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Momentum contrast for unsupervised visual representation learning

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.873475Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.873475Z digest=sha256:60417ea2c4ab1958934c468790b07fa19bb6993fda97c6db57a342ebda1ac9c8

Observation 688d65ed-4bff-4110-a7af-35d28a44760d · outbound

This paper cites Measuring Massive Multitask Language Understanding.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Measuring Massive Multitask Language Understanding

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.877048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.877048Z digest=sha256:5b7482136cb7dea7d2a29e0a1daa5dbef986f651336780d489dac1864cdaed4b

Observation b175704b-317e-4612-ad96-c1a7e576cdfc · outbound

This paper cites Measuring mathematical problem solving with the math dataset.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Measuring mathematical problem solving with the math dataset

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.880776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.880776Z digest=sha256:4b1204dcf212c36323efc8035d901e004c7ad49df6a1bdb4a7fda3a6ce21f691

Observation f7ac45f8-93e2-4db4-8b6e-513633c2f52a · outbound

This paper cites LoRA: Low-Rank Adaptation of Large Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring LoRA: Low-Rank Adaptation of Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.884405Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.884405Z digest=sha256:29f91f14f7a92a115cc56b1162e4fabf07685dfac1f12e97450280a91b56b548

Observation f2ff69cd-e2d8-495a-bf29-c5ad0093834c · outbound

This paper cites A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.888220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.888220Z digest=sha256:ab36568995758e9adb7639803bb35b141c56350685bf82e2a52dc8ee4d16323b

Observation 173d7867-b738-4c0a-9787-e087706fc231 · outbound

This paper cites Can Large Language Models Explain Themselves? A Study of LLM-Generated Self-Explanations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Can Large Language Models Explain Themselves? A Study of LLM-Generated Self-Explanations

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.891758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.891758Z digest=sha256:4b9b04018a318bea1e2662a0ede5acab1bc23aa6af745925f78e7b6ea8fdeab0

Observation 10957a03-58f7-494b-875c-b555402d289d · outbound

This paper cites Vaccine: Perturbation-aware Alignment for Large Language Models against Harmful Fine-tuning Attack.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Vaccine: Perturbation-aware Alignment for Large Language Models against Harmful Fine-tuning Attack

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.895736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.895736Z digest=sha256:8a7a17b00a6a926f1552e4dc5b379b5c4bd4e913989796a6d6f77e871ba5f9ea

Observation c35dd0db-4a15-410d-8ace-4a2453be7f10 · outbound

This paper cites Anthropic: Responsible scaling policy.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Anthropic: Responsible scaling policy

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.332762Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.899620Z digest=sha256:d2b728520375b27f7ebd7eb410721eabff92d892fa782f895967ce7577d77f21

Observation 5e83a56d-4123-4e6b-b529-66b410741f27 · outbound

This paper cites The Platonic Representation Hypothesis.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The Platonic Representation Hypothesis

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.903599Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.903599Z digest=sha256:42c0b4d69300644b97a3f93296d693e60e9c7d4ced88d5744ff2f5eb33a9df34

Observation 83447c0a-c73c-4565-8128-9ab08938f379 · outbound

This paper cites Klanderman, and William J Rucklidge.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Klanderman, and William J Rucklidge

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.318683Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.907611Z digest=sha256:91622beb4e1f665c7758ad747bcc483624f4e0b72ee254fbc21e80c0354dc881

Observation a4e41a44-f263-41ee-84a9-6447e16b6d3b · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.911523Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.911523Z digest=sha256:8875b34bddd970e3e780715c4f74869d5b0ac740be7f877b497c6ef32489de6c

Observation 70aa9370-bc40-4292-9e1d-49f62f31b051 · outbound

This paper cites Beavertails: Towards improved safety alignment of llm via a human-preference dataset.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Beavertails: Towards improved safety alignment of llm via a human-preference dataset

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.915594Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.915594Z digest=sha256:45bbe6f7bb85ef46a2c6fa592158979ff59b1a93e88c5902e81066cc833fb576

Observation adcf540f-b082-4a3e-8918-95a7bd6c7d59 · outbound

This paper cites Mistral 7B.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Mistral 7B

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.919286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.919286Z digest=sha256:78ea6686bf76c0555ebbc639d90ceac5237d65faba0631d325a1808e4d2ea96c

Observation d035885d-8c60-4038-ad07-fdf4cbde629f · outbound

This paper cites NeurIPS 2020 Competition: Predicting Generalization in Deep Learning.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring NeurIPS 2020 Competition: Predicting Generalization in Deep Learning

Reference 38

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.683476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.923429Z digest=sha256:a08312dc3b047b8505a1198322293d31b75ed89ec2403ad6f2c4b6e5a6f2cb3e

Observation 13866d13-644a-4719-b597-dc36bef6e648 · outbound

This paper cites Explainable artifi- cial intelligence for mental health through transparency and interpretability for understandability.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Explainable artifi- cial intelligence for mental health through transparency and interpretability for understandability

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.295179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.927512Z digest=sha256:bd5a08ceda338b9ef87df79a9e48779da9726362f62bd4e17d5d14f691966023

Observation ae57fff5-306c-420d-9be1-75a143f4fa31 · outbound

This paper cites Theoretical Analysis of Weak-to-Strong Generalization.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Theoretical Analysis of Weak-to-Strong Generalization

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.931312Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.931312Z digest=sha256:629765623755e281b994658115cb8861120e71086a472580d29536ec26c8be3e

Observation e56eae66-2a65-4723-84a4-b2a9ea64b870 · outbound

This paper cites Getting More Juice Out of the SFT Data: Reward Learning from Human Demonstration Improves SFT for LLM Alignment.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Getting More Juice Out of the SFT Data: Reward Learning from Human Demonstration Improves SFT for LLM Alignment

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.935526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.935526Z digest=sha256:872798aac2fcb9abffceab18816c5f19823471b27a6276091d92792931042c99

Observation 4ff0e8ae-7aed-43ef-b4ef-f79cf43fff2e · outbound

This paper cites Inference- time intervention: Eliciting truthful answers from a language model.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Inference- time intervention: Eliciting truthful answers from a language model

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.281700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.939591Z digest=sha256:5d895b1de9ab23a4f2d4951b0bc85a4ed56f9b2c996f51766b1d214d97758147

Observation 3b5c0a1c-1092-451e-abaf-5fcbafeda044 · outbound

This paper cites SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.943327Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.943327Z digest=sha256:963b81bccdd9344f9d6d9342c0bf595918b77278b21109686b7278f0709bf451

Observation 91f68183-74c7-4e22-bd63-d35465225cf9 · outbound

This paper cites The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.947697Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.947697Z digest=sha256:7541b97c6e0a94c0585c13c3bc15d4d78ee491b743fcea1d61c5e7d4c305c527

Observation 20f0ad26-1ff9-4a3a-8c07-5e261d86327f · outbound

This paper cites Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.952238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.952238Z digest=sha256:2a957a93e78ef8fd6300374e3f0c3ea4dba103993f019a9de2570827c5a0f3cd

Observation 8ce0c3e3-8ff9-4f56-949e-5081cf4e12d3 · outbound

This paper cites Large language models in finance: A survey.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Large language models in finance: A survey

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.956497Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.956497Z digest=sha256:e1b58360e0daa92ffa9990aa273741a6aae0282d361c2723af4e4e43b7048858

Observation fa921c34-69a1-4f13-bb2a-16033b96982f · outbound

This paper cites Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.960754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.960754Z digest=sha256:ee867b58e1ac7f5a3eb96aa2032ae1a1d0af02d239cbcf567f3b88c64a7d3827

Observation 2fe70bf5-43ea-4c1f-9120-0d1084c5f9b8 · outbound

This paper cites Latent guard: a safety framework for text-to-image generation.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Latent guard: a safety framework for text-to-image generation

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.258531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.965090Z digest=sha256:0668d8dd2ec20a53182fc370c7bc5ca37d56a8a2521f329cc7c63482c8a1490b

Observation 8a83b41f-745d-483b-9005-e7157117c742 · outbound

This paper cites Breaking Free from MMI: A New Frontier in Rationalization by Probing Input Utilization.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Breaking Free from MMI: A New Frontier in Rationalization by Probing Input Utilization

Reference 49

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.576746Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.969484Z digest=sha256:0efb6d31009ffb8f807bac0f42c2d8afe24e7c154f8abf99ce24332df1ece263

Observation 036de2d0-4613-491c-bb9f-b3cc5f5c938a · outbound

This paper cites Is the MMI Criterion Necessary for Interpretability? Degenerating Non-causal Features to Plain Noise for Self-Rationalization.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Is the MMI Criterion Necessary for Interpretability? Degenerating Non-causal Features to Plain Noise for Self-Rationalization

Reference 50

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.558474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.973742Z digest=sha256:5836efb18986a283d80ca4686434539e42022caecee42fdbdd411eb01e78a9ea

Observation a900ae02-3466-4912-8423-ea555e038e6d · outbound

This paper cites MGR: Multi-generator Based Rationalization.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring MGR: Multi-generator Based Rationalization

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.537652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.977711Z digest=sha256:e785771bbb765cb33b0e46f258b331804b7236cd390ce4c1476a48e008d3c42f

Observation 4e06cb80-918d-4863-8234-b1daffbddaf5 · outbound

This paper cites D-separation for causal self-explanation.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring D-separation for causal self-explanation

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.245452Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.981604Z digest=sha256:e89f004c21e670e15ea67e04f7bf4f1680595cf9262ee9cdab82c40c0b608146

Observation df5fed00-963e-4362-b243-b73676f467f7 · outbound

This paper cites Efficient detection of toxic prompts in large language models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Efficient detection of toxic prompts in large language models

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.985225Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.985225Z digest=sha256:d83af03cbc20d2718c9110f9e47769eca5eda30b50aa523a823e8002a3b20172

Observation 16164951-f8c2-42c2-95a9-11c2a14fd8e2 · outbound

This paper cites Are self-explanations from large language models faithful? In Findings of the Association for Computational Linguistics ACL 2024, pages 295–337, 2024.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Are self-explanations from large language models faithful? In Findings of the Association for Computational Linguistics ACL 2024, pages 295–337, 2024

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.222356Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.988861Z digest=sha256:983bb2e386c06b0ddb0be2680663727a5ee9a43c7f1d9bf2cac1338b12d939b7

Observation 446c31d7-65c7-4a8a-b4c3-89caa757e468 · outbound

This paper cites Introducing llama 3.1: Our most capable models to date.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Introducing llama 3.1: Our most capable models to date

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.207161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.992591Z digest=sha256:e239d32e879ccee9c1be18569805a8d2f102934d219b46152994bdb40c486a7a

Observation 1d218019-ad92-4d0e-9b10-81277d858604 · outbound

This paper cites Large language models in healthcare and medical domain: A review.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Large language models in healthcare and medical domain: A review

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:55.996095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:55.996095Z digest=sha256:d4c4a79eb6db9347e942f1a1875a08a0af6792cc381f7ccf257641f098839c90

Observation 20430a8d-5418-4d9d-9714-48fe056b05aa · outbound

This paper cites interpreting gpt: the logit lens, 2020.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring interpreting gpt: the logit lens, 2020

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.182480Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:55.999980Z digest=sha256:ba656097e9fbe4dd734c6b162366d72b217fc6b062c1c6d3accc2f856d923a0c

Observation 225d2322-a4f4-4637-8b8b-803d0835fc56 · outbound

This paper cites Show Your Work: Scratchpads for Intermediate Computation with Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Show Your Work: Scratchpads for Intermediate Computation with Language Models

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.003552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.003552Z digest=sha256:7114b91703657f50aa0d447eb1c5cb6379151fd5b63f5d44bf5f29dbc7d405d7

Observation 2653e440-a101-4d97-a749-9c18c20fe79a · outbound

This paper cites Representation Learning with Contrastive Predictive Coding.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Representation Learning with Contrastive Predictive Coding

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.007455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.007455Z digest=sha256:0af055ff9bb800157f5aefd102b6a6bd8da279c21caff0735795cde9fcef3d86

Observation 77650200-95ad-4254-ae66-b393f8e2d986 · outbound

This paper cites LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.011274Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.011274Z digest=sha256:8e1917c6a025c8da7831d12db9483a0297d397d27c0debf9a09843ffb27142d1

Observation 26f79b94-4509-4a6c-9844-3692db5eff03 · outbound

This paper cites Training language models to follow instructions with human feedback.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Training language models to follow instructions with human feedback

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.015292Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.015292Z digest=sha256:1013e9f80e6595983bfedf6c69cb50ce7e042f297447ec0bb912cdac68d2816c

Observation 9df7f434-40a5-467f-824c-394f877165eb · outbound

This paper cites The Tug of War Within: Mitigating the Fairness-Privacy Conflicts in Large Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The Tug of War Within: Mitigating the Fairness-Privacy Conflicts in Large Language Models

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.019041Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.019041Z digest=sha256:57c76358dbd1634a0070b960ecf670103cb3a2c9d73834126ef4859c57071588

Observation 747cf1a8-5e93-4708-8a45-16bfebbf9b3c · outbound

This paper cites Learning transferable visual models from natural language supervision.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Learning transferable visual models from natural language supervision

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.022839Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.022839Z digest=sha256:3297e8f97122eb0c762ee8de0cff13100b67b78b47e00ad39bd02ce8eeb7f74e

Observation 8c0bdbcb-74c2-45ee-80d8-7e72561f0d4f · outbound

This paper cites Representation Noising: A Defence Mechanism Against Harmful Finetuning.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Representation Noising: A Defence Mechanism Against Harmful Finetuning

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.026593Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.026593Z digest=sha256:7243b91811c15fc81c3bcd185b83e1a9ae90ab92d8c5b44fec44f85f49f5f20d

Observation f1aa9788-3f59-43b1-9fcc-dc77ff0d4fc9 · outbound

This paper cites XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.030792Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.030792Z digest=sha256:f08f7fa2f8afc58252b787296ad1266c31e5bdaf88e5f2b0c70d440151766012

Observation c0568c9d-14e2-486f-b012-9c06393075b6 · outbound

This paper cites The effective rank: A measure of effective dimensionality.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The effective rank: A measure of effective dimensionality

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.034858Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.034858Z digest=sha256:efa14e871c987d1b9972243ac60c2b9cb2c34eee0598aa95bee036afbd8be92f

Observation 60750dfb-be55-4241-815e-7f1a073573f9 · outbound

This paper cites SocialIQA: Commonsense Reasoning about Social Interactions.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring SocialIQA: Commonsense Reasoning about Social Interactions

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.038650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.038650Z digest=sha256:2f579bc89aa538c9217149f62d8701b163ea5e3601c35c3c8102ea3e1f003ec0

Observation b947ce92-bb8f-4fc5-bbe7-cbb7fd9dc66f · outbound

This paper cites Facenet: A unified embedding for face recognition and clustering.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Facenet: A unified embedding for face recognition and clustering

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.042629Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.042629Z digest=sha256:2e58cb89b9c28a89b90d2c7d0ed390e30a0e078d25f76cd7eb93a1ca5e266bb8

Observation 17821f04-8ab1-4875-9197-6ea97b00a04f · outbound

This paper cites Lmfingerprints: Visual explanations of language model embedding spaces through layerwise contextualization scores.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Lmfingerprints: Visual explanations of language model embedding spaces through layerwise contextualization scores

Reference 69

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.130582Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.046235Z digest=sha256:e58eb34b91ae193c396c4259feef9bb8a67eaeeeb1f8f13515ff74d959063b63

Observation e2c8f106-6e1b-4c54-961a-ecbcd71885f5 · outbound

This paper cites k-variance: A clustered notion of variance.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring k-variance: A clustered notion of variance

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.116105Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.050394Z digest=sha256:efa3da011dc55b2aecc6f23af1e7e4d9d96fcf62769534aac37d7de843adb581

Observation 1de0eab6-ba41-4b39-ab5e-adb1a6deb80d · outbound

This paper cites Gemma 2: Improving Open Language Models at a Practical Size.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Gemma 2: Improving Open Language Models at a Practical Size

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.054470Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.054470Z digest=sha256:521a19ea3e7bf07e68a887f2243c3e739c47ff0cb8ccda3ac6ed153e0ecff668

Observation 3e19d31c-1e90-4440-ad87-d31159744ba7 · outbound

This paper cites Daniel Freeman, Theodore R.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Daniel Freeman, Theodore R

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.059007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.059007Z digest=sha256:445f8e6eab4900e65f75d0dbdb908eb9cc0cfb6cfe7330b29f511f5cac230999

Observation 93d11c2a-7849-4444-b3f6-cb06558089a2 · outbound

This paper cites Language models don’t always say what they think: unfaithful explanations in chain-of-thought prompting.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Language models don’t always say what they think: unfaithful explanations in chain-of-thought prompting

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.063915Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.063915Z digest=sha256:56411c36599e46b8f6e963a9e1be6b770342973628da03c815cb759f74d27a96

Observation cd3ee770-4322-4bd8-9d30-f2c3e99d076c · outbound

This paper cites Optimal transport: old and new, volume 338.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Optimal transport: old and new, volume 338

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.068139Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.068139Z digest=sha256:36ba94db4a216718afe96487e6d0a3addbb89e6d2cf09ccce8820a9510932fcd

Observation 7e5f683d-ee24-4e37-bb56-4e66c8530de7 · outbound

This paper cites The wasserstein distances.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring The wasserstein distances

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.072383Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.072383Z digest=sha256:86135b6eab105597777a862b160db8f1500cdd12ec5acd88945c81c8ee2b9601

Observation f8d9cf8e-f1cc-4754-95ea-77d0287e45b6 · outbound

This paper cites GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.076683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.076683Z digest=sha256:a3e3b7ed71e890e33901a520d007cd2f3351ac71fdd5a6bd61a2fc8df2c45a37

Observation c30e8831-9260-4a73-817d-aa3178454530 · outbound

This paper cites Chain-of-thought prompting elicits reasoning in large language models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Chain-of-thought prompting elicits reasoning in large language models

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.081306Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.081306Z digest=sha256:8e6337f6596a6924af3a5935e54e53adec26967304ffbd91d26e19e64efd241b

Observation d1bae7d8-6fc3-4d92-8aa1-a01fabec5b31 · outbound

This paper cites Diff-erank: A novel rank-based metric for evaluating large language models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Diff-erank: A novel rank-based metric for evaluating large language models

Reference 78

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.057955Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.085269Z digest=sha256:3b8b71a9940f21f3cad113ad2a9a9f555f0d143a4101075606c38c8ebf34e845

Observation 98241810-e6fc-4da6-b8c2-fdd71696400b · outbound

This paper cites ReFT: Representation Finetuning for Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring ReFT: Representation Finetuning for Language Models

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.089277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.089277Z digest=sha256:fbd6c678106e4be14e3dfa46a2679ae4cd06145aef2ba21e90570e36eeaaf8c3

Observation 7c478ef5-0b34-4c83-a5d5-0e163c9ce198 · outbound

This paper cites Good Idea or Not, Representation of LLM Could Tell.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Good Idea or Not, Representation of LLM Could Tell

Reference 80

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.371735Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.093042Z digest=sha256:144be9d393e7a38505299f71769d9e04892484bbbf3562d3fa1bd7d82e6c9fcc

Observation f4abf341-265d-49b5-9dd6-72f6a8734d07 · outbound

This paper cites Qwen2.5 Technical Report.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Qwen2.5 Technical Report

Reference 81

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.096969Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.096969Z digest=sha256:0274542f3e726771a1f9d01bc6d2d1f87996d2c163a64e4014bdfa8566bece73

Observation 40f6b988-4f04-4cc0-a4eb-880f270b3154 · outbound

This paper cites A fingerprint for large language models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring A fingerprint for large language models

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.100706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.100706Z digest=sha256:00d907416aa5d9be427aeedd656ec1079b251de9348e6b60d2b2836f8c097d47

Observation 091dd076-9a66-4127-95df-8f08f6cecf83 · outbound

This paper cites LoFiT: Localized Fine-tuning on LLM Representations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring LoFiT: Localized Fine-tuning on LLM Representations

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.104290Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.104290Z digest=sha256:5230c6d8189f641c7fbb567ff8f51774cf43f6afbd6c3f57f514cabf14f02c72

Observation dab498e3-2f81-4167-bdea-0c80fc1fe5dc · outbound

This paper cites Barlow twins: Self- supervised learning via redundancy reduction.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Barlow twins: Self- supervised learning via redundancy reduction

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.108043Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.108043Z digest=sha256:794151e02d842df03d0c962a4d5f009c6e399ab99b817e17588ff65d615063da

Observation d647cc87-41ae-40f1-8821-278ab1fcf4b6 · outbound

This paper cites Similar Data Points Identification with LLM: A Human-in-the-loop Strategy Using Summarization and Hidden State Insights.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Similar Data Points Identification with LLM: A Human-in-the-loop Strategy Using Summarization and Hidden State Insights

Reference 85

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.111620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.111620Z digest=sha256:7e20d83b99c1e00ee3c33ea8fb7b26acc7c9a5342c4600f5a53f9d8551cc67d6

Observation dcbaeea0-a2a4-4a7a-b6d0-5364c23af323 · outbound

This paper cites REAL: Response Embedding-based Alignment for LLMs.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring REAL: Response Embedding-based Alignment for LLMs

Reference 86

Resolution
verified exact
local_arxiv, observed 2026-08-08T21:06:56.207427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.115603Z digest=sha256:9ee286e429c0c2d3dd50320db5f8ce209cbbde75342fa8dd67f8a0a1c29b0ac3

Observation 62028e91-3ff0-4b67-8729-f27302ce3255 · outbound

This paper cites REEF: Representation Encoding Fingerprints for Large Language Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring REEF: Representation Encoding Fingerprints for Large Language Models

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.119689Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.119689Z digest=sha256:36240ee1424ddbe55ba45c8c3be6de7a1c09851b1f695e7bcd4e968459d3ae9f

Observation a5d8497d-01d9-4a05-9ebb-a9209b335a59 · outbound

This paper cites AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models

Reference 88

Resolution
unresolved
no resolver link, observed 2026-08-08T21:06:56.123451Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:06:56.123451Z digest=sha256:73dfbbdafe23a87489f21120487a71fbd7eade0b6439800cba6758fc268009d2

Observation d4a13672-7dec-4bf3-a6fa-701fb7cf5a0d · outbound

This paper cites Improving alignment and robustness with circuit breakers.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring Improving alignment and robustness with circuit breakers

Reference 89

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.035985Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.127637Z digest=sha256:64f48b026fb8b389ff86ea3cfa72aab0126e6494c1c8502dc64d14ef5ac21ed2

Observation 5e295cd8-8b93-4bf9-866d-ec29bbb9cc8e · outbound

This paper cites [ 62] disentangles LLMs’ awareness of fairness and privacy by deactivating the entangled neurons in representations.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring [ 62] disentangles LLMs’ awareness of fairness and privacy by deactivating the entangled neurons in representations

Reference 90

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T21:06:57.023153Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.131162Z digest=sha256:5c2d20be18036d6464c67a6ed94394c639a6f80cd95086ce3bf464aee0b0aa21

Observation f4ef902d-32e2-4788-bb28-1158b52b904a · outbound

This paper cites safe" or.

Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring safe" or

Reference 91

Resolution
malformed identifier
raw_fallback, observed 2026-08-08T21:06:57.010023Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-08T21:06:56.135403Z digest=sha256:a6604b697510dbc21ca7f5143b30a3d3645a2ae83af0ab826340256694a80765

Pith citing papers

Observation 0bdfb9f2-0a78-4996-bd33-6a36b60098b2 · inbound

Position: Intelligent Coding Systems Should Write Programs with Justifications cites this paper.

Position: Intelligent Coding Systems Should Write Programs with Justifications Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-05T23:02:04.284765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-05T23:01:59.215909Z digest=sha256:72e7a6709cf86ac29ad767d4c47dfa911b58c0739eb7d73b8cff1054062427bb