{"as_of":"2026-08-16T03:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3220a6c60ecbfb4f66abac35cf1c6c1e7b277d727bce94a0c416627a8662f456","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:52:45.971931Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13568/citation-record","integrity":"/paper/2607.13568/integrity","json":"/paper/2607.13568/citation-record.json","paper":"/paper/2607.13568"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:38.612024Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:38.612024Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:b300db186194cc3ba85cc56afc8d8f010fe4b8252d49ff2bbf92d16be5bb1900","observation_id":"40c0e650-dde4-4773-8cf3-8c79946c1d72","resolution":{"observed_at":"2026-08-02T04:52:38.612024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:38.720644Z","title":"The Internal State of an","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:38.720644Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:67c7faca50c5ee7e3271d6d2bdba84148f4c99e70182cafe20837071125b02e5","observation_id":"5aeea62b-9842-4344-ad40-e6238affb3a3","resolution":{"observed_at":"2026-08-02T04:52:38.720644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:38.833175Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:38.833175Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:6f228164a6e2ecdbce9e1aa648a6affc8ccb74ada03e5264089d0207ba91d9b3","observation_id":"13acca83-b787-4fef-9bd9-61d7b3d30cf5","resolution":{"observed_at":"2026-08-02T04:52:38.833175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:38.975510Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:38.975510Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:c93c281155d73e4c2833770fb6371c95fe89bec8cce36dcea11f9169b62cffdf","observation_id":"1d4c6906-db50-4ae0-b529-e6d5d12e7e21","resolution":{"observed_at":"2026-08-02T04:52:38.975510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15927","last_updated":"2024-06-22T19:46:06Z","snapshot_observed_at":"2026-07-30T04:59:24.269176Z","submitted_at":"2024-06-22T19:46:06Z","title":"Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15927","snapshot_observed_at":"2026-08-02T04:52:39.095413Z","title":"Semantic Entropy Probes: Robust and Cheap Hallucination Detection in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.095413Z"},"links":{"cited_paper":"/paper/2406.15927","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:91210c2981eff9c7a4222f8403d4a3762ec562a03434526c0807cd4846524348","observation_id":"9e9055e1-57bf-4a0d-8c38-0703aea95166","resolution":{"observed_at":"2026-08-02T04:52:39.095413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:39.247537Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.247537Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:65d317a7c89969a6c4e655c0a5933a6ece325ff10146b895a654642ae8c54737","observation_id":"e0420fd2-3562-49a9-b132-969f07fa6c65","resolution":{"observed_at":"2026-08-02T04:52:39.247537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07071","last_updated":"2024-10-03T17:26:48Z","snapshot_observed_at":"2026-08-13T13:06:10.076285Z","submitted_at":"2024-07-09T17:44:34Z","title":"Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07071","snapshot_observed_at":"2026-08-02T04:52:39.429749Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing (EMNLP) , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.429749Z"},"links":{"cited_paper":"/paper/2407.07071","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:bb954dc21e5f0a4c8a87817bee0b6a10f9d817de40afbea249b360b2521f9f60","observation_id":"c2d9a60e-877c-45ba-8b2b-cda24874c80c","resolution":{"observed_at":"2026-08-02T04:52:39.429749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01917","last_updated":"2025-05-22T00:33:01Z","snapshot_observed_at":"2026-08-15T19:59:39.268468Z","submitted_at":"2025-03-01T19:19:34Z","title":"Steer LLM Latents for Hallucination Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01917","snapshot_observed_at":"2026-08-02T04:52:39.522421Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.522421Z"},"links":{"cited_paper":"/paper/2503.01917","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:1b6b8409c226a3cc41fdc2fd890afe3e0e64fc2a9d6c8551887ad6df2f6499e1","observation_id":"8c6f6293-71b0-4ef7-9a09-200ee4d9ae5c","resolution":{"observed_at":"2026-08-02T04:52:39.522421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:39.596058Z","title":"Hallucination Detection in","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.596058Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:4ad0ab28f62fe1e2a80878b89a0153dee6265a2d340f61b0b91b103eb330a140","observation_id":"9ccf5a3a-3882-4e23-bcb0-1e34a0ef93c3","resolution":{"observed_at":"2026-08-02T04:52:39.596058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-02T04:52:39.706835Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.706835Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:ca104abc905c2dbbc490081307194471d57d3c7d7a15c0abfbc1980778ca21d0","observation_id":"250c961c-8576-4e79-a5b5-e4ffde5dbdcd","resolution":{"observed_at":"2026-08-02T04:52:39.706835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:39.780813Z","title":"Nature , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.780813Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:9bb080555a03c4dad6d178112f7528154cdee2b4537e0a2222bb8a05bee58f1e","observation_id":"66a5161d-ae83-404d-bb27-39295e82c07c","resolution":{"observed_at":"2026-08-02T04:52:39.780813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-02T04:52:39.847140Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.847140Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:33ca086da85787ce84a49c8307927fbed49808f59132279c4bd327abe5728da0","observation_id":"afc139f0-044a-4579-a969-fc54d2585e6e","resolution":{"observed_at":"2026-08-02T04:52:39.847140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:39.923351Z","title":"2022 , eprint =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:39.923351Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:ef6f737c04a33228e0804d17e31942138acd80ccba58f2460fe2deb521617eed","observation_id":"8dff0429-c1b8-4135-bfb7-b50eb8c02dd5","resolution":{"observed_at":"2026-08-02T04:52:39.923351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:40.022767Z","title":"2025 , howpublished =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.022767Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:5c93b31761af5cc6903f6ebf1cb7d6d27ba9ee53ede982dc5fab637ea40471c8","observation_id":"e3f68620-d200-438f-86fd-8e0545cff2b9","resolution":{"observed_at":"2026-08-02T04:52:40.022767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:40.179130Z","title":"Deja Vu: Contextual Sparsity for Efficient","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.179130Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:7f2111323f4f08d91585394dbe95515c9b133e2e1b2b1d7195cede9059d5dc30","observation_id":"acee621d-4c9e-459d-a9b7-9c9a0e68ea0e","resolution":{"observed_at":"2026-08-02T04:52:40.179130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-13T14:07:24.299403Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-02T04:52:40.385460Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.385460Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:40c8436f8412b1e38fe327a55d318d5652defdac83a433202919daaa149dc4f5","observation_id":"14a78b9a-81b6-4c22-9a92-829b0a12ab87","resolution":{"observed_at":"2026-08-02T04:52:40.385460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-08-16T00:18:10.564651Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17762","snapshot_observed_at":"2026-08-02T04:52:40.524880Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.524880Z"},"links":{"cited_paper":"/paper/2402.17762","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:91a07a11de8a44b67913d15e0f4f442d55d6c81bb9db1836a6b82dbd08374d52","observation_id":"dbaf008b-e25d-4a52-ae7d-8becdb250a27","resolution":{"observed_at":"2026-08-02T04:52:40.524880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:40.733782Z","title":"Physical Review , volume =","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.733782Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:926a6151feffcea22ab2841b2bf2debd3fa093c53eec8f7724f188a06c378820","observation_id":"17f018da-0971-4535-98a7-881898222abb","resolution":{"observed_at":"2026-08-02T04:52:40.733782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:40.857124Z","title":"The Effective Rank:","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.857124Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:3abc2e9899a3d75c5685eca337898f84f14ac78ee3cbf3e123d2ac74abd08b90","observation_id":"32f701fa-704d-41af-99cb-798bd0db35ef","resolution":{"observed_at":"2026-08-02T04:52:40.857124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.004027Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.004027Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:637bab78b5c8fdcc9ebd13438389dad0af54cb626dc14ecdc0655331abcb08a6","observation_id":"a2072be3-dcb7-43c7-ba9e-2eaa64f414a1","resolution":{"observed_at":"2026-08-02T04:52:41.004027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.057636Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.057636Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:cc098e5e677c657e7f72700871aa00516f77c2edac0f82c7f1729636ba3c8824","observation_id":"0fd56e73-ed51-4b55-a442-0b498ad42dda","resolution":{"observed_at":"2026-08-02T04:52:41.057636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.106880Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.106880Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:f2876f6f2ee156c0ad22f58f334352f63df8436c1b839ed9df66c8537ecd6e6f","observation_id":"452f97b5-e049-4714-897a-2993e6cf6a40","resolution":{"observed_at":"2026-08-02T04:52:41.106880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.150525Z","title":"Proceedings of the 40th International Conference on Machine Learning (ICML) , series =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.150525Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:5a9693934b1ba2bc3516441a078d45e4b7f9ecf8b34c9ded20d17069fd510a2a","observation_id":"db233c21-9f04-433f-916e-aa1fe5dc0dc9","resolution":{"observed_at":"2026-08-02T04:52:41.150525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.227402Z","title":"Findings of the Association for Computational Linguistics: ACL 2023 , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.227402Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:57272ee04cd8c98dc78cc5350402dc3a2100d69000f41086107b2ea2bd2a5a8c","observation_id":"af6d6bdd-a5e3-4b03-b48d-1c12b16c85c5","resolution":{"observed_at":"2026-08-02T04:52:41.227402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.286248Z","title":"interpreting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.286248Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:9b1144cc4e47d3df80cb17ad267038a05510fe368ac07fa93792be28cfd6ea0d","observation_id":"5166cf4f-8c8b-476c-91a6-e0890be16e3a","resolution":{"observed_at":"2026-08-02T04:52:41.286248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.337163Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.337163Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:a596014a8018dec10d2a9c28a0a96716eee8f00e86b6a74fe47eb6f7ecbc5fb1","observation_id":"c9cac7d3-3b34-4576-93aa-224a8679cd60","resolution":{"observed_at":"2026-08-02T04:52:41.337163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.415476Z","title":"1979 , address =","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.415476Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:d067700b3a166afe5c7eca786e025971cdcd876971295838c8c12d364d89aed6","observation_id":"ca9f6028-f8f4-43d9-83c2-aefd2c4bdfe6","resolution":{"observed_at":"2026-08-02T04:52:41.415476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.585102Z","title":"2509.11569 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.585102Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:bc1b9775125cb78189846254396a9cf349964865e90a8744f6bf16dad84db1bb","observation_id":"297b7895-2838-4b66-b13e-d6efb659d151","resolution":{"observed_at":"2026-08-02T04:52:41.585102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.720440Z","title":"2509.15735 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.720440Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:2383719b87fddc19499fcf5021f763e3523bd188b75f9d0d978a594985cd7300","observation_id":"e5bc632d-a53f-44ec-9c17-f61fcfc045dd","resolution":{"observed_at":"2026-08-02T04:52:41.720440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06448","last_updated":"2024-06-10T05:48:30Z","snapshot_observed_at":"2026-08-13T00:57:55.593567Z","submitted_at":"2024-03-11T05:51:03Z","title":"Unsupervised Real-Time Hallucination Detection based on the Internal States of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06448","snapshot_observed_at":"2026-08-02T04:52:41.842255Z","title":"2024 , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.842255Z"},"links":{"cited_paper":"/paper/2403.06448","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:67855cc5c12159277f3554228f2c7a37b34fc5006b9f19d755bf657c2a588f20","observation_id":"583af310-9294-486d-8d83-0d336508fcba","resolution":{"observed_at":"2026-08-02T04:52:41.842255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:41.950739Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:41.950739Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:cb8c6677eefb8dac211a34d49bdc7189909a3ece2933004fc824dd4197004d07","observation_id":"73a41b42-9105-4573-9912-6cedb788e04c","resolution":{"observed_at":"2026-08-02T04:52:41.950739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:42.117409Z","title":"No Answer Needed: Predicting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:42.117409Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:f9eea873688878f37b59ed299f0e9c3c6d02c0573702aa2afceb767be747baa1","observation_id":"5b86a583-349b-4c64-8bc0-bb2550dcae66","resolution":{"observed_at":"2026-08-02T04:52:42.117409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:42.231869Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:42.231869Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:83ad5535ae9afdaeaa10c23e3953c9647c3d298cef4144e7b511dcf3f382522d","observation_id":"bedcfa52-8355-4771-9788-fbd3110a91b8","resolution":{"observed_at":"2026-08-02T04:52:42.231869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11975","last_updated":"2025-04-28T06:19:32Z","snapshot_observed_at":"2026-08-13T03:24:54.251906Z","submitted_at":"2025-04-16T11:15:26Z","title":"SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11975","snapshot_observed_at":"2026-08-02T04:52:42.351670Z","title":"Proceedings of the 19th International Workshop on Semantic Evaluation (SemEval-2025) , year =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:42.351670Z"},"links":{"cited_paper":"/paper/2504.11975","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:9c1bd1f26d6f99932d0e0bda628365fba90b964612b7b1bba764ef8c2ebf36d7","observation_id":"52b3b818-f504-42ec-851f-97b044013cf4","resolution":{"observed_at":"2026-08-02T04:52:42.351670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:42.550491Z","title":"Faiyaz Abdullah , booktitle =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:42.550491Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:d43b8947cb310b1dee74d11d731305033f02bd4b362aff54a3bbb1f33ff7b129","observation_id":"5aa6c31e-d9e4-4845-8fa4-d58eb8e5344f","resolution":{"observed_at":"2026-08-02T04:52:42.550491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07833","last_updated":"2025-03-10T20:24:07Z","snapshot_observed_at":"2026-08-09T23:45:09.215643Z","submitted_at":"2025-03-10T20:24:07Z","title":"HalluVerse25: Fine-grained Multilingual Benchmark Dataset for LLM Hallucinations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07833","snapshot_observed_at":"2026-08-02T04:52:42.769864Z","title":"2503.07833 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:42.769864Z"},"links":{"cited_paper":"/paper/2503.07833","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:216d479666355c76597ce73fb4d9202b50069409b313ca756c8197b6cebb5568","observation_id":"1ed4fb4d-f234-45f0-ab72-300d5838ace2","resolution":{"observed_at":"2026-08-02T04:52:42.769864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15574","last_updated":"2024-04-24T00:24:03Z","snapshot_observed_at":"2026-08-13T00:23:22.242528Z","submitted_at":"2024-04-24T00:24:03Z","title":"Retrieval Head Mechanistically Explains Long-Context Factuality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15574","snapshot_observed_at":"2026-08-02T04:52:42.981569Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:42.981569Z"},"links":{"cited_paper":"/paper/2404.15574","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:dae8d8ea573cc60724c556fd9ec04e67853649e7e7ff5b690a237a524dc33632","observation_id":"c5fcd489-85bd-4766-82cb-123fdc3d0930","resolution":{"observed_at":"2026-08-02T04:52:42.981569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.112361Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.112361Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:08e8177aecda0b413ff9b90a8eccb675bbe6f5b397671d8c3adeac33330cbb4b","observation_id":"b737a39c-6c34-4b6e-a58a-17b3e26ea0af","resolution":{"observed_at":"2026-08-02T04:52:43.112361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.183430Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.183430Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:2ca8fa9b03819d87c3fceec51c4b1e6bb3f80ffb853b21a408cbd3238385c4c8","observation_id":"e644c0f0-0c09-4cab-9e60-049b4a052cce","resolution":{"observed_at":"2026-08-02T04:52:43.183430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.249744Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.249744Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:a2d4653bef27b293a89e704ad77027e71adcfc8da25c96adc51a2918cf314a60","observation_id":"ea3b8a22-bd33-4e48-8135-6d33a6a1fd40","resolution":{"observed_at":"2026-08-02T04:52:43.249744Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.308213Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.308213Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:ca4c457ff8065ebfe00f907c8ea34a445118d462a12c2f9185ab5a479a4ac56a","observation_id":"99b7ad15-e220-405d-b3c4-ec3866a92730","resolution":{"observed_at":"2026-08-02T04:52:43.308213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.378173Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.378173Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:1fad1678a330bbf3198d34574bbd340979d5a17043d471120baa60e1c4f56d31","observation_id":"15978331-1970-497c-8a77-0b1416df98dc","resolution":{"observed_at":"2026-08-02T04:52:43.378173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.494066Z","title":"2024 , howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.494066Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:97aef5e2b884b1a4383ff2e8156d9bb41513124112053ab2766cc03fb5ad3640","observation_id":"c4e52e27-c13e-44a4-ab71-5b44fcc4a02a","resolution":{"observed_at":"2026-08-02T04:52:43.494066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.535579Z","title":"Advances in Neural Information Processing Systems 37 (NeurIPS 2024) , year =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.535579Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:44e25aef82d6917f03e0e9c9f6f5bc4ccc99a3afd5d365ec3f6bd054e9be909c","observation_id":"e8c4bff1-b226-4da0-9a92-ee73f9560d8c","resolution":{"observed_at":"2026-08-02T04:52:43.535579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.597681Z","title":"and Mini, Ulisse and MacDiarmid, Monte , title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.597681Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:8c698e44d557ca0dfe8a482589a76dd68600b50fd94f33f6e2036c67bb688473","observation_id":"ddefda16-5b60-4dfe-b4b8-e97f614c8430","resolution":{"observed_at":"2026-08-02T04:52:43.597681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.664177Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (ACL) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.664177Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:1de3c00aa0eef5f99eaa52fb5f987711ea0a2d1b8a5954348914fdbf5f881347","observation_id":"7ff408a9-c057-4213-8dd9-9269bb6eb85f","resolution":{"observed_at":"2026-08-02T04:52:43.664177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.735445Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.735445Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:a7dc7b1d25c9f39cd979d2234b447d615fde599b0660e4f6587a1bf43e820fff","observation_id":"d4625504-3de2-4533-ad7d-1b2fb0aae636","resolution":{"observed_at":"2026-08-02T04:52:43.735445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.825747Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.825747Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:507e6afd72a155f48025d4c4c6004629a8bf0fa62a6911896842d9e6f41fae4e","observation_id":"7fba4c99-b2ec-4435-8d30-0518f0e1a30b","resolution":{"observed_at":"2026-08-02T04:52:43.825747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:43.958362Z","title":"Journal of Machine Learning Research , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:43.958362Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:03ded7ee659efa649471468c1cc82d3df7bfa8d18abbfd594c29d77047461a3b","observation_id":"4909710c-2b7f-4be7-afa6-3635b8381bff","resolution":{"observed_at":"2026-08-02T04:52:43.958362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:44.148857Z","title":"Advances in Neural Information Processing Systems 30 (NIPS 2017) , year =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:44.148857Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:b4f7928dcc90a99da21c458522bda881b3e1e8ce2de578dc7e47781e288f50b8","observation_id":"1e4eeb5d-22ae-45a1-a1fb-2bb6397a4d93","resolution":{"observed_at":"2026-08-02T04:52:44.148857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:44.310549Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:44.310549Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:b84e2b9deaa9e3e9bed755df1abfba7ea6017841de26075f1aaf1bae41d3902c","observation_id":"4f1c50c2-8300-4e51-860c-d22574803cc3","resolution":{"observed_at":"2026-08-02T04:52:44.310549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12459","last_updated":"2025-04-16T19:50:03Z","snapshot_observed_at":"2026-08-12T18:05:41.807353Z","submitted_at":"2025-04-16T19:50:03Z","title":"On Linear Representations and Pretraining Data Frequency in Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12459","snapshot_observed_at":"2026-08-02T04:52:44.489356Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:44.489356Z"},"links":{"cited_paper":"/paper/2504.12459","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:b2d0e25577fd8ae480d57170fe81492c1f60c467be1cb4972c5ddece0e988182","observation_id":"72086d85-fd50-4d02-ae8f-6cd0aac35639","resolution":{"observed_at":"2026-08-02T04:52:44.489356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.09033","last_updated":"2026-04-17T13:34:13Z","snapshot_observed_at":"2026-08-01T13:12:12.666371Z","submitted_at":"2025-10-10T06:09:04Z","title":"Do LLMs Really Know What They Don't Know? Internal States Mainly Reflect Knowledge Recall Rather Than Truthfulness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.09033","snapshot_observed_at":"2026-08-02T04:52:44.614251Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:44.614251Z"},"links":{"cited_paper":"/paper/2510.09033","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:ebf58366ec1be82e8f4c41261171b3d425e285c14898d102b229952dd4d86b51","observation_id":"9d998643-9fef-41e9-99ac-d1e879238a5e","resolution":{"observed_at":"2026-08-02T04:52:44.614251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:44.809328Z","title":"Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:44.809328Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:b3b572f688db574b9829864a0572aa9682c62b5a787f7c39cdfa90a3d7d736f4","observation_id":"09465626-acb0-436d-b656-82534f3a84e5","resolution":{"observed_at":"2026-08-02T04:52:44.809328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05907","last_updated":"2025-02-17T20:23:19Z","snapshot_observed_at":"2026-08-12T22:49:53.332117Z","submitted_at":"2024-09-06T15:47:40Z","title":"Programming Refusal with Conditional Activation Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05907","snapshot_observed_at":"2026-08-02T04:52:44.968384Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:44.968384Z"},"links":{"cited_paper":"/paper/2409.05907","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:5f2ce123bc68ca5953f2a1adfb2acb130dad1b5281652aacbd28779531bc4516","observation_id":"89bc6b5a-29a2-405d-b803-3040becbe969","resolution":{"observed_at":"2026-08-02T04:52:44.968384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.046734Z","title":"Hallucination Reduction with","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.046734Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:3dff080981bcc10b38eed3e6348e61c26d8ba17c98e8fa2670bc94a2c95d8616","observation_id":"4cb0db19-e492-4702-af63-fcb8fe26a15f","resolution":{"observed_at":"2026-08-02T04:52:45.046734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.193063Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.193063Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:46d155fce8dc3334c5249d153ff7a521c7d7ff0e237586f42203485ad613165f","observation_id":"c4664956-6c7e-4541-a236-80249126bbe4","resolution":{"observed_at":"2026-08-02T04:52:45.193063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03341","last_updated":"2024-06-26T14:11:53Z","snapshot_observed_at":"2026-08-13T19:18:46.730073Z","submitted_at":"2023-06-06T01:26:53Z","title":"Inference-Time Intervention: Eliciting Truthful Answers from a Language Model","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03341","snapshot_observed_at":"2026-08-02T04:52:45.285865Z","title":"Advances in Neural Information Processing Systems 36 (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.285865Z"},"links":{"cited_paper":"/paper/2306.03341","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:bda4682ef88d37674dc46c65c077244a76dff9a425c9d227de241a03b0c64246","observation_id":"de829921-2786-4991-9a72-a6a1f3e49092","resolution":{"observed_at":"2026-08-02T04:52:45.285865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-10T11:37:23.229129Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T04:52:45.338836Z","title":"The Eleventh International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.338836Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:1c54ffffdc3c14ecdd312c77ccc1ec9c51dcb42e72796d1bcc1faf6b5e09a493","observation_id":"d5d3e08a-91a9-4b84-a73b-1f135effb8c3","resolution":{"observed_at":"2026-08-02T04:52:45.338836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-02T04:52:45.394496Z","title":"First Conference on Language Modeling (COLM) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.394496Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:14c49a0552d8c96d16521681c544b35cf151a5ef6dbb8780d3c8d3ab8c858752","observation_id":"d057cc36-4c44-4553-b8b5-2ec8bed672b8","resolution":{"observed_at":"2026-08-02T04:52:45.394496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.446536Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP) , year =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.446536Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:0d2a0bbe68a54f4548f84a2b1b679f63f4c0d46885c0b8b47f2f3ca3f85d9391","observation_id":"3a4d8bbc-c6f3-4c85-b9c6-b065eb58a512","resolution":{"observed_at":"2026-08-02T04:52:45.446536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14183","last_updated":"2024-08-22T07:01:29Z","snapshot_observed_at":"2026-08-13T15:03:54.160476Z","submitted_at":"2023-12-19T14:35:04Z","title":"On Early Detection of Hallucinations in Factual Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14183","snapshot_observed_at":"2026-08-02T04:52:45.486669Z","title":"Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.486669Z"},"links":{"cited_paper":"/paper/2312.14183","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:9e439db877bff409cdc9600dd8e96b20063a73af9f2e0c555c6028fd6de4a690","observation_id":"558193ad-0e40-422e-a3a1-bda9d31abcef","resolution":{"observed_at":"2026-08-02T04:52:45.486669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.535662Z","title":"Do Llamas Work in","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.535662Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:c29b51737b06b21a261cfb3c1cef48bb223b1abb77c138240bcb8b7a732bc2d5","observation_id":"8bb5ff22-2dcb-46db-90ea-adbe8b4d479a","resolution":{"observed_at":"2026-08-02T04:52:45.535662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.591066Z","title":"and Lian, Qing and Wang, Xingyao and Chen, Yangyi and Ji, Heng and Zhang, Tong , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.591066Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:3b3cf7fa4ead7cd341d2c1eeeae98e6a2e39238f41fb2073a4dfee93e41ac843","observation_id":"e454ca9d-5d65-4389-949c-5df707d608f3","resolution":{"observed_at":"2026-08-02T04:52:45.591066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.634036Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.634036Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:11484281f4457dab45c3139275159df98fc8de510838b923e1d0f3f62e1559b6","observation_id":"e739588a-c866-41ab-8f76-52bda51956a7","resolution":{"observed_at":"2026-08-02T04:52:45.634036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14334","last_updated":"2022-06-13T05:04:53Z","snapshot_observed_at":"2026-08-09T23:45:38.167954Z","submitted_at":"2022-05-28T05:02:31Z","title":"Teaching Models to Express Their Uncertainty in Words","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14334","snapshot_observed_at":"2026-08-02T04:52:45.745159Z","title":"Transactions on Machine Learning Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.745159Z"},"links":{"cited_paper":"/paper/2205.14334","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:2d4e78a3941a8ac14b18cac2724f8ab3f8191ab4841db1b60f89920ebeaaf6a5","observation_id":"e6f53da7-b2d9-4d56-a01d-aef6ada79ba0","resolution":{"observed_at":"2026-08-02T04:52:45.745159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.857162Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP) , year =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.857162Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:c7e176e16275fa64c00b1d35631cb188d736168de60d35f2e0bf71d2e768ae21","observation_id":"fb2ae773-e464-4218-8e2f-135cc48ac863","resolution":{"observed_at":"2026-08-02T04:52:45.857162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:52:45.971931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.971931Z"},"links":{"citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:887384638f1af5512c994b48201a596cdb633597c2efa4369a6c7096c19812b1","observation_id":"5187b285-0242-4285-852f-67b15551672b","resolution":{"observed_at":"2026-08-02T04:52:45.971931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2607.13568."}