{"as_of":"2026-08-04T11:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec9f53e81d0531c8093f425ea4e89aa733ec83b82405ca54ce559bf1fd5e461a","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:14:59.660318Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:21:30.932283Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T07:26:26.034345Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"cited_work":{"arxiv_id":"2602.10352","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.10352","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bdd0f17c-30eb-4805-8385-b671bcf694c2","year":null},"citing_paper":{"arxiv_id":"2605.08837","last_updated":"2026-05-09T09:41:12Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T09:41:12Z","title":"The Grounding Gap: How LLMs Anchor the Meaning of Abstract Concepts Differently from Humans","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-12T03:21:30.932283Z"},"links":{"cited_paper":"/paper/2602.10352","citing_paper":"/paper/2605.08837"},"observation_digest":"sha256:3ea592166ac6cf9600057a476f0ea8f5d69db810bb38f5f8d933415adb0395e9","observation_id":"e6bfdad0-2cc0-4030-804c-e618b691e5a1","resolution":{"observed_at":"2026-06-03T02:05:13.472474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.10352/citation-record","integrity":"/paper/2602.10352/integrity","json":"/paper/2602.10352/citation-record.json","paper":"/paper/2602.10352"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.647413Z","title":"Tell me about","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.647413Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:7feb355ef20726e434de087131ef450a4436dad2b2f2dd1b2dbe80f748729d5c","observation_id":"ed057f1e-cdae-4fdf-bc73-325d66801d0c","resolution":{"observed_at":"2026-08-03T01:14:58.647413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.718966Z","title":"Factorials in combinatorics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.718966Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:01cf089fc3f7dd7716ee6597f8f3f5600322381dfa09597892a8ade97d8f75f7","observation_id":"1b8e4095-0c9a-4f18-875c-7f11a7526bd9","resolution":{"observed_at":"2026-08-03T01:14:58.718966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.232649Z","title":"Tell me about [topic]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.232649Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:1e424fda5ba66f5b6d49d2114b012e9948dcebb2b6fdbf34e56489a3fe424ecb","observation_id":"4c2757a0-0aa2-470a-bc9b-89cf7b502842","resolution":{"observed_at":"2026-08-03T01:14:59.232649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.155823Z","title":"Kissane, C., Krzyzanowski, R., Conmy, A., and Nanda, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.155823Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:1093087877e5560d59c0848edc2f06e099df66e51ddc65165b43837f43054fbe","observation_id":"86d8b7aa-686f-4f73-8bfe-5733b9e62f8e","resolution":{"observed_at":"2026-08-03T01:14:58.155823Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.193388Z","title":"URL https://arxiv.org/abs/2511.08579","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.193388Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:a9a535854605074ae038528dda03df01bc30c9f6eea948fed1f4ce345a44c0ba","observation_id":"4c040916-a8f8-4b11-8907-acb2332be587","resolution":{"observed_at":"2026-08-03T01:14:58.193388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16837","last_updated":"2025-05-31T11:20:49Z","snapshot_observed_at":"2026-08-03T17:13:46.816316Z","submitted_at":"2024-02-26T18:57:54Z","title":"Do Large Language Models Latently Perform Multi-Hop Reasoning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16837","snapshot_observed_at":"2026-08-03T01:14:58.578330Z","title":"teaching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.578330Z"},"links":{"cited_paper":"/paper/2402.16837","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:8e177e0e1208b3f49b91874ea5c28ee409dbee01ecf1e8f5972faabaad6ea52c","observation_id":"1d899097-a7a3-44c9-8a4f-950fb72b03c9","resolution":{"observed_at":"2026-08-03T01:14:58.578330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.986640Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.986640Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:e19d2c5bf9e49cf1273a4e8188aa054ec1b2330d3ba0c9b8fefd17e9109a12e6","observation_id":"8939c515-2167-4bab-a24c-6d8969e8d3ea","resolution":{"observed_at":"2026-08-03T01:14:58.986640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.086880Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.086880Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:944b363508c568de3ff1ba7c7716b9e3ae1fdeac26532b3029ec9c16ce7d25c0","observation_id":"31dd630c-5491-4520-be02-7a8d9d450ca9","resolution":{"observed_at":"2026-08-03T01:14:59.086880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.402782Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.402782Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:ee100e5218ded24fd8a2e8dc2b9b99739b9b30e09765f13b50ed0cee01dbc063","observation_id":"d03c27a0-fd53-43c6-a345-2f194bd66d8b","resolution":{"observed_at":"2026-08-03T01:14:59.402782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.524167Z","title":"Left Ginza","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.524167Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:3c66521f55cace5b325436373340c3d700c127439cb20e0da6b4ef94e79e1d83","observation_id":"f42e4a61-4db6-42d2-ba5e-24fb6d7322c6","resolution":{"observed_at":"2026-08-03T01:14:59.524167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.554865Z","title":"reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.554865Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:6a632afdc9b3263d3afd770ff361c132a932322d53cb07ad6e0add08776c0714","observation_id":"0a16c97a-6e99-4de5-ad89-23360f0470e7","resolution":{"observed_at":"2026-08-03T01:14:59.554865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.572874Z","title":"Tell me about [topic]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.572874Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:5a3a8a510847b3a3989e99d8580b5be3e928c64b150f63ee9956dc7bc2e90d32","observation_id":"2b88c734-a6f3-4eb5-b072-919c81abb261","resolution":{"observed_at":"2026-08-03T01:14:59.572874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.385110Z","title":"Lindsey, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":147,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.385110Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:429cab0812846fdbb657b9d5d7e68c81d068bf0d8c561d18709c3b61620bccab","observation_id":"692a6ed7-739b-47f8-928b-f18a41d9c38d","resolution":{"observed_at":"2026-08-03T01:14:58.385110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03281","last_updated":"2023-08-07T03:52:59Z","snapshot_observed_at":"2026-08-03T21:06:36.343882Z","submitted_at":"2023-08-07T03:52:59Z","title":"Towards General Text Embeddings with Multi-stage Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03281","snapshot_observed_at":"2026-08-03T01:14:58.256692Z","title":"acl-long.353/","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":353,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.256692Z"},"links":{"cited_paper":"/paper/2308.03281","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:2b7aab555cda0774e4da06892b02b1b6e48e4c7c82537be441373383bcf850ac","observation_id":"39a3cf3b-d41d-4ac6-aeed-d48ea1255d0c","resolution":{"observed_at":"2026-08-03T01:14:58.256692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-07-06T19:40:25.975196Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-03T01:14:58.085415Z","title":"Ghandeharioun, A., Caciularu, A., Pearce, A., Dixon, L., and Geva, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":600,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.085415Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:52b5988b636e74cc8153c73462a9d5260bdf7ee2c4d23a95e824fbd18ce31be2","observation_id":"feddd9b1-463e-42c8-acff-10c4c15954d3","resolution":{"observed_at":"2026-08-03T01:14:58.085415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:59.660318Z","title":"Taboo” baseline uses the following prompt: Describe {topic_phrase} without using the word","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:59.660318Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:64f19c9bf26845fb5a7f7add360718a1b09b29f12ebf4aa0f54e7a773afc7887","observation_id":"2ce183c0-aa24-4abe-93b7-f53a37c0f4f2","resolution":{"observed_at":"2026-08-03T01:14:59.660318Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:14:58.480736Z","title":"cc/paper_files/paper/2022/hash/6f1d4 3d5a82a37e89b0665b33bf3a182-Abstrac t-Conference.html","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.480736Z"},"links":{"citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:dcbf5886fc8b4acd523bca70b4549a6332e1ce7d47c23635774d54005c75ccee","observation_id":"10837290-1fcd-4e71-b248-61386805d3a6","resolution":{"observed_at":"2026-08-03T01:14:58.480736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03281","last_updated":"2023-08-07T03:52:59Z","snapshot_observed_at":"2026-08-03T21:06:36.343882Z","submitted_at":"2023-08-07T03:52:59Z","title":"Towards General Text Embeddings with Multi-stage Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03281","snapshot_observed_at":"2026-08-03T01:14:58.325590Z","title":"URL https: //arxiv.org/abs/2308.03281","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.325590Z"},"links":{"cited_paper":"/paper/2308.03281","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:e04b6d1ceb4c4f448d57827261009a2b9ec9ffa6a696fc5ab1f11fef2ba2fd5a","observation_id":"c7cd32bf-f96f-455a-bcdd-f2712dcdd238","resolution":{"observed_at":"2026-08-03T01:14:58.325590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-03T01:14:58.032031Z","title":"Cunningham, H., Ewart, A., Riggs, L., Huben, R., and Sharkey, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.032031Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:95863c64c60afca787075b5e94e99dbb172ab349defb78906121d9b16b519b64","observation_id":"c574c26f-2878-438c-90e7-dddf62e1d865","resolution":{"observed_at":"2026-08-03T01:14:58.032031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-03T01:14:57.994458Z","title":"Belrose, N., Ostrovsky, I., McKinney, L., Furman, Z., Smith, L., Halawi, D., Biderman, S., and Steinhardt, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:57.994458Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:00b4d6fce52c1d1a54cbcb2a0332dfb227865fd42b9d884c7453db98bade5e42","observation_id":"0fc7b930-0c60-4b34-b99b-1ab1adf79c9f","resolution":{"observed_at":"2026-08-03T01:14:57.994458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T01:14:55.796764Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2602.10352."}