{"as_of":"2026-08-10T04:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af2eee47ed8925ed2665cc063339cea16d9255bd6b815377dc0ad8e1d549a214","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:25:31.903456Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-07T12:25:31.903456Z","title":"A primer on the inner workings of transformer-based language models.arXiv preprint arXiv:2405.00208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24539","last_updated":"2026-07-28T16:02:36Z","snapshot_observed_at":"2026-08-07T14:30:36.260777Z","submitted_at":"2025-05-30T12:46:44Z","title":"Localizing Persona Representations in LLMs","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:25:31.903456Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2505.24539"},"observation_digest":"sha256:08d2ec3b257db7f5d294f36de1956972f6c6a36329e7ad8bf3b36cb1f5bcbda1","observation_id":"cd891a5e-fdcc-4edc-aee8-29bd0f28be5b","resolution":{"observed_at":"2026-08-07T12:25:31.903456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-07T12:00:20.644602Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00829","last_updated":"2025-06-03T16:03:55Z","snapshot_observed_at":"2026-08-08T08:18:37.701965Z","submitted_at":"2025-06-01T04:26:46Z","title":"COMPKE: Complex Question Answering under Knowledge Editing","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:00:20.644602Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2506.00829"},"observation_digest":"sha256:fb442989f8902eef80e0855fd12a4b2bc6ff0ae680a5d89bcc84252f8b899ad1","observation_id":"ff9321fb-f648-45d5-911f-03a2f7b310df","resolution":{"observed_at":"2026-08-07T12:00:20.644602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-07T11:32:41.614831Z","title":"Costa-jussà","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02172","last_updated":"2025-06-02T18:58:41Z","snapshot_observed_at":"2026-08-07T11:26:56.619282Z","submitted_at":"2025-06-02T18:58:41Z","title":"Different Speech Translation Models Encode and Translate Speaker Gender Differently","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:32:41.614831Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2506.02172"},"observation_digest":"sha256:66f23dbed712fa9e3a544be1c31624f7f5ac98d5088617ef27ad916d811c4688","observation_id":"5d965c15-1fd4-4e84-95fd-5844c1471ab9","resolution":{"observed_at":"2026-08-07T11:32:41.614831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-07T05:19:30.100608Z","title":"A primer on the inner workings of transformer-based language models.arXiv preprint arXiv:2405.00208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08359","last_updated":"2026-07-13T06:33:40Z","snapshot_observed_at":"2026-08-08T00:02:40.624808Z","submitted_at":"2025-06-10T02:16:50Z","title":"REAL: Reading Out Transformer Activations for Precise Localization in Language Model Steering","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:19:30.100608Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2506.08359"},"observation_digest":"sha256:b7ac06d45924ee433a9548a3a747433adc28645ecb7e4239d759b2512bb95c29","observation_id":"a7746e88-e267-4a16-ab21-a2c6f35cccb0","resolution":{"observed_at":"2026-08-07T05:19:30.100608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-07T05:27:08.613581Z","title":"Costa-jussà","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10024","last_updated":"2025-06-09T17:57:43Z","snapshot_observed_at":"2026-08-09T19:26:08.293354Z","submitted_at":"2025-06-09T17:57:43Z","title":"Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:27:08.613581Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2506.10024"},"observation_digest":"sha256:073bd65a0b48344f023469a809ca334a7b37db7313d3584b7f195684ea9264c4","observation_id":"d039dfbb-1351-4c27-869b-4fa661590064","resolution":{"observed_at":"2026-08-07T05:27:08.613581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-06T21:26:12.059928Z","title":"Costa-jussà","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00152","last_updated":"2025-06-30T18:04:36Z","snapshot_observed_at":"2026-08-08T00:40:32.050938Z","submitted_at":"2025-06-30T18:04:36Z","title":"Table Understanding and (Multimodal) LLMs: A Cross-Domain Case Study on Scientific vs. Non-Scientific Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T21:26:12.059928Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2507.00152"},"observation_digest":"sha256:4501b69f975c11481ee7c4fae9dd8e8dcf284d85bfbc3ed94f3c036f6f2645e3","observation_id":"969dbf6a-d78c-4991-b7cc-d00e476c2663","resolution":{"observed_at":"2026-08-06T21:26:12.059928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-06T19:53:37.628279Z","title":"arXiv preprint arXiv:2405.00208 (Apr 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04432","last_updated":"2025-07-06T15:35:45Z","snapshot_observed_at":"2026-08-10T00:57:28.846603Z","submitted_at":"2025-07-06T15:35:45Z","title":"Reconstructing Biological Pathways by Applying Selective Incremental Learning to (Very) Small Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:37.628279Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2507.04432"},"observation_digest":"sha256:cdb76d6b8eb4bd80047d946ed39dddcdee8eb2a1c5770e7b1e834a68d259aaf5","observation_id":"a7107925-66e7-4d5e-939b-6ac8c480cc71","resolution":{"observed_at":"2026-08-06T19:53:37.628279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-06T16:19:52.229487Z","title":"A primer on the inner workings of transformer-based language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13858","last_updated":"2025-07-18T12:23:47Z","snapshot_observed_at":"2026-08-08T06:10:45.567459Z","submitted_at":"2025-07-18T12:23:47Z","title":"InTraVisTo: Inside Transformer Visualisation Tool","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:52.229487Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2507.13858"},"observation_digest":"sha256:dbeb2538cb1a26e94cf9c615b79093bd96389fdde0bc1a40bb8cc1e67eff5ca1","observation_id":"33e50dca-6d09-4305-be81-0a65a7de62a0","resolution":{"observed_at":"2026-08-06T16:19:52.229487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-04T15:52:06.284744Z","title":"A primer on the inner workings of transformer-based language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.18010","last_updated":"2026-06-22T14:35:25Z","snapshot_observed_at":"2026-08-06T04:50:51.070686Z","submitted_at":"2025-09-22T16:49:26Z","title":"Cross-Attention is Half Explanation in Speech-to-Text Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T15:52:06.284744Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2509.18010"},"observation_digest":"sha256:10e103237b621a58fe0a3a0ee6a562d51e05db373ad3009eb25a9880d3acd590","observation_id":"6360b106-6c69-4543-bebd-268732f5067c","resolution":{"observed_at":"2026-08-04T15:52:06.284744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2509.18127","last_updated":"2026-04-14T10:00:44Z","snapshot_observed_at":"2026-08-02T17:25:00.233548Z","submitted_at":"2025-09-11T11:22:43Z","title":"Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-18T18:13:01.662828Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2509.18127"},"observation_digest":"sha256:c08a02778e04756dd8c08366a0acfe9c9509d649c416fac0d040148c73441e90","observation_id":"ae9637fe-1be0-4efa-9434-4a352bf193e0","resolution":{"observed_at":"2026-05-18T18:16:43.774882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-04T10:40:26.442823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.09340","last_updated":"2026-06-30T16:53:02Z","snapshot_observed_at":"2026-08-08T13:15:45.460913Z","submitted_at":"2025-10-10T12:49:00Z","title":"Deductive Logic in Language Models: Horizontal vs Vertical Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T10:40:26.442823Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2510.09340"},"observation_digest":"sha256:47c8666f0af808f43b43c31432650e9183d48abfd4f1d969fafdeb420c0152a0","observation_id":"4dd6da5a-0fac-4782-889b-93e2cb759d3b","resolution":{"observed_at":"2026-08-04T10:40:26.442823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-04T09:08:54.428626Z","title":"A Primer on the Inner Workings of Transformer-based Language Models.arXiv preprint arXiv:2405.00208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17256","last_updated":"2026-06-03T19:38:37Z","snapshot_observed_at":"2026-08-08T10:07:33.427560Z","submitted_at":"2025-10-20T07:43:53Z","title":"Explainability of Large Language Models: Opportunities and Challenges toward Generating Trustworthy Explanations","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T09:08:54.428626Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2510.17256"},"observation_digest":"sha256:4e8f656a240bb6864bb0c0312c6017dd4dafa65894d3082c9f42b9a7a77b65b1","observation_id":"f1af8c93-d940-408c-9025-3865fb76a609","resolution":{"observed_at":"2026-08-04T09:08:54.428626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-03T14:02:56.666237Z","title":"A primer on the inner workings of transformer-based language models.arXiv preprint arXiv:2405.00208,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.22088","last_updated":"2026-06-10T15:31:41Z","snapshot_observed_at":"2026-08-09T06:43:58.919201Z","submitted_at":"2025-12-26T17:20:09Z","title":"Unifying Learning Dynamics and Generalization in Transformers Scaling Law","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T14:02:56.666237Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2512.22088"},"observation_digest":"sha256:8f3bd572599c78c2604488bdc50d7365405a75170bf6a9309e23f7937e9ccbf7","observation_id":"11c8130f-c5be-4e8d-8cab-00bd528aee42","resolution":{"observed_at":"2026-08-03T14:02:56.666237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-07-31T09:24:49.481740Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:2908a083d114da60559c832ae5fb67b5895c2b46fdfbf6c160d1fa324d2eb5cd","observation_id":"f53c37eb-ce5e-4382-a38d-c96bc8906a9a","resolution":{"observed_at":"2026-05-16T12:40:54.748973Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-02T22:39:09.674583Z","title":"arXiv:2405.00208 [cs.CL] https://arxiv.org/abs/2405.00208","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16299","last_updated":"2026-07-06T07:51:55Z","snapshot_observed_at":"2026-08-09T07:24:27.924510Z","submitted_at":"2026-02-18T09:30:29Z","title":"MICE: Minimal Interaction Cross-Encoders for efficient Re-ranking","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T22:39:09.674583Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2602.16299"},"observation_digest":"sha256:aee8082cac2825a8678ff18600aec1d4492ae2ca30d09cd1d5132b630f7f1a54","observation_id":"09abdd37-4ecf-4c6e-83e9-0eb4e5e2abb6","resolution":{"observed_at":"2026-08-02T22:39:09.674583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2602.16608","last_updated":"2026-05-19T23:05:11Z","snapshot_observed_at":"2026-08-08T15:26:08.027438Z","submitted_at":"2026-02-18T17:03:10Z","title":"Explainable AI: Context-Aware Layer-Wise Integrated Gradients for Explaining Transformer Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-21T12:46:59.419162Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2602.16608"},"observation_digest":"sha256:de42ff60bac9a53ac6a38931aa0e912489c54c950d281f5e69746cc8521170bc","observation_id":"026ccf86-4225-4276-8128-7c829353877f","resolution":{"observed_at":"2026-05-21T12:50:09.275117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2604.06356","last_updated":"2026-04-07T18:35:47Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:35:47Z","title":"In-Context Learning in Speech Language Models: Analyzing the Role of Acoustic Features, Linguistic Structure, and Induction Heads","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T20:14:21.150863Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2604.06356"},"observation_digest":"sha256:3af3f6cdf2f050b31313a89519c4060885c94e536af2e5276fe35ca8fe417ee1","observation_id":"10668668-0420-40c4-98e8-0eed8aa1a1cf","resolution":{"observed_at":"2026-05-10T22:05:49.019611Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2604.07019","last_updated":"2026-04-08T12:37:39Z","snapshot_observed_at":"2026-07-06T22:55:24.459130Z","submitted_at":"2026-04-08T12:37:39Z","title":"ConceptTracer: Interactive Analysis of Concept Saliency and Selectivity in Neural Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:13:21.974912Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2604.07019"},"observation_digest":"sha256:82553758eb49e6e98d8003994f7981b1a5d79dbe383345039f55d31873307c54","observation_id":"83663496-d765-4e1c-a429-25342bb7063c","resolution":{"observed_at":"2026-05-10T23:20:51.372895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2604.17761","last_updated":"2026-04-20T03:24:11Z","snapshot_observed_at":"2026-08-04T06:40:12.598546Z","submitted_at":"2026-04-20T03:24:11Z","title":"Contrastive Attribution in the Wild: An Interpretability Analysis of LLM Failures on Realistic Benchmarks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T05:12:31.218055Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2604.17761"},"observation_digest":"sha256:d4b41f6d01d567136421f550d3e4d571b7a9b16366d5e0b1cd652c2a384ee3cd","observation_id":"25a79f0f-dd89-4954-bebd-aff1becd1fab","resolution":{"observed_at":"2026-05-10T09:38:42.816884Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.04177","last_updated":"2026-05-05T18:14:59Z","snapshot_observed_at":"2026-07-09T23:16:44.047024Z","submitted_at":"2026-05-05T18:14:59Z","title":"Are LLMs Ready for Conflict Monitoring? Empirical Evidence from West Africa","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-08T17:48:51.792769Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.04177"},"observation_digest":"sha256:1a0f07a34a21f717b45a2c78930a33c8ef2c77b4914858725febc57e43b717de","observation_id":"c562ffef-6152-4ae4-b75a-74d28d7c9c9d","resolution":{"observed_at":"2026-05-11T17:11:18.021348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.09129","last_updated":"2026-05-09T19:20:57Z","snapshot_observed_at":"2026-08-02T09:24:59.983230Z","submitted_at":"2026-05-09T19:20:57Z","title":"Data-driven Circuit Discovery for Interpretability of Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T02:19:45.010301Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.09129"},"observation_digest":"sha256:9ce5459ecfb6aecc64deb68af370676f9dd67ecb2dfce2b8d7db437b39adbf9d","observation_id":"6cc7a763-e24b-4086-b8fd-81fcb49e69ec","resolution":{"observed_at":"2026-05-12T02:21:16.662417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.11093","last_updated":"2026-05-11T18:01:36Z","snapshot_observed_at":"2026-07-06T23:22:57.012338Z","submitted_at":"2026-05-11T18:01:36Z","title":"Enabling Performant and Flexible Model-Internal Observability for LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T07:17:13.823853Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.11093"},"observation_digest":"sha256:89055cc8a28e1f9b8b9d0ad31efb5336321e3905bd7169b434b3cba409e76073","observation_id":"3ee19c8b-1c38-4afc-a82f-f9003397b20b","resolution":{"observed_at":"2026-05-13T07:17:28.083335Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.11206","last_updated":"2026-05-13T08:57:14Z","snapshot_observed_at":"2026-08-05T18:10:32.435834Z","submitted_at":"2026-05-11T20:21:04Z","title":"Instructions Shape Production of Language, not Processing","version":1},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-05-13T03:09:02.902912Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.11206"},"observation_digest":"sha256:824747952eb1a7bef232f92569a0555c544931533611e12c88685c9901338d5d","observation_id":"f714c5e2-0d39-4939-a70c-b660c5e12355","resolution":{"observed_at":"2026-05-13T03:12:09.296748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.11206","last_updated":"2026-05-13T08:57:14Z","snapshot_observed_at":"2026-08-05T18:10:32.435834Z","submitted_at":"2026-05-11T20:21:04Z","title":"Instructions Shape Production of Language, not Processing","version":2},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-05-14T21:02:02.135970Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.11206"},"observation_digest":"sha256:aeff5b4536e7730ea89276d1215f929cffc4f42fcde05ab91fd7fd734b0a70df","observation_id":"d957face-3a0b-471f-9aa8-effa8058e3e4","resolution":{"observed_at":"2026-05-14T21:02:58.204816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.12412","last_updated":"2026-05-12T17:09:41Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:09:41Z","title":"Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-13T05:17:34.283917Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.12412"},"observation_digest":"sha256:991751d4ba3952be8b07834e930129e380c9b9bb3e84a599adbeecf6928fef66","observation_id":"d20cb649-d16e-429e-8140-99aecf524e17","resolution":{"observed_at":"2026-05-13T05:22:18.929668Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.14075","last_updated":"2026-05-13T19:51:25Z","snapshot_observed_at":"2026-08-02T01:26:29.339562Z","submitted_at":"2026-05-13T19:51:25Z","title":"Rethinking Layer Relevance in Large Language Models Beyond Cosine Similarity","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-15T05:05:01.099084Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.14075"},"observation_digest":"sha256:def1df75d69c3bd6db5db7dab98c737931ad95eda516f2055ae2009ac80fa53b","observation_id":"676e7e43-ddd8-49e9-8fcd-52512a69dd4c","resolution":{"observed_at":"2026-05-15T05:09:44.376483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.22532","last_updated":"2026-05-23T09:13:45Z","snapshot_observed_at":"2026-08-02T17:55:32.280248Z","submitted_at":"2026-05-21T14:22:27Z","title":"Relational Linear Properties in Language Models: An Empirical Investigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T07:45:09.743615Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.22532"},"observation_digest":"sha256:9c2619e2a3264efb5fe74832e5be67c5b029bdeb7fcd722fe817930e61cf7ff9","observation_id":"6e249306-266e-478a-ac6b-c035aa77ec84","resolution":{"observed_at":"2026-05-22T07:46:14.986084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2605.22532","last_updated":"2026-05-23T09:13:45Z","snapshot_observed_at":"2026-08-02T17:55:32.280248Z","submitted_at":"2026-05-21T14:22:27Z","title":"Relational Linear Properties in Language Models: An Empirical Investigation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T17:13:03.620676Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2605.22532"},"observation_digest":"sha256:6ab434335a7f4ee14dc7f988eeb0eecfa63a3a83ce89ba714ccfc092f50c9ca0","observation_id":"d9ed1830-ba6f-45ca-8190-44260ed1cec7","resolution":{"observed_at":"2026-06-30T17:14:56.759886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2606.03085","last_updated":"2026-06-02T03:15:35Z","snapshot_observed_at":"2026-07-06T23:43:22.513369Z","submitted_at":"2026-06-02T03:15:35Z","title":"Multi-component Causal Tracing in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T11:52:24.954950Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2606.03085"},"observation_digest":"sha256:5d0ccec4e1a817d612a1027bb8dd453eb812cc97b8edc96d1178a692d1294b00","observation_id":"98d98515-5b4a-422d-aa76-daff08a04ab8","resolution":{"observed_at":"2026-07-02T01:36:24.919128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:946316357b5143beeb88ffaa83e590255fae96b4566b9f17b72f946acfc9a828","observation_id":"8a866893-c40e-4719-84fb-e708dbbc3f9e","resolution":{"observed_at":"2026-06-28T23:32:46.752725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":158,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:6ee84dab39eadc9cb11261e444056fb6c3f51ec46d870da9d989632bd71899c5","observation_id":"aa70353b-9fe2-4354-843f-4502b7615ab5","resolution":{"observed_at":"2026-06-28T23:32:47.304588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2606.09466","last_updated":"2026-06-09T09:48:08Z","snapshot_observed_at":"2026-08-07T14:01:37.853419Z","submitted_at":"2026-06-08T13:21:42Z","title":"DECSELFMASK: Leveraging Unlabeled Text via Self-Relevance-Guided Masking for Decoder-Only Classification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T16:36:10.784902Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2606.09466"},"observation_digest":"sha256:b7e0aadef81d0edc3afa9bfcf6a151eb0f29292a6aed9674f92fb160843c9564","observation_id":"17b1d4fc-ca74-41a8-81d9-4e6feb7269e5","resolution":{"observed_at":"2026-07-03T01:27:30.553886Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2606.24026","last_updated":"2026-06-23T00:04:31Z","snapshot_observed_at":"2026-08-02T11:37:58.639463Z","submitted_at":"2026-06-23T00:04:31Z","title":"Can Language Model Agents be Helpful Circuit Explainers in Mechanistic Interpretability?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T00:47:00.310205Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2606.24026"},"observation_digest":"sha256:d29ee92904f5593987238789f5398e7690da54d68d2e1e9cfb9aaadf8a37ba31","observation_id":"630106ce-c732-46c8-a961-19f73307ba2a","resolution":{"observed_at":"2026-07-04T16:19:57.641510Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":"2405.00208","doi":"10.48550/arxiv.2405.00208","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"e2a1ac9c-a52e-4b96-8aea-1eb401e09698","year":2024},"citing_paper":{"arxiv_id":"2607.00012","last_updated":"2026-05-08T10:35:13Z","snapshot_observed_at":"2026-08-04T21:03:13.172809Z","submitted_at":"2026-05-08T10:35:13Z","title":"PRA-RAG: Provably Robust Aggregation in Retrieval-Augmented Generation against Retrieval Corruption","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-02T23:42:23.695930Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2607.00012"},"observation_digest":"sha256:9d6ededfe1c36c4b96ac16f34ab02d4ac2aa010cd10f7fe1a1cf8c5e97b471f9","observation_id":"6489dc32-5b72-4f04-a3da-eb0acccce6a4","resolution":{"observed_at":"2026-07-02T23:47:27.188119Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"A Primer on the Inner Workings of Transformer-based Language Models.arXiv preprint arXiv:2405.00208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-09T18:25:10.447410Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:0aacd943c546634c3e6b8c2aec2f0b5bd74e80dd046f64ca782303a89d83b0bb","observation_id":"b8170ba8-a3cf-4660-ae68-63ce9d7b66b4","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.00208/citation-record","integrity":"/paper/2405.00208/integrity","json":"/paper/2405.00208/citation-record.json","paper":"/paper/2405.00208"},"outbound":[],"paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:00:54.767580Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2405.00208."}