{"as_of":"2026-08-07T21:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:423edc2752270df4fd53dc42acf111b71d08f2981fdc85278f3691b857fa4773","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:59:49.861333Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25614/citation-record","integrity":"/paper/2607.25614/integrity","json":"/paper/2607.25614/citation-record.json","paper":"/paper/2607.25614"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.766270Z","title":"Nested learning: The illusion of deep learning architectures.arXiv preprint arXiv:2512.24695,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.766270Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:c765417e7b70e9a229155e236ef16b437f6f99fcbf7a5c69f32d631af7bf5fc3","observation_id":"fb559bd6-d0b6-4d0b-8e77-37b2c71a7494","resolution":{"observed_at":"2026-08-01T01:59:49.766270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.861333Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.861333Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:477320b92b7f7fd23c51ce39866b3ce04c6023e306cb5ffee4f343cbc6a6c043","observation_id":"e7c4a55f-1261-4334-80a6-f5a39c1e5400","resolution":{"observed_at":"2026-08-01T01:59:49.861333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-01T01:59:49.781202Z","title":"On the opportunities and risks of foundation models.arXiv preprint arXiv:2108.07258,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.781202Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:a9f26597188db4d3066264b4d53541319d28993ebc6cce69d8fc79e1ab76b064","observation_id":"5fd6c1c4-b4ab-4062-a880-e5da167fda06","resolution":{"observed_at":"2026-08-01T01:59:49.781202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07372","last_updated":"2026-07-12T07:41:31Z","snapshot_observed_at":"2026-08-06T19:10:40.703812Z","submitted_at":"2026-01-12T09:54:49Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07372","snapshot_observed_at":"2026-08-01T01:59:49.791419Z","title":"Conditional memory via scalable lookup: A new axis of sparsity for large language models.arXiv preprint arXiv:2601.07372,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.791419Z"},"links":{"cited_paper":"/paper/2601.07372","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:9cd33143872421f146ad4f3fdc053d817f2ef98032df078462d56d490d5dcb25","observation_id":"9fba827b-e92a-412a-a116-be7990f3b112","resolution":{"observed_at":"2026-08-01T01:59:49.791419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.797566Z","title":"Lawbench: Benchmarking legal knowledge of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.797566Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:4884b193bf3282d8358699a6a78af3f2ce20560199b60fa2545ddbd7bdaf9870","observation_id":"5f12b3f4-e261-4586-acc1-487b1f97f3e1","resolution":{"observed_at":"2026-08-01T01:59:49.797566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.800561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.800561Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:a3ff07df132998e3341cef5e069ed6f5ac302a7c50c576c9e60829a9ec134d8b","observation_id":"172d9212-d55a-4924-88f9-56f814482fd8","resolution":{"observed_at":"2026-08-01T01:59:49.800561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.803728Z","title":"Biology-instructions: A dataset and benchmark for multi-omics sequence understanding capability of large language models.arXiv preprint arXiv:2412.19191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.803728Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:528094a47b49f684a398d7106149f547ed58e9f1f5cb2801f5a32cdfe7246158","observation_id":"e0ab5222-c315-4c54-a4f9-91210d12a5c7","resolution":{"observed_at":"2026-08-01T01:59:49.803728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05605","last_updated":"2024-01-11T00:44:25Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-11T00:44:25Z","title":"Scaling Laws for Forgetting When Fine-Tuning Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05605","snapshot_observed_at":"2026-08-01T01:59:49.806815Z","title":"Scaling laws for forgetting when fine-tuning large language models.arXiv preprint arXiv:2401.05605,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.806815Z"},"links":{"cited_paper":"/paper/2401.05605","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:cd25375dd0ba0a525996b158ffc00823a8316b6c44485eca8b9d545ac0768cd8","observation_id":"2a4cc0e8-e02f-45d7-8bee-36ab3aa6fa80","resolution":{"observed_at":"2026-08-01T01:59:49.806815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00172","last_updated":"2020-02-15T01:04:52Z","snapshot_observed_at":"2026-07-06T08:33:58.970043Z","submitted_at":"2019-11-01T01:09:53Z","title":"Generalization through Memorization: Nearest Neighbor Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00172","snapshot_observed_at":"2026-08-01T01:59:49.810007Z","title":"Generalization through memorization: Nearest neighbor language models.arXiv preprint arXiv:1911.00172,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.810007Z"},"links":{"cited_paper":"/paper/1911.00172","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:c33f225f464117d807f516e7c32b41e789e4ce7c9ed80b20181e7ac2efbd60be","observation_id":"644d2c2a-aa12-4b6b-87a3-66500040f953","resolution":{"observed_at":"2026-08-01T01:59:49.810007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.813332Z","title":"Revisiting catastrophic forgetting in large language model tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.813332Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:455e0608fa00668b3cd4f61c96457a8c91753f417266317f7dd7a3c52a35c100","observation_id":"078f9086-7e4f-4ea8-a15f-8672ce0f2f59","resolution":{"observed_at":"2026-08-01T01:59:49.813332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.816334Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.816334Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:528a9013f2bf0fde2aa524fb87fd988f34250afbeed0247052a49499170256c4","observation_id":"3dc97909-ec0a-4c1c-9af4-9cc36405d763","resolution":{"observed_at":"2026-08-01T01:59:49.816334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.819376Z","title":"More than catastrophic forgetting: Integrating general capabilities for domain-specific llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.819376Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:51cb3f598bbbe12655cf5134f3d860a9a41dc0ea402868b52fa4260090b89ec2","observation_id":"6b1ea18c-7af5-4050-8932-3c84e8fec64c","resolution":{"observed_at":"2026-08-01T01:59:49.819376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.822157Z","title":"Openswi: a massive-scale benchmark dataset for surface wave dispersion curve inversion.Earth System Science Data Discussions, 2025:1–37,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.822157Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:282c258f141842943d862a5c79f2bd5a087135fb3430351215c7513fbaf2341b","observation_id":"38b08e56-fabf-47e1-b2dd-1d2cad791960","resolution":{"observed_at":"2026-08-01T01:59:49.822157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.831062Z","title":"K-adapter: Infusing knowledge into pre-trained models with adapters","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.831062Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:de1a2ee3801b5209c42b8afc86dc7cf6b516a16dfe4c08af6fe955fae8f2c6a0","observation_id":"d2034f67-ce03-4c4a-be68-73b852813996","resolution":{"observed_at":"2026-08-01T01:59:49.831062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-01T01:59:49.833794Z","title":"Finetuned language models are zero-shot learners.arXiv preprint arXiv:2109.01652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.833794Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:378d54dc2d3083ef25b17137647745f743d8900399510a584ef93df532cebd0d","observation_id":"7fb349ae-8d2e-43c3-9eb7-63d15d154403","resolution":{"observed_at":"2026-08-01T01:59:49.833794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08913","last_updated":"2022-03-16T19:54:35Z","snapshot_observed_at":"2026-08-05T11:47:40.727016Z","submitted_at":"2022-03-16T19:54:35Z","title":"Memorizing Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08913","snapshot_observed_at":"2026-08-01T01:59:49.839575Z","title":"Memorizing transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.839575Z"},"links":{"cited_paper":"/paper/2203.08913","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:41fa13aa70835efbe6942f56e48ad83edc528db3073aee079c7b802db62e8d67","observation_id":"df9d31c1-994e-48a6-85b2-5cb092d4baed","resolution":{"observed_at":"2026-08-01T01:59:49.839575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T01:59:49.842509Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.842509Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:95e23db17364cce05662774070e65b298de7dd676143786041b9abbb8eba582b","observation_id":"a8cc3a37-d8c6-4d53-8da7-9208ab44cc40","resolution":{"observed_at":"2026-08-01T01:59:49.842509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01178","last_updated":"2024-07-01T11:07:23Z","snapshot_observed_at":"2026-07-06T18:39:29.270369Z","submitted_at":"2024-07-01T11:07:23Z","title":"$\\text{Memory}^3$: Language Modeling with Explicit Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01178","snapshot_observed_at":"2026-08-01T01:59:49.845780Z","title":"Memory3: Language modeling with explicit memory.arXiv preprint arXiv:2407.01178,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.845780Z"},"links":{"cited_paper":"/paper/2407.01178","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:a46fd2ff20691e8bec9603a0ee4c99265781184fd3919a4e93ada8d5cef3509c","observation_id":"8bf876c6-f133-4777-9c85-42e6014413b5","resolution":{"observed_at":"2026-08-01T01:59:49.845780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09391","last_updated":"2024-08-10T13:28:11Z","snapshot_observed_at":"2026-08-04T14:26:55.582131Z","submitted_at":"2024-02-14T18:42:25Z","title":"LlaSMol: Advancing Large Language Models for Chemistry with a Large-Scale, Comprehensive, High-Quality Instruction Tuning Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09391","snapshot_observed_at":"2026-08-01T01:59:49.848706Z","title":"Llasmol: Advancing large language models for chemistry with a large-scale, comprehensive, high-quality instruction tuning dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.848706Z"},"links":{"cited_paper":"/paper/2402.09391","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:4969221c3a77d1e9546a49e6697592387a29d6f072d13b5032395dd2fa504258","observation_id":"c35b4678-2a49-4c23-a705-72a5b783ad2e","resolution":{"observed_at":"2026-08-01T01:59:49.848706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-01T01:59:49.852324Z","title":"Instruction-following evaluation for large language models.arXiv preprint arXiv:2311.07911,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.852324Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:5479c922eb9a618abe9342e45cea1f4b6440b89b5d556318ba1d109eb172ef6b","observation_id":"302dfb7d-0802-49cc-897f-9237fdd5ed42","resolution":{"observed_at":"2026-08-01T01:59:49.852324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.855248Z","title":"2-10 trigger_word_extraction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.855248Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:9fe0a04ca72baf3ceb20cb6262a6cd670335e62c1697237559e7890f1fa80293","observation_id":"0e835b8c-ccd5-41f1-b29d-9fd9c7925c3f","resolution":{"observed_at":"2026-08-01T01:59:49.855248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.858569Z","title":null,"venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.858569Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:0450f588e39dba8681e4d3ce1eaa093e98a01a0dca8a613636c8d47d98cdae0f","observation_id":"12c767ba-d2ba-4282-8ce3-8b47011f72d7","resolution":{"observed_at":"2026-08-01T01:59:49.858569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.828263Z","title":"In- clude: Evaluating multilingual language understanding with regional knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.828263Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:6cca9a76bff26643d8767d02249f2914fe56aba218cabc32e3b8108f8f2ff75a","observation_id":"91ec4bc2-563a-4a3c-88ff-fa7a573dc0ab","resolution":{"observed_at":"2026-08-01T01:59:49.828263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-07-06T08:36:43.643240Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-08-01T01:59:49.824935Z","title":"Compressive trans- formers for long-range sequence modelling.arXiv preprint arXiv:1911.05507,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.824935Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:ad99fe838a967fbdf6739ba22c15f24165e05da8943e05607885477be70a5e85","observation_id":"6cad2ed6-b857-4284-aee9-8f1b4fb670f1","resolution":{"observed_at":"2026-08-01T01:59:49.824935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.19276","last_updated":"2026-06-08T02:37:16Z","snapshot_observed_at":"2026-08-06T04:07:58.371903Z","submitted_at":"2026-05-19T02:50:11Z","title":"OpenCompass: A Universal Evaluation Platform for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19276","snapshot_observed_at":"2026-08-01T01:59:49.787962Z","title":"Memory decoder: A pretrained, plug-and-play memory for large language models.Advances in Neural Information Processing Systems, 38:115487–115510, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.787962Z"},"links":{"cited_paper":"/paper/2605.19276","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:59500ce782cedac88dc33cf7675551482db1568baec4b8878f851107adc6d8fc","observation_id":"d9c2fd53-3dc8-4f36-93bc-8a52f7067c9a","resolution":{"observed_at":"2026-08-01T01:59:49.787962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.836797Z","title":"Mlp mem- ory: A retriever-pretrained memory for large language models.arXiv preprint arXiv:2508.01832,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.836797Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:29fa40a7eb9e00f0ba32f3916b5d194ca1d4ad57f8684b1d58a2f944b890d9c0","observation_id":"e79e74aa-a955-4716-bc66-d1e25c7eb940","resolution":{"observed_at":"2026-08-01T01:59:49.836797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.784689Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.784689Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:a5f644bab15679db2a968ff437e49ba735714c760fe533902b014a9ad37cdd12","observation_id":"746c02d1-d3e0-4969-8468-cc27a48cadca","resolution":{"observed_at":"2026-08-01T01:59:49.784689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09428","last_updated":"2025-06-28T02:26:03Z","snapshot_observed_at":"2026-08-07T08:21:32.126750Z","submitted_at":"2025-06-11T06:23:50Z","title":"Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09428","snapshot_observed_at":"2026-08-01T01:59:49.794527Z","title":"Improved supervised fine-tuning for large language models to mitigate catastrophic forgetting.arXiv preprint arXiv:2506.09428,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.794527Z"},"links":{"cited_paper":"/paper/2506.09428","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:0db23c640087f326929532e118df5cabc511f95200b7aa5e833063b00ff63adc","observation_id":"66302a0f-e1f9-48af-8a1f-3809a69c10bb","resolution":{"observed_at":"2026-08-01T01:59:49.794527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T01:59:49.777615Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.777615Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:d901fed13d34c067fa0f7e77ea2a0694813d80160aa870718800ee70769cdea6","observation_id":"ef603cd2-3f3e-472d-9311-0db57add52cf","resolution":{"observed_at":"2026-08-01T01:59:49.777615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09764","last_updated":"2024-12-20T17:36:52Z","snapshot_observed_at":"2026-08-06T02:00:43.818545Z","submitted_at":"2024-12-12T23:56:57Z","title":"Memory Layers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09764","snapshot_observed_at":"2026-08-01T01:59:49.773747Z","title":"Memory layers at scale.arXiv preprint arXiv:2412.09764,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.773747Z"},"links":{"cited_paper":"/paper/2412.09764","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:323efcf0c841a343611cd5c2cd3a5464bed3ab3a39f8f9c40810e24e9b0375d9","observation_id":"434605c4-975c-4aee-81f8-030c3887a850","resolution":{"observed_at":"2026-08-01T01:59:49.773747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.770279Z","title":"Llama-nemotron: Efficient reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.770279Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:933c60936458b46aaca090f023b728ed0c2161c255d02322a4fa3159e39b41b8","observation_id":"0d4e5623-24ae-43bf-86ce-3f5d50e05e2b","resolution":{"observed_at":"2026-08-01T01:59:49.770279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2607.25614."}