{"as_of":"2026-08-09T05:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a72f4792bdd7b5f3be0a800ff704f8f291e12aca69a8f9c363596c2507aaff8b","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T09:34:23.475942Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T07:36:43.499258Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21577","snapshot_observed_at":"2026-07-14T07:36:43.499258Z","title":"Collaborative parameter learning: Mitigating forgetting via parameter-level gradient analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11020","last_updated":"2026-07-14T05:59:33Z","snapshot_observed_at":"2026-08-08T18:22:25.527933Z","submitted_at":"2026-07-13T02:39:38Z","title":"Can a Language Model Learn Facts Continually in Its Weights?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:43.499258Z"},"links":{"cited_paper":"/paper/2601.21577","citing_paper":"/paper/2607.11020"},"observation_digest":"sha256:811c47e3c6bdd12adc228e7e3878bbc4595298ec4b9ea333f222e6cea583e59e","observation_id":"5e013853-de42-4363-9b6c-53ed31d8ab7e","resolution":{"observed_at":"2026-07-14T07:36:43.499258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2601.21577/citation-record","integrity":"/paper/2601.21577/integrity","json":"/paper/2601.21577/citation-record.json","paper":"/paper/2601.21577"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:169a5a4852f628a2fa4101cb997466e6d08fe18d1e4b553e6f88105fabd274b6","observation_id":"d5a36b79-2f19-4397-84ac-e043ed312fd4","resolution":{"observed_at":"2026-05-16T09:37:41.653744Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:dbc938bc32c51185018be1ba816ac323c4d870c8cad166c9af8aede0164e1504","observation_id":"acd85973-c994-40d9-a5bf-db8787bcb4e0","resolution":{"observed_at":"2026-05-16T09:37:41.614032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04496","last_updated":"2024-07-23T00:46:37Z","snapshot_observed_at":"2026-07-06T18:26:50.515452Z","submitted_at":"2024-06-06T20:41:36Z","title":"Time Sensitive Knowledge Editing through Efficient Finetuning","version":2},"cited_work":{"arxiv_id":"2406.04496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04496","snapshot_observed_at":"2026-07-03T16:58:43.092756Z","title":"Time sensitive knowledge editing through efficient finetuning.arXiv preprint arXiv:2406.04496","venue":null,"work_id":"0f44370a-c8cc-46a5-9746-386137b2fc54","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2406.04496","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:ea594e1c87e81a08c6f0e4ee05c3d83b6d3fc5c1e0df067e31b0b78994b3abeb","observation_id":"fe343f95-5805-412f-af3f-144610398a21","resolution":{"observed_at":"2026-05-16T09:37:41.594163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:244ed29327f119dcdc8f82aec8186e16663975f01efc0990196b87e3b5fe7841","observation_id":"fb949c5c-c2b0-4c4e-906d-b594839a96e7","resolution":{"observed_at":"2026-05-16T09:37:41.598002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-07T23:01:40.564640Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":"2304.08247","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-07-03T08:17:45.726306Z","title":"Medalpaca–an open-source collection of medical conversational ai models and training data","venue":null,"work_id":"e04d7f5e-abf5-46d9-8a8a-1707106f84bd","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:090ca9c7b1d077d68ab6efdc4521b2da7df0798c19c6c0880f04bd0c9128cbb6","observation_id":"7cf5ee17-471e-4721-9bc4-e2e7901eda67","resolution":{"observed_at":"2026-05-16T09:37:41.650160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:f9aba678449ec8d6606dce04d05f355f45d06fc8a750812cbbbfe71e30d28436","observation_id":"9b72f284-9513-4373-9150-0b6bf68c0418","resolution":{"observed_at":"2026-05-16T09:37:41.610469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:7f07321d78ca4dd96de8f3b4cb85021c58c6598b3c13fc54c37cda79ef7a9567","observation_id":"ae411208-6855-4ce0-93bb-4518282acf59","resolution":{"observed_at":"2026-05-16T09:37:41.664096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Connecting the knowledge dots: Retrieval-augmented knowledge connection for commonsense reasoning","venue":null,"work_id":"58fcb5be-8e48-4489-81e3-478d93e38a36","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:3764fe313da3f95dd5320f16b7ffb8e8ee71c4d8764f46724d2950f3d4448f14","observation_id":"e266c18c-1f68-4c3f-9dd3-94c9f45a6e41","resolution":{"observed_at":"2026-05-16T09:42:42.188537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:3d9d3f44fd739b76cc2c0a9f9c90b7cb7d10a8ab85765637064dd3918d377f54","observation_id":"13bcfbba-cbab-4891-8474-ccade904158d","resolution":{"observed_at":"2026-05-16T09:37:41.606172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10105","last_updated":"2024-04-14T01:15:31Z","snapshot_observed_at":"2026-07-06T16:20:13.025092Z","submitted_at":"2023-09-18T19:28:48Z","title":"Understanding Catastrophic Forgetting in Language Models via Implicit Inference","version":2},"cited_work":{"arxiv_id":"2309.10105","doi":"10.48550/arxiv.2309.10105","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arxiv.2309.10105","venue":"arXiv (Cornell University)","work_id":"62d31a2c-7d11-4b83-b935-1c9164a7ec93","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2309.10105","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:6a597b14bc1e5cfe3d0704d8f03b356543dd17affe3e0bd9150aada7cc7abca2","observation_id":"3cf745ed-7ca6-4416-965d-20756712751e","resolution":{"observed_at":"2026-05-16T09:37:41.658814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04836","last_updated":"2024-06-07T11:09:13Z","snapshot_observed_at":"2026-07-06T18:27:03.044022Z","submitted_at":"2024-06-07T11:09:13Z","title":"Revisiting Catastrophic Forgetting in Large Language Model Tuning","version":1},"cited_work":{"arxiv_id":"2406.04836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04836","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Revisiting catastrophic forgetting in large language model tuning.arXiv preprint arXiv:2406.04836","venue":null,"work_id":"b770be2d-1ed6-4278-8844-c2900da65a0a","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2406.04836","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:b92c94db985f59a5922b071dee55e48db553e1444715d8577534aefa83c78b14","observation_id":"ee4a8779-c9c6-4974-ba2d-c76e963d555f","resolution":{"observed_at":"2026-05-16T09:37:41.602424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Analyzing and reducing catastrophic forgetting in parameter efficient tuning","venue":null,"work_id":"423e5597-a8d0-4db8-a2a9-42580db2cd38","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:8364d1a6acb13f223b074212ca8906319391fc4dba886cb645368143964542d3","observation_id":"93f0729b-837d-4dfa-b692-9472a7a4d39a","resolution":{"observed_at":"2026-05-16T09:42:42.193106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-07-06T14:04:55.099373Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":"2210.07229","doi":"10.48550/arxiv.2210.07229","metadata_source":"pith","pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mass-Editing Memory in a Transformer","venue":"cs.CL","work_id":"03332427-98ba-4287-876a-bb315cbddb1d","year":2022},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:4754a683e99a2307a08cef1faa11f6b402acc9955a902bf06e9020aa733dc29d","observation_id":"dd44a44a-7b67-4d3b-966d-dfa93452b594","resolution":{"observed_at":"2026-05-16T09:37:41.618410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Commonsenseqa: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":"46d9f4cf-4177-4585-a844-fd3a75256887","year":2019},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:99c01a482f0893bc8e1c52d0d0145f1f71b11f3720528f9877564c6ee843f57a","observation_id":"e0f22afc-7ed1-4b31-93dd-fb3f39db77a4","resolution":{"observed_at":"2026-05-16T09:42:42.183709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paths-over-graph: Knowledge graph empowered large language model reasoning","venue":null,"work_id":"871c1347-1c7c-4843-a718-be1a873bd0aa","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:c03e5352f5bc5d8683e6267c3b2326587e5f1b487632d2b20ba805fabc7fd80a","observation_id":"7d97ffa9-3c19-44c9-8adf-9beee5accb4b","resolution":{"observed_at":"2026-05-16T09:42:42.190719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:c44f0fc72d7a6f67c2daa2e19c54eab8d42defd555fd63012a47151ed2c6c6c3","observation_id":"6f5c34c1-b2fa-4c26-8c3c-208407dfdc9d","resolution":{"observed_at":"2026-05-16T09:37:41.641416Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T16:08:17.350515+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02503","last_updated":"2025-07-03T10:11:22Z","snapshot_observed_at":"2026-08-06T20:25:19.241969Z","submitted_at":"2025-07-03T10:11:22Z","title":"Continual Gradient Low-Rank Projection Fine-Tuning for LLMs","version":1},"cited_work":{"arxiv_id":"2507.02503","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02503","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continual gradient low-rank projection fine-tuning for llms.arXiv preprint arXiv:2507.02503","venue":null,"work_id":"2ecc31c9-cc88-4f3b-8792-744eb92037be","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2507.02503","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:5aec23597a23b21f8bb554b651f031b2145e8362d6363402f85e57b2fe53e552","observation_id":"52e83c59-c9e1-46eb-9620-09dec1db033f","resolution":{"observed_at":"2026-05-16T09:37:41.645835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"K-adapter: Infusing knowledge into pre-trained models with adapters","venue":null,"work_id":"b6f2f154-0a3f-43f4-90e8-4cc1b235848f","year":2021},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:11c5936e47bc5ca5da83d733a133e8578f38df189d74ac1392d6ae0d206a3e56","observation_id":"7aa5e7e6-6342-496d-bccf-46b0efc6c8a9","resolution":{"observed_at":"2026-05-16T09:42:42.180887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarking retrieval-augmented generation for medicine","venue":null,"work_id":"dfc11ed2-75a7-4c09-887a-839252f9f334","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:fba5e31c791163a9e4b0dbf9c21cb084edefaabeb053f5402cd90bafc0a149ba","observation_id":"f4b832d8-7df2-411b-b816-8d9177fc3cf0","resolution":{"observed_at":"2026-05-16T09:42:42.185935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:949e8f0cb86f88665cda9ad3e38adf4d6fb57f475b37205dbc342c8cd0ecffef","observation_id":"e5760c54-0820-4ac6-b731-b1a889c04bd3","resolution":{"observed_at":"2026-05-16T09:37:41.628904Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16386","last_updated":"2024-04-23T10:44:01Z","snapshot_observed_at":"2026-07-06T17:21:58.983048Z","submitted_at":"2024-01-29T18:27:52Z","title":"Continual Learning with Pre-Trained Models: A Survey","version":2},"cited_work":{"arxiv_id":"2401.16386","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.16386","snapshot_observed_at":"2026-07-04T02:49:25.503928Z","title":"Con- tinual learning with pre-trained models: A survey","venue":null,"work_id":"283359ab-3ad3-424b-a6b8-89e104f4360b","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2401.16386","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:8545c89b2d6913867e6c004ee8936427b9760f967e43b67456b88c18a25710fa","observation_id":"711f0166-de29-4d34-b105-2b9683d500bc","resolution":{"observed_at":"2026-05-16T09:37:41.625079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.01549","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An information bottleneck perspective for effective noise filtering on retrieval-augmented generation.arXiv preprint arXiv:2406.01549","venue":null,"work_id":"13552968-97e9-4c55-969a-6455a2e79eef","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:ed98d8ef27147ea4a0cde57d73d07e7e4e05abad2a8589fae35a7d441100158a","observation_id":"02b89018-8723-426d-98bd-98b0c6cada50","resolution":{"observed_at":"2026-05-16T09:37:41.637326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06864","last_updated":"2025-02-08T02:14:31Z","snapshot_observed_at":"2026-08-08T19:24:46.685087Z","submitted_at":"2025-02-08T02:14:31Z","title":"Knowledge Graph-Guided Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":"2502.06864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06864","snapshot_observed_at":"2026-07-02T23:47:27.245445Z","title":"Knowledge graph-guided retrieval augmented generation","venue":null,"work_id":"81fa99b0-6c6e-40e6-8391-c0008b405337","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2502.06864","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:ced5898ba032d6ab72a5506c20189c96c69079696e54bc3af0b0ffd0e9276a18","observation_id":"6ed3e21b-dfdd-4899-8cde-ad9feee21481","resolution":{"observed_at":"2026-05-16T09:37:41.633393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":16,"verified_fuzzy":6},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:2601.21577."}