{"as_of":"2026-08-07T10:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:51936b07811aec6bd0b1488b0aa76e8f7682d7116a2b0c90f13021ec029993dc","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:54:27.362235Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T09:05:33.034464Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T09:13:16.301066Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"cited_work":{"arxiv_id":"2508.04676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04676","snapshot_observed_at":"2026-06-29T09:13:16.301066Z","title":"Gere: Towards efficient anti-forgetting in continual learning of llm via general samples replay","venue":null,"work_id":"602d5bcc-4b5f-4ed8-8c07-6958e2e45842","year":2023},"citing_paper":{"arxiv_id":"2605.09608","last_updated":"2026-05-10T15:40:44Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T15:40:44Z","title":"Geometry Conflict: Explaining and Controlling Forgetting in LLM Continual Post-Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T02:32:08.672114Z"},"links":{"cited_paper":"/paper/2508.04676","citing_paper":"/paper/2605.09608"},"observation_digest":"sha256:f13887e3c839d79077b14e7b933075a70858db736572600add7c3c3c8de69b5f","observation_id":"b225c227-d422-4b6f-84aa-b32e2baac9d9","resolution":{"observed_at":"2026-05-12T07:31:37.497057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"cited_work":{"arxiv_id":"2508.04676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04676","snapshot_observed_at":"2026-06-29T09:13:16.301066Z","title":"Gere: Towards efficient anti-forgetting in continual learning of llm via general samples replay","venue":null,"work_id":"602d5bcc-4b5f-4ed8-8c07-6958e2e45842","year":2023},"citing_paper":{"arxiv_id":"2605.29495","last_updated":"2026-05-28T07:19:47Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:19:47Z","title":"On-Policy Replay for Continual Supervised Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T09:05:33.034464Z"},"links":{"cited_paper":"/paper/2508.04676","citing_paper":"/paper/2605.29495"},"observation_digest":"sha256:f0545b0b47a0f10231336c5c06abace86588e571f00cbc6eded940a39e2ad445","observation_id":"fb37a9e9-4231-4a3e-9305-faa28754926a","resolution":{"observed_at":"2026-06-29T09:13:16.302628Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.04676/citation-record","integrity":"/paper/2508.04676/integrity","json":"/paper/2508.04676/citation-record.json","paper":"/paper/2508.04676"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-05T23:54:22.998215Z","title":"An empirical study of catastrophic forgetting in large language mod- els during continual fine-tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:22.998215Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:0c0d44330e3a18ec19d7c451ac292b92e57a852c1033da0dcf3566798f1c52be","observation_id":"6f9ed571-e0b6-42aa-a3f0-c67c9f6bb7cb","resolution":{"observed_at":"2026-08-05T23:54:22.998215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.893843Z","title":"Concept-1k: A novel benchmark for instance incremental learning,","venue":null,"work_id":"dbfbc964-f11e-45b0-85dc-822c6da82155","year":null},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.089423Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:2970bac1e7dd6192cf2fe23a6dc361b84c4c0f24cbfa76f173df5c642734cb88","observation_id":"34fa1b53-ec1b-46e7-a916-961858ea1b25","resolution":{"observed_at":"2026-08-05T23:54:28.898085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16789","last_updated":"2024-11-25T05:27:13Z","snapshot_observed_at":"2026-08-06T00:13:40.325158Z","submitted_at":"2024-04-25T17:38:57Z","title":"Continual Learning of Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16789","snapshot_observed_at":"2026-08-05T23:54:23.113997Z","title":"Continual learning of large language models: A comprehensive survey,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.113997Z"},"links":{"cited_paper":"/paper/2404.16789","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:28b757dc9c4ed953b3c4976d0852a7a1bb8163396ebaded818c79d5f320604fa","observation_id":"4aaeacdd-b6ac-4123-b652-20f406154120","resolution":{"observed_at":"2026-08-05T23:54:23.113997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T23:54:23.189170Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.189170Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:c90a1f8de768f3dcf31fe8539a2c61625c4ad6addc0e502d2c0c540a1db7c803","observation_id":"f95199bc-5376-413f-bd75-b630e5e62b99","resolution":{"observed_at":"2026-08-05T23:54:23.189170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T23:54:23.333100Z","title":"Qwen2. 5 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.333100Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:a464e12526d83384ffa05dfcb412a4e1784b85ab877aee8be101ee97ee8f02f6","observation_id":"b4804479-37a6-4ff7-8d97-1f04e3d6bd80","resolution":{"observed_at":"2026-08-05T23:54:23.333100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.881137Z","title":"Emergence of simple-cell recep- tive field properties by learning a sparse code for natural images,","venue":null,"work_id":"2acd2ebf-3341-4234-b9f5-de2494629504","year":1996},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.434574Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:64099a2ee07cb91c3040b0d47e94479e77757bc52028da210289a64dd9d2f55f","observation_id":"a04df5bd-5300-470e-807b-26ef7c2b737e","resolution":{"observed_at":"2026-08-05T23:54:28.884983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.868345Z","title":"Sparse and powerful cortical spikes,","venue":null,"work_id":"e8d89e46-4985-47a3-831d-d9f1062d35dc","year":2010},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.517325Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:ce4669bfe82ec4e9cba8e0958cd7205af679a09059048d52c84c0cfccda83d6b","observation_id":"02fea985-c3d5-4d77-9304-bc2023c8167c","resolution":{"observed_at":"2026-08-05T23:54:28.872631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.855243Z","title":"Continual lifelong learning with neural networks: A review,","venue":null,"work_id":"8c209968-c241-4169-94ac-2eb484eb19a0","year":2019},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.611826Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:f04f6612479cc93e908b657deba17ca58512d057d523b93031080157d9df02fd","observation_id":"45b268ad-5fea-4f87-867b-784a007a4395","resolution":{"observed_at":"2026-08-05T23:54:28.859031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.843425Z","title":"Catastrophic forgetting in connectionist networks,","venue":null,"work_id":"7792f1fb-3128-405b-81f9-78e78e08d66d","year":1999},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.784183Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:6e9b2c8e1b23e5a27ff120dd8cc7e1a33903357230e44b6265498e6f6eac019b","observation_id":"9de862b1-2ff5-455c-89a3-1cd23049e231","resolution":{"observed_at":"2026-08-05T23:54:28.847087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.831220Z","title":"Experience replay for continual learning,","venue":null,"work_id":"7edc1237-f920-496b-b11b-2c2e2faff8e7","year":2019},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.868373Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:4b01fe338baa344656f192d8cba34d86a6b0bdb62dd39980ba865f71b1fbecb9","observation_id":"3281ebca-4aa1-44b1-84c7-44fada9a78c2","resolution":{"observed_at":"2026-08-05T23:54:28.834929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.818403Z","title":"Overcoming catastrophic forgetting in neural networks,","venue":null,"work_id":"e49d939d-cf9a-40b2-8ac2-737aaf65b7c9","year":2017},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:23.984907Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:b8984d11baad284e2e73a0b0733b4ac5558b86251f406477debba63505618ae4","observation_id":"edff8a82-ea57-47a3-b3d5-b8d8911951c7","resolution":{"observed_at":"2026-08-05T23:54:28.822240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.806160Z","title":"Learning without forgetting,","venue":null,"work_id":"05c32c78-9741-4506-bcd2-1a471e9279a4","year":2017},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.095831Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:d66b3384360df888bb6b6f40cb83d5d146df08ecb19e19dd1f26a8d7a1a256c2","observation_id":"c94188ed-ec11-4c8e-8d7a-77cbf6339d6e","resolution":{"observed_at":"2026-08-05T23:54:28.810045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.04671","last_updated":"2022-10-22T14:34:44Z","snapshot_observed_at":"2026-08-05T07:46:46.355580Z","submitted_at":"2016-06-15T08:20:51Z","title":"Progressive Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.04671","snapshot_observed_at":"2026-08-05T23:54:24.202325Z","title":"Progressive neural networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.202325Z"},"links":{"cited_paper":"/paper/1606.04671","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:3fd270892ebf9f131eb8743dbf7dd3b8b45e74e07c82296f019412ed252bb3f7","observation_id":"083411ef-4259-43b3-9a1f-e415a67e6e9a","resolution":{"observed_at":"2026-08-05T23:54:24.202325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.793185Z","title":"Piggyback: Adapting a single network to multiple tasks by learning to mask weights,","venue":null,"work_id":"af2a63ef-6107-47be-a9a5-27f2264ccfe6","year":2018},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.308037Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:96171dd0b8e3321a7c8c1db183b7ce4b2c88dc1a46b1a7cf150ecc9cc780edce","observation_id":"5616900b-bcdf-4387-9ab7-7ae2e72f99c3","resolution":{"observed_at":"2026-08-05T23:54:28.797363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.779993Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"9b67899d-a48c-48b9-8477-d6d246cbc81d","year":2022},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.425878Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:a3099364f19b5fe92b608aa5a01e023cba36305a95306bc7dcf4c069464378ac","observation_id":"6a78c139-2616-48e1-ab19-db622591f10c","resolution":{"observed_at":"2026-08-05T23:54:28.784156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T23:54:24.546774Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.546774Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:73d410a5162253e638c86b5fcbc5e0d6e3b753b51199568f23301583c316706f","observation_id":"baacf0bf-e404-4385-80ef-7a7f350a18b7","resolution":{"observed_at":"2026-08-05T23:54:24.546774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-03T03:32:02.223426Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-05T23:54:24.645078Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.645078Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:8a96674b0a998e06154c41067afa00554cd736a04ae0dedf5cc1f2c76f0dd5ee","observation_id":"007edd1a-73ac-4fef-9230-b6e68172ef28","resolution":{"observed_at":"2026-08-05T23:54:24.645078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-03T15:20:38.939869Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T23:54:24.707388Z","title":"Tinybert: Distilling bert for natural language understand- ing,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.707388Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:3f6c92d10a9f3711968d374f45e21a8de7211d6e6b4fab09007ee25faf748769","observation_id":"0da92d69-bef4-4ab0-bc68-d82858b0e5ab","resolution":{"observed_at":"2026-08-05T23:54:24.707388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12345","last_updated":"2022-07-08T08:43:24Z","snapshot_observed_at":"2026-07-31T04:20:42.801281Z","submitted_at":"2022-03-23T11:56:23Z","title":"Surface Patches with Rounded Corners","version":2},"cited_work":{"arxiv_id":"2203.12345","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.12345","snapshot_observed_at":"2026-08-05T23:54:27.793435Z","title":"Surface Patches with Rounded Corners","venue":"cs.CG","work_id":"9106968b-ca76-4874-bb08-b6c137718ba5","year":2022},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.800249Z"},"links":{"cited_paper":"/paper/2203.12345","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:d09d1e3e8c28897693d4470f37817e93a198685a469f57116d7a3e67bbe777d3","observation_id":"df1fdda1-2051-40eb-b0e4-c9b8b9537b87","resolution":{"observed_at":"2026-08-05T23:54:27.893245Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.766464Z","title":"Localizationdistillationforobjectdetection,","venue":null,"work_id":"06ff960d-776a-4965-90f4-9bc160dd6fae","year":null},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.966819Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:a8cdd20e8588cbd10184ebf26b8c143885e9cbf19ae927512ba10f5a9f559399","observation_id":"ff531de9-3929-4f45-8393-cbd77c24375e","resolution":{"observed_at":"2026-08-05T23:54:28.771134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04567","last_updated":"2023-01-21T01:39:55Z","snapshot_observed_at":"2026-08-03T18:23:59.184075Z","submitted_at":"2023-01-11T16:49:07Z","title":"Chemical profiles of the oxides on tantalum in state of the art superconducting circuits","version":2},"cited_work":{"arxiv_id":"2301.04567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.04567","snapshot_observed_at":"2026-08-05T23:54:27.586283Z","title":"Chemical profiles of the oxides on tantalum in state of the art superconducting circuits","venue":"cond-mat.mtrl-sci","work_id":"ad3d8665-b7f4-4f81-a892-134030e73bb2","year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.133367Z"},"links":{"cited_paper":"/paper/2301.04567","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:6015eb5960f806b43eeff67fdbc2a006cc9700a91ba050aca81043e12523532c","observation_id":"61fe0054-53cb-472b-a5ab-6bfcc14a9e4e","resolution":{"observed_at":"2026-08-05T23:54:27.674978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-05T23:54:25.223218Z","title":"A survey on knowledge distillation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.223218Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:53ebb131758421c45679f57e872f2febc354baffd3fb8baba76272c1f705d33c","observation_id":"eef7f794-b0a5-4d10-bb0e-811e4dca03e1","resolution":{"observed_at":"2026-08-05T23:54:25.223218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T23:54:25.317777Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.317777Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:4953567a7b7695ac5c9abb2146279aec1e06b911250c3ab2ca174004406c0071","observation_id":"7f0119f9-1b5e-452f-8954-104c4aa649cd","resolution":{"observed_at":"2026-08-05T23:54:25.317777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.753496Z","title":"Visualizing the loss landscape of neural nets,","venue":null,"work_id":"807a6992-24c6-4f05-8ef7-1e755b90ed67","year":2018},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.396189Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:dba53ee81e744e6cc0e09edc89682dec342bd6ed178c35c7abbab6f5834a98e9","observation_id":"f4bf4c91-5963-4e14-bdb2-cc91b2b4714e","resolution":{"observed_at":"2026-08-05T23:54:28.757601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.740845Z","title":"A comprehensive survey of continual learning: Theory, method and application,","venue":null,"work_id":"892cdd18-8c19-474a-a7a6-356e9c49ea15","year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.468676Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:7d39820feb62da675f268829e4fa716088c7c579d5cf8cef7735359768f2989a","observation_id":"94811abf-52d1-4a43-bc76-0f780d339cf2","resolution":{"observed_at":"2026-08-05T23:54:28.744917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.727897Z","title":"Slimpajama: A 627b token cleaned and deduplicated version of redpajama,","venue":null,"work_id":"aa4f46e7-674b-4b82-ab6d-7a4a092cb1f1","year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.633939Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:ba80e145285f32d0fb964aed75156718859d8b6d1f6816c7e6ca8a9bddc6b5ad","observation_id":"3a929b2a-efda-4345-bafa-2f24e9a6c531","resolution":{"observed_at":"2026-08-05T23:54:28.732131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.716143Z","title":"Redpajama: an open dataset for training large language models,","venue":null,"work_id":"a38baf68-b716-4d76-b2c5-8843cefaba5d","year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.707000Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:3a428a362b739f192493959d7683fa36a982f32373d290446a541601f97aa768","observation_id":"4c34e90f-2d46-4c4e-845d-b40788dc45e9","resolution":{"observed_at":"2026-08-05T23:54:28.719896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.703821Z","title":"Progressive prompts: Continual learning for lan- guage models,","venue":null,"work_id":"2304f3fc-eed2-4e6f-9cd6-6b13bed8100e","year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.826305Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:29d6c5bdbe030315e483e6ef07878f5ac7ce22d15b59bc38dfbe79cdd1d3b9c4","observation_id":"4d8879a0-3e9c-4024-aa49-dfc99daa7565","resolution":{"observed_at":"2026-08-05T23:54:28.708056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.690222Z","title":"Character-level convolutional networks for text classification,","venue":null,"work_id":"53c176e4-2200-4e00-a29a-623ef18f943a","year":2015},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.907310Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:c43e0cd2149789ba35212f6b02d7f7e9e89013293cd8fde9a16084617474c916","observation_id":"5582fc45-0ec5-4211-83ca-beea9abcb8db","resolution":{"observed_at":"2026-08-05T23:54:28.694534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07298","last_updated":"2022-03-31T02:40:57Z","snapshot_observed_at":"2026-08-05T10:50:54.178336Z","submitted_at":"2021-10-14T12:06:29Z","title":"LFPT5: A Unified Framework for Lifelong Few-shot Language Learning Based on Prompt Tuning of T5","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07298","snapshot_observed_at":"2026-08-05T23:54:25.973883Z","title":"Lfpt5: A unified framework for lifelong few- shot language learning based on prompt tuning of t5,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:25.973883Z"},"links":{"cited_paper":"/paper/2110.07298","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:2afb85b7dacff5da532156fa6592cd961166ba9dec183331011af1542a87f39b","observation_id":"4fdd26e1-cb8d-41eb-ae5b-59f97883515b","resolution":{"observed_at":"2026-08-05T23:54:25.973883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-05T23:54:26.021190Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.021190Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:b8a5ce4f170f5e825a49a5d72150e00c8add64c5f5cd6f9706ea6f31727c30d7","observation_id":"f06783cb-bafa-4877-b610-d823d58b0e62","resolution":{"observed_at":"2026-08-05T23:54:26.021190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.676469Z","title":"Superglue: A stickier benchmark for general-purpose language understanding systems,","venue":null,"work_id":"19c0ab22-59ef-4029-8e48-f3a4147f1064","year":2019},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.154794Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:3b213a5a8114284a56d6e1e2aff501ef41db7bb80b98e1f5beed955431d5188d","observation_id":"fe28f298-9435-491f-be1f-79f9513bd361","resolution":{"observed_at":"2026-08-05T23:54:28.680669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.662712Z","title":"Learning word vectors for sentiment analysis,","venue":null,"work_id":"b5537fff-9ef5-439e-850c-f999212baeb0","year":2011},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.243506Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:06df9bb7237c2c78a55a6bb8a058d896feaef3aaef54bb095ff077a9e983eef6","observation_id":"cf804778-e56f-4f2a-8435-072c306910c1","resolution":{"observed_at":"2026-08-05T23:54:28.667400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T23:54:26.323101Z","title":"Measuring massive multitask language under- standing,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.323101Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:963743132bd030ee149a775150778a6902b5708cfe56b40e9db43096d5778eed","observation_id":"c4f0dff0-f02a-4bd9-b9f6-3ebf141efb66","resolution":{"observed_at":"2026-08-05T23:54:26.323101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.647400Z","title":"Rieman- nian walk for incremental learning: Understanding forgetting and intransigence,","venue":null,"work_id":"9f806795-e7d9-412b-a536-2c33878be883","year":2018},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.439599Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:748eb9f613e9080523cce33fc86edd97f9b4537a6f1ea5aeb658f6205fcf184f","observation_id":"f3f1515c-4ef7-4439-b4ff-5755624734c1","resolution":{"observed_at":"2026-08-05T23:54:28.652075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.631113Z","title":"Logit standardization in knowledge distillation,","venue":null,"work_id":"1bb3ff18-2c30-4672-ab20-9e2edaf1a296","year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.549094Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:b681c71d8604fb6fb613210e69e95b3f546a7914b00d56f3d5373e14eb84193a","observation_id":"0798ddbf-8a42-4238-bd09-80f411bf2df2","resolution":{"observed_at":"2026-08-05T23:54:28.636329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14152","last_updated":"2023-10-22T02:23:44Z","snapshot_observed_at":"2026-08-01T22:59:36.693105Z","submitted_at":"2023-10-22T02:23:44Z","title":"Orthogonal Subspace Learning for Language Model Continual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14152","snapshot_observed_at":"2026-08-05T23:54:26.646447Z","title":"Orthogonal subspace learning for language model continual learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.646447Z"},"links":{"cited_paper":"/paper/2310.14152","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:eebeb47783803bc95fab44a9848458c7c266c228c604ab4529fed7c6e41fe51f","observation_id":"3f8917cb-77d7-4f78-95b2-b74ab483fab2","resolution":{"observed_at":"2026-08-05T23:54:26.646447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.616283Z","title":"Transformers: State-of-the-art natural language processing,","venue":null,"work_id":"50b28fa4-d6be-48df-a9df-e582ebfcca0c","year":2020},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.818822Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:cb73ccd3cef18bfe5f56744ea30eb35bd8358fb27de3efa9eab4e6b4e308a4e3","observation_id":"939a4884-5485-42c7-b050-a8317bb60b7a","resolution":{"observed_at":"2026-08-05T23:54:28.620566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.602042Z","title":"Zero: Memory optimizations toward training trillion parameter models,","venue":null,"work_id":"938f8e25-daf3-42d1-b61f-7ef1c8a8d6d1","year":2020},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.865869Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:a9dc61710250e10ec3b4a6c0c7ad38c598b109c76e4a94d060b84931d5be12f7","observation_id":"6505e89e-c570-4686-b98c-80058f7d2470","resolution":{"observed_at":"2026-08-05T23:54:28.606206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T23:54:26.944641Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:26.944641Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:3420cd90c1bfe2f7c8938c8e9670db59817542ba53c091870c7c66fe35785d11","observation_id":"65e3ea5f-fb0f-4bfc-8f62-4562e1455faa","resolution":{"observed_at":"2026-08-05T23:54:26.944641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-05T23:54:27.028906Z","title":"Lora learns less and forgets less,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:27.028906Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:969c24640f355e96fdaf5ac505e83a59ad20c7e8488efd7c1894f5c569bdd060","observation_id":"20f7bc87-c7a9-4749-ab6c-1aeba422fb72","resolution":{"observed_at":"2026-08-05T23:54:27.028906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.586979Z","title":"Loss of plasticity in deep continual learning,","venue":null,"work_id":"2a18a135-e1c1-4af9-b1c5-9cde8f6f7530","year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:27.129052Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:c95514b9ada341fbec63440548347e33c84f328734552902823a65f7b8afb975","observation_id":"5d91c55c-b95b-42e6-9cef-5f8e755e4b95","resolution":{"observed_at":"2026-08-05T23:54:28.591348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.430211Z","title":"Spurious forgetting in continual learning of language models,","venue":null,"work_id":"e8bd69c5-dd8b-4c1f-a93a-ddb1940a6d1c","year":2025},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:27.317529Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:269617cd7aa984b88905f82f37a1c9b8f20ae318e83621ebfee6b1ec65a2129d","observation_id":"aba289c0-9c0c-4653-8fe1-7eeb71be89c7","resolution":{"observed_at":"2026-08-05T23:54:28.518979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:54:28.157386Z","title":"Editing models with task arithmetic,","venue":null,"work_id":"aa713a6a-d327-492b-b3b5-c8c1eb38d6d3","year":2023},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:27.362235Z"},"links":{"citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:4203fe7c43718e346bf27736824fd86094f0b2aabb01a67103cb505ccd4ee5a9","observation_id":"ab0bd8a1-e975-4d85-bf5d-c0f9ddf1645a","resolution":{"observed_at":"2026-08-05T23:54:28.256520Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2508.04676."}