{"as_of":"2026-08-07T23:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b119d956ec3a9725954a276a4cd9396d2eb9c71fdfef7a045736ee2ff7ff95cd","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:51:54.491362Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01266/citation-record","integrity":"/paper/2506.01266/integrity","json":"/paper/2506.01266/citation-record.json","paper":"/paper/2506.01266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.272478Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.272478Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1a0ffcdfcaa9c39054c1a891d98ab49a2f501cc56731a95788fc195107c05db4","observation_id":"b89bdda8-fa52-4c7e-af61-2f38f5c89343","resolution":{"observed_at":"2026-08-07T11:51:45.272478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.304035Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.304035Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:bc347665ce713e2492ea0d1970018d8a077409206a8cf8a120115ae811c08c24","observation_id":"20acb898-7531-4fc2-bb9f-dc0e2bf351a9","resolution":{"observed_at":"2026-08-07T11:51:45.304035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:51:45.333566Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.333566Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:6387952e5abd3b6e0a27a59cbd4b329bb019c185b8da3c9931e999d1050f5334","observation_id":"6be7d929-abbe-4758-b969-a3675539e5bb","resolution":{"observed_at":"2026-08-07T11:51:45.333566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:04.022072Z","title":null,"venue":null,"work_id":"2923c70d-652a-443f-90ae-0ef87ddf13e2","year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.364356Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:923fedf1924f4e789183baf97a32d2b57219e827e0f0a34fa6f0fbe0e1bf603b","observation_id":"b6863612-2737-4174-b008-bd3b3d3ee3ed","resolution":{"observed_at":"2026-08-07T11:52:04.142692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.395877Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.395877Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:08b81f01df32d73688598be19e73498e9abe458b1b42c3d706886bd8abfc50ec","observation_id":"a679713c-07ea-4dca-972a-26e73c51849d","resolution":{"observed_at":"2026-08-07T11:51:45.395877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03301","last_updated":"2024-04-04T17:41:12Z","snapshot_observed_at":"2026-08-01T20:52:43.105416Z","submitted_at":"2023-11-06T17:49:34Z","title":"Ziya2: Data-centric Learning is All LLMs Need","version":2},"cited_work":{"arxiv_id":"2311.03301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.03301","snapshot_observed_at":"2026-08-07T11:51:56.527748Z","title":"Ziya2: Data-centric Learning is All LLMs Need","venue":"cs.CL","work_id":"c2d086d1-b12d-45cd-84da-32eceeff0af2","year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.426914Z"},"links":{"cited_paper":"/paper/2311.03301","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:ec009d84e80babc3253c7ee204bcb74cae410d7d2d0ab44dae01eea1b9708d8d","observation_id":"40eaaf01-ab00-4cdf-9bf9-0a05778f6242","resolution":{"observed_at":"2026-08-07T11:51:56.715361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.801370Z","title":null,"venue":null,"work_id":"5c5a54aa-e325-42f3-9ddc-229c6c3ffc91","year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.461546Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:f983a9f26e927017352094367a93b21b23f78a9f4e0c0727b5dff1058a56f1e8","observation_id":"36a2baf0-7e55-4bb9-b8bb-0e73a5aa1061","resolution":{"observed_at":"2026-08-07T11:52:03.906447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-03T05:22:23.916601Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-07T11:51:45.524038Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.524038Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:3ba5233b5bc282522b02b98475a2fc2d51d55af2c8a79e2f1895452edbda55b3","observation_id":"97cc80aa-5161-4654-8b2f-d7fee3097039","resolution":{"observed_at":"2026-08-07T11:51:45.524038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.599524Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.599524Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:f5a88fc96f33ccdb5746245810283ffc3abb9e9140ed7799ab454db83cc56f96","observation_id":"dc021cae-e4ef-4b5b-ac49-42ecf781cdfc","resolution":{"observed_at":"2026-08-07T11:51:45.599524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.593413Z","title":null,"venue":null,"work_id":"01f8e4d8-17dd-4b14-80f5-bce9e6d90461","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.644887Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:3d2ad6c3839debbefa20a169742995b77141e034ce0df579a95d40ad1f8e26cd","observation_id":"8ab9c7df-6216-4c80-99c1-8961b32129b1","resolution":{"observed_at":"2026-08-07T11:52:03.678229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.407370Z","title":null,"venue":null,"work_id":"fcd47e3f-def9-42cd-829a-f90f574f1e34","year":2025},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.673129Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:54312d576267ff2fb221d2c20607737f5b5b7f827fd627076ac85f205573d965","observation_id":"13e5232a-b22d-41fe-aa7b-1a76b076c743","resolution":{"observed_at":"2026-08-07T11:52:03.501080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.158431Z","title":null,"venue":null,"work_id":"2e229b0a-38e5-4b93-adb3-7bd75963592a","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.701034Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:5de5439b373b44ae92ec1669f6aa7d3ac079a05e4ddfa7979fdd4898be389c1c","observation_id":"ade7bf5a-a4fd-4569-995c-73b5dfb92e7b","resolution":{"observed_at":"2026-08-07T11:52:03.280322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T11:51:45.730983Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.730983Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:72c0a92f2e81a2166a2903d8a8308ee8d6df75947d914be77d05651de34b44ba","observation_id":"b369b048-ffc6-4cff-9c81-0d800aa88605","resolution":{"observed_at":"2026-08-07T11:51:45.730983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.041891Z","title":null,"venue":null,"work_id":"615d0715-9ad1-4b47-b894-c9e9a97480bb","year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.830582Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:ff444875a7d054defc6d7895d00ecd3fea7bae16d99b72cda3ab0e2130b49947","observation_id":"6b11ce9a-c206-4b83-b10c-f0812214de20","resolution":{"observed_at":"2026-08-07T11:52:03.119915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06367","last_updated":"2020-10-22T14:14:09Z","snapshot_observed_at":"2026-08-07T21:01:20.443312Z","submitted_at":"2020-09-14T17:45:36Z","title":"GeDi: Generative Discriminator Guided Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06367","snapshot_observed_at":"2026-08-07T11:51:45.935133Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.935133Z"},"links":{"cited_paper":"/paper/2009.06367","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:db59b714e3c749639983490403da4972043316443d0baede8bed1a819cd733af","observation_id":"0928d240-736c-4e75-9763-2dd63715be2d","resolution":{"observed_at":"2026-08-07T11:51:45.935133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09573","last_updated":"2023-10-14T12:51:38Z","snapshot_observed_at":"2026-07-06T16:33:04.032904Z","submitted_at":"2023-10-14T12:51:38Z","title":"Self-Detoxifying Language Models via Toxification Reversal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09573","snapshot_observed_at":"2026-08-07T11:51:46.053269Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.053269Z"},"links":{"cited_paper":"/paper/2310.09573","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:5375cdfb231990a56c4d05c0e4ce561a9c49361c6d6ae860c03469a010d25494","observation_id":"a53f86f6-b837-4a99-ad2b-113983bc6c3b","resolution":{"observed_at":"2026-08-07T11:51:46.053269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.902295Z","title":null,"venue":null,"work_id":"64c3c050-af01-4cff-917e-b003353ac3de","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.151659Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:77bb29004be97e644ea22b0f22646ee2ad6d10079094b4ad13194b7b0a2f2026","observation_id":"97660000-f33f-4754-8701-3310dbf88fb4","resolution":{"observed_at":"2026-08-07T11:52:02.974755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03772","last_updated":"2024-10-02T23:15:53Z","snapshot_observed_at":"2026-08-03T10:53:30.869578Z","submitted_at":"2024-10-02T23:15:53Z","title":"Precision Knowledge Editing: Enhancing Safety in Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.03772","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03772","snapshot_observed_at":"2026-08-07T11:51:56.049935Z","title":"Precision Knowledge Editing: Enhancing Safety in Large Language Models","venue":"cs.CL","work_id":"9a776804-e4d3-4b1a-935f-9f70b4223fb2","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.237788Z"},"links":{"cited_paper":"/paper/2410.03772","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1cc3d819138a3b996d7a503a69efb07f78e4738426025a232a637e476cad1647","observation_id":"016cd33c-8500-4650-950d-b7a098a65af6","resolution":{"observed_at":"2026-08-07T11:51:56.293516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T11:51:46.326752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.326752Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:429e23a8b1b16446f9e38c7bb2650ae6a4431063fbdfdf99f66674e027793921","observation_id":"b6b49cb8-5d42-4e9f-acc5-1c7f8bbca5fc","resolution":{"observed_at":"2026-08-07T11:51:46.326752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:46.402957Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.402957Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:30f4c534ce643ca0558efb4aaed7eae19fe34eddd5ca1e06494211a2fe593741","observation_id":"f92ee00c-3f18-48b7-9c1a-98bb007513a9","resolution":{"observed_at":"2026-08-07T11:51:46.402957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:46.476104Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.476104Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:657d1c34c70f82007219444a4800d9ac138af41910f1be13e2955f35646845f1","observation_id":"e86c3c7a-4930-48b7-830f-c729ad1297e0","resolution":{"observed_at":"2026-08-07T11:51:46.476104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-07T11:51:46.551565Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.551565Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:9f85207c83c2921424ec171c8ab246d8bdf0f3c7121b99983dbdcc46aa887b0c","observation_id":"ac449988-62f8-4712-83df-351a9a7db8bb","resolution":{"observed_at":"2026-08-07T11:51:46.551565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06947","last_updated":"2024-01-13T01:46:20Z","snapshot_observed_at":"2026-08-03T23:32:37.774749Z","submitted_at":"2024-01-13T01:46:20Z","title":"Parameter-Efficient Detoxification with Contrastive Decoding","version":1},"cited_work":{"arxiv_id":"2401.06947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.06947","snapshot_observed_at":"2026-08-07T11:51:55.610600Z","title":"Parameter-Efficient Detoxification with Contrastive Decoding","venue":"cs.CL","work_id":"f4e02a96-20a1-4ae3-9b34-afeba818dfbd","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.641084Z"},"links":{"cited_paper":"/paper/2401.06947","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:d181e43afabaa1fe2c55df77ad598c81e2ec696d2cd8474a021e5dfd4c34b464","observation_id":"ff750c46-6b22-4fb8-8a5a-04863c8fcb3e","resolution":{"observed_at":"2026-08-07T11:51:55.719667Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.714223Z","title":null,"venue":null,"work_id":"3ad1f99f-1867-4bdd-808b-a2a80fc7972e","year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.755987Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:00016f8c38724c48eb51fec8e8e8e31e6d759329716cbaa6b036b8838288d513","observation_id":"b4b8de2f-d822-4963-8cfd-74d13705dcb4","resolution":{"observed_at":"2026-08-07T11:52:02.781299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T11:51:46.840713Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.840713Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:3c20f88fe119a2f0bc4d7b8f71f3fbbf99b15021b990f318bc80bcf42d18d7f0","observation_id":"1eb3da40-2bbc-46d0-9eaf-6016d3d7e52c","resolution":{"observed_at":"2026-08-07T11:51:46.840713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.521517Z","title":null,"venue":null,"work_id":"3c1cb3a4-d323-48e2-a12c-e64259d7e479","year":2014},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.920151Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:cad738b602a5831212cf20cf0c924d9924644f3b765e9ab1cab99dbf24e810fe","observation_id":"06349381-7883-45cd-a579-a66af14320c6","resolution":{"observed_at":"2026-08-07T11:52:02.616160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:47.048666Z","title":"Peters, Mark Neumann, Mohit Iyyer, Matt Gardner, Christopher Clark, Kenton Lee, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.048666Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:2d9a52c1438d3c8d407ed6719b318661c8a2daaa1e655f1fc9deeaa01bc06a5e","observation_id":"10828be9-e92e-4d9d-b240-01634ddabaf0","resolution":{"observed_at":"2026-08-07T11:51:47.048666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.362642Z","title":null,"venue":null,"work_id":"9e8494d4-e4c2-4f33-a0a9-76fff0e74f35","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.186646Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:da2f16f531468bda7b160ea9c6997ef47cc3155c6ef9bd0df47626b199319f8e","observation_id":"d0599b91-af16-4420-a3f3-76c91bd425d9","resolution":{"observed_at":"2026-08-07T11:52:02.435758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.194729Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":"6fed4f8e-6aec-4bd1-be56-cad9c0ae5d50","year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.425663Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:998c424bec1f78e5304597148e238b35a124dc42e1f1a519fd10999d434d94ed","observation_id":"00e05e4a-2bc7-486f-8c7b-66fe99146878","resolution":{"observed_at":"2026-08-07T11:52:02.287963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.017356Z","title":null,"venue":null,"work_id":"c5c061c0-e93d-4e9a-a351-88d686498bb0","year":2021},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.678852Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:ab7c70097e30fb4d7c9bb13ee97e0c1ce958e34638b33f095caf3108098a7eea","observation_id":"26b6142c-5166-406b-927e-f24aae360ca7","resolution":{"observed_at":"2026-08-07T11:52:02.095429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:47.834752Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.834752Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:ddc7635a01af83b4229dad54e5d5b5ab9d8db6c6424e6d05fb949d79612c410e","observation_id":"93a055b5-6c24-4c7b-883a-4ac523369648","resolution":{"observed_at":"2026-08-07T11:51:47.834752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:47.904434Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.904434Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1688d20941ccc03d7102ac134e25870a74bcfbfa37251d4d6fedfb1c94fbbac4","observation_id":"eeabb20c-47ab-4542-8326-239378930f87","resolution":{"observed_at":"2026-08-07T11:51:47.904434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:01.834095Z","title":null,"venue":null,"work_id":"0f7baf1a-5768-4714-9b17-5ee13730a6e6","year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.961916Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:4113b42b18c1c0d65b481120889189ea12332e0e77a5eff02ee055309260be49","observation_id":"b5d80c8a-968b-4eaf-905d-50cbfe38a651","resolution":{"observed_at":"2026-08-07T11:52:01.912627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:00.548213Z","title":null,"venue":null,"work_id":"a8ce06b3-d667-4adc-8865-4e08849afbe6","year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.022425Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:730e30966810b34fff20421791ff04b66542a8bf22204859b3618c39e44650a7","observation_id":"4bb94026-2d27-4793-ae04-62a27ef08797","resolution":{"observed_at":"2026-08-07T11:52:01.205023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.01279","last_updated":"2021-05-04T04:08:58Z","snapshot_observed_at":"2026-08-04T19:01:56.567591Z","submitted_at":"2021-05-04T04:08:58Z","title":"ZEN 2.0: Continue Training and Adaption for N-gram Enhanced Text Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.01279","snapshot_observed_at":"2026-08-07T11:51:48.152786Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.152786Z"},"links":{"cited_paper":"/paper/2105.01279","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:976e929fee28cd26ea6068765afc9f14f2a07b3c7618ab62c55dd600cc35830c","observation_id":"9edaf56a-78b6-45dd-aba5-94c27b9fddc4","resolution":{"observed_at":"2026-08-07T11:51:48.152786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:48.328718Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.328718Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:c8551db8272cc688cb461d5be0dcb03d6c6c16ddd8507a09060606729f326778","observation_id":"bed7ebfc-c274-4607-8b60-7f9b37f9d9cc","resolution":{"observed_at":"2026-08-07T11:51:48.328718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:48.514174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.514174Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:e62c75692ebaebb3bf69a181dab77ba0f167fbbb70439fc91b7151a62ebf291b","observation_id":"c942f8a5-1c0f-49a6-825f-f6e59c35dc7e","resolution":{"observed_at":"2026-08-07T11:51:48.514174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:48.761372Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.761372Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:aceea92fbe1ba9e1acbcf6b607cd869c82368b79c865083c8de5c7c8b4c1e941","observation_id":"4eff3e0d-489d-4049-bfed-78516ee1fd8a","resolution":{"observed_at":"2026-08-07T11:51:48.761372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:59.792222Z","title":null,"venue":null,"work_id":"db664730-2479-40ce-ad9e-d6a52f62db18","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.976916Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:3867ba741a1141758d3056fe470b2a718eec76060004afe03c7770a19ba78257","observation_id":"d3adda92-cfe3-46f2-bcda-1c03309856af","resolution":{"observed_at":"2026-08-07T11:52:00.071296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:59.241141Z","title":null,"venue":null,"work_id":"9a63651a-8743-4c1c-b0c3-8e4b4efcf8c1","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:49.154907Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1b2792c23d7cda265fdb56ac63edf01c5c28afa705f4e5fb1e664b126aacc947","observation_id":"ad73e881-8426-4ee9-bce3-a3e4cc3adf99","resolution":{"observed_at":"2026-08-07T11:51:59.500034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:51:49.331347Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:49.331347Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:96111b2629e7ace932e1a2fefa236483b6f7b9e72c9f84e373b77c29bcb173f9","observation_id":"f6e667d0-dcb9-45be-841c-4b9768301b70","resolution":{"observed_at":"2026-08-07T11:51:49.331347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13967","last_updated":"2025-03-01T01:35:47Z","snapshot_observed_at":"2026-07-06T18:18:12.096996Z","submitted_at":"2024-05-22T20:08:48Z","title":"Model Editing as a Robust and Denoised variant of DPO: A Case Study on Toxicity","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13967","snapshot_observed_at":"2026-08-07T11:51:49.597443Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:49.597443Z"},"links":{"cited_paper":"/paper/2405.13967","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:0e29c42c939a484214991bd366218a95124e40a4944b57bcc7fc5d078cc303fe","observation_id":"baa25229-99c8-470e-8a81-0cd560c40f4a","resolution":{"observed_at":"2026-08-07T11:51:49.597443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:58.314583Z","title":null,"venue":null,"work_id":"0aea7d81-d2a6-409a-92ab-24a2fccb22e3","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:50.029694Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:f85c0eac6e37d2aec69fcfeecd004f1e647c29af4b72ccad761fe456d5064d1f","observation_id":"0e4da451-3a45-4c81-9d64-8d953cb11c8e","resolution":{"observed_at":"2026-08-07T11:51:59.025581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:57.021940Z","title":null,"venue":null,"work_id":"079c3060-e8cb-45d7-bf5a-f5a57959f67a","year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:50.491614Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1144ee15b725ed6c79a8a85f0e4bd0c6044138873206f4d36cf036feb2802d03","observation_id":"863f590a-89a7-40c0-8111-6dd071d76196","resolution":{"observed_at":"2026-08-07T11:51:57.530766Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14472","last_updated":"2024-05-28T09:11:25Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:18:30Z","title":"Detoxifying Large Language Models via Knowledge Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14472","snapshot_observed_at":"2026-08-07T11:51:51.205902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:51.205902Z"},"links":{"cited_paper":"/paper/2403.14472","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:11ac0246bd5bbbdac360253be6fe8361ff72953d49f0d1e462b70e317a60a68a","observation_id":"b1890723-a92b-423f-bed2-768d20cd11e2","resolution":{"observed_at":"2026-08-07T11:51:51.205902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14688","last_updated":"2024-06-18T03:17:18Z","snapshot_observed_at":"2026-07-06T17:20:45.227692Z","submitted_at":"2024-01-26T07:17:50Z","title":"Taiyi-Diffusion-XL: Advancing Bilingual Text-to-Image Generation with Large Vision-Language Model Support","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14688","snapshot_observed_at":"2026-08-07T11:51:52.409165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:52.409165Z"},"links":{"cited_paper":"/paper/2401.14688","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:938602a5d9f6b164226ac6cfa20b8ba454a8b27938247e11b095b47ad673f359","observation_id":"f649639a-6536-4191-b00d-84b1bb1e4f21","resolution":{"observed_at":"2026-08-07T11:51:52.409165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02958","last_updated":"2025-06-17T07:41:08Z","snapshot_observed_at":"2026-08-06T23:39:44.483678Z","submitted_at":"2025-02-05T07:51:32Z","title":"Position: Editing Large Language Models Poses Serious Safety Risks","version":3},"cited_work":{"arxiv_id":"2502.02958","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02958","snapshot_observed_at":"2026-08-07T11:51:55.251367Z","title":"Position: Editing Large Language Models Poses Serious Safety Risks","venue":"cs.CL","work_id":"e67ec0bb-f431-4847-9ee2-87aecd0946dd","year":2025},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:54.491362Z"},"links":{"cited_paper":"/paper/2502.02958","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:f7a86eff13a3b9d824f1fb1899aeaa5eec0aebad17f2b5d4d6071a6f5bb63c08","observation_id":"7290928f-4e26-4d5d-a66e-63c19beb25be","resolution":{"observed_at":"2026-08-07T11:51:55.414117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:44:11.259086Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2506.01266."}