{"as_of":"2026-08-06T18:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9a18cd804f75dcfc23fa640191db9a672c9c621a3debfe0628ef367eb1c3aa2","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T22:30:44.520703Z","state":"measured"},{"denominator":152,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":152,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":52,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:24:30.574240Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":45,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"reference_index":200,"source":"pdf_text","source_observed_at":"2026-05-13T02:46:26.957539Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2311.05232"},"observation_digest":"sha256:84ee6ae840af148204956a40bc064155d90bfcc0411a0052d7e96e6983f206ed","observation_id":"0c1e245c-a9df-41ef-8817-a9c7de9009b5","resolution":{"observed_at":"2026-05-13T02:46:27.769211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2401.02458","last_updated":"2026-04-29T07:43:10Z","snapshot_observed_at":"2026-07-29T23:57:44.096283Z","submitted_at":"2024-01-04T08:00:32Z","title":"Data-Centric Foundation Models in Computational Healthcare: A Survey","version":3},"reference_index":180,"source":"pdf_text","source_observed_at":"2026-05-24T04:13:05.328492Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2401.02458"},"observation_digest":"sha256:418b4460e67dd482165fe50adfdf3722f0687391cba7f4aad90c2a05833c1bf4","observation_id":"eff41bd8-5cc5-4d29-80e3-f0366c3c759a","resolution":{"observed_at":"2026-05-24T04:13:53.101265Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-18T11:17:08.108565Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2401.05561"},"observation_digest":"sha256:e110a5a8572a6a2eb2fcc39a8a2ab2b1e5b63f0391b08178064a3cda0c6f749a","observation_id":"5c4d3f45-cc05-44bc-8fc8-e190eb8f5f1b","resolution":{"observed_at":"2026-05-18T11:17:08.440377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-05-17T23:31:11.213552Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2402.13116"},"observation_digest":"sha256:9d4064669064e59912f90ce868fa78302377dac59f05a802fa68fde13bbe33c9","observation_id":"111e065d-3b4d-4da0-bc9d-922e2214f7cd","resolution":{"observed_at":"2026-05-17T23:31:11.657170Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T07:21:39.440092Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2404.13501"},"observation_digest":"sha256:0ba69538480d3ecc77c17ff419cd4eaa290b5990219bf211640dc118f08e5d08","observation_id":"b6f4c71f-f7f6-4e20-a730-1d0debc45709","resolution":{"observed_at":"2026-05-15T07:21:39.700353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2408.12622","last_updated":"2026-05-05T05:31:40Z","snapshot_observed_at":"2026-07-06T19:04:47.884694Z","submitted_at":"2024-08-14T10:32:06Z","title":"The AI risk repository: A meta-review, database, and taxonomy of risks from artificial intelligence","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2408.12622"},"observation_digest":"sha256:c21d76631a63982ef3787555175a113fc659fbba2973677fbb90544ab872d22d","observation_id":"cb1fec76-ea68-4c16-8075-1d38f23c817e","resolution":{"observed_at":"2026-05-23T21:58:29.267806Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2409.02977","last_updated":"2025-12-03T03:33:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:59:41Z","title":"Large Language Model-Based Agents for Software Engineering: A Survey","version":2},"reference_index":285,"source":"pdf_text","source_observed_at":"2026-05-17T12:35:48.170947Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2409.02977"},"observation_digest":"sha256:c3b7f189cd9889686f70a013d1161ecef791f8ef7b179e814fc46a6adb38d52a","observation_id":"06c80a18-f5f5-40c8-867d-a9375cc639f1","resolution":{"observed_at":"2026-05-17T12:35:48.559608Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2409.10102","last_updated":"2026-05-16T07:15:07Z","snapshot_observed_at":"2026-08-04T19:12:49.508911Z","submitted_at":"2024-09-16T09:06:44Z","title":"Trustworthiness in Retrieval-Augmented Generation Systems: A Survey","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T21:08:11.787013Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2409.10102"},"observation_digest":"sha256:5c017828008c8654747b9f0cc547f354ed71f5e7cbf0bf5ea866ef1ec57b9eaa","observation_id":"6b95cbd2-9fbf-4292-9d87-31c568a39992","resolution":{"observed_at":"2026-05-23T21:08:25.850865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:5f7f3ce97a39c39debaaea4ffd0bdc4da6a91275df1fe58a965f84b69dc046d3","observation_id":"c59c3462-0e0c-45dc-a861-7ab0345af97a","resolution":{"observed_at":"2026-05-23T20:58:26.193034Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2410.17196","last_updated":"2024-12-11T15:45:21Z","snapshot_observed_at":"2026-07-06T19:37:56.214143Z","submitted_at":"2024-10-22T17:15:20Z","title":"VoiceBench: Benchmarking LLM-Based Voice Assistants","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-17T00:50:13.841689Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2410.17196"},"observation_digest":"sha256:fb6ca6529823ade176263c8bac1b5b880227a4df73298c4252926322681a48dd","observation_id":"9459b701-cd90-4add-a3ec-386afba2657b","resolution":{"observed_at":"2026-05-17T00:50:13.995652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:69c8f379d2a2a989c8076fc87134a959b0c2b5122f8dee50a454062c0c1795ed","observation_id":"1e092785-dddf-40bf-9b52-4e4d4e51c9c4","resolution":{"observed_at":"2026-05-12T05:42:58.329329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2503.19444","last_updated":"2026-04-30T03:28:28Z","snapshot_observed_at":"2026-07-06T20:58:14.950470Z","submitted_at":"2025-03-25T08:35:30Z","title":"AI Failures in the Eyes of the Downstream Developer: A First Look at Concerns, Practices, and Challenges","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-22T23:13:37.570261Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2503.19444"},"observation_digest":"sha256:33d5773db9ecdd05788d4b346d19a27c9f965863a154963504ca745cfea6cd9f","observation_id":"04421911-0776-4065-9396-b010ad2bda3e","resolution":{"observed_at":"2026-05-22T23:15:13.145782Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2505.22073","last_updated":"2025-06-02T19:08:46Z","snapshot_observed_at":"2026-07-06T21:31:59.333003Z","submitted_at":"2025-05-28T07:54:06Z","title":"A Closer Look at the Existing Risks of Generative AI: Mapping the Who, What, and How of Real-World Incidents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T14:11:50.109906Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2505.22073"},"observation_digest":"sha256:c4e49045bb86d159f54adc6e50c73e0c7c9b763c841dec1dfbef80c69f84428c","observation_id":"795b9480-2c04-4ebe-a98b-a3d537712592","resolution":{"observed_at":"2026-05-19T14:12:22.121283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-06T16:24:30.574240Z","title":"Trustworthy llms: a survey and guideline for evaluating large language models’ alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13629","last_updated":"2025-07-18T03:41:18Z","snapshot_observed_at":"2026-08-06T16:17:24.952667Z","submitted_at":"2025-07-18T03:41:18Z","title":"Large Language Models in Cybersecurity: Applications, Vulnerabilities, and Defense Techniques","version":1},"reference_index":186,"source":"pdf_text","source_observed_at":"2026-08-06T16:24:30.574240Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2507.13629"},"observation_digest":"sha256:486138c8500ebf0f4a740f52f9163ca8316543ac8cb4dca43f87a86dbed757c8","observation_id":"c44292fa-c9c8-45d0-9953-da6d675b64d7","resolution":{"observed_at":"2026-08-06T16:24:30.574240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-06T16:09:19.093234Z","title":"Trustworthy llms: A survey and guide- line for evaluating large language models’ alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14418","last_updated":"2025-07-19T00:15:05Z","snapshot_observed_at":"2026-08-06T15:54:28.158615Z","submitted_at":"2025-07-19T00:15:05Z","title":"Designing Conversational AI to Support Think-Aloud Practice in Technical Interview Preparation for CS Students","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:19.093234Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2507.14418"},"observation_digest":"sha256:6812331d37d3f05372363e2de1c82e352f6ac912748ba5efbd1ec267c91032b5","observation_id":"745b0090-d851-4e13-9112-f91f25bd8cbc","resolution":{"observed_at":"2026-08-06T16:09:19.093234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-06T15:48:01.323942Z","title":"Trustworthy llms: a survey and guideline for evaluating large language models' alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14987","last_updated":"2025-07-20T14:47:03Z","snapshot_observed_at":"2026-08-06T15:41:01.200040Z","submitted_at":"2025-07-20T14:47:03Z","title":"AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:48:01.323942Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2507.14987"},"observation_digest":"sha256:b1085e822f045d01775ad1394d85e219b6cae5671bf999b090e8dd89671ed25e","observation_id":"e6826717-384c-4b13-b4d2-b0eedd7eb3d9","resolution":{"observed_at":"2026-08-06T15:48:01.323942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-06T05:29:15.227219Z","title":"Trustworthy llms: a survey and guideline for evaluating large language models’ alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01781","last_updated":"2025-08-03T14:37:16Z","snapshot_observed_at":"2026-08-06T05:29:07.933755Z","submitted_at":"2025-08-03T14:37:16Z","title":"A comprehensive taxonomy of hallucinations in Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T05:29:15.227219Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2508.01781"},"observation_digest":"sha256:4ed62798878b70742c0dfdf6ed23e5259d2962369bcebd89572657eb3ef43617","observation_id":"02b8932a-1e18-4c97-89ce-ace2f2e300c9","resolution":{"observed_at":"2026-08-06T05:29:15.227219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T15:38:47.219443Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19689","last_updated":"2025-08-27T08:52:47Z","snapshot_observed_at":"2026-08-05T22:14:58.306507Z","submitted_at":"2025-08-27T08:52:47Z","title":"Building Task Bots with Self-learning for Enhanced Adaptability, Extensibility, and Factuality","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-05T15:38:47.219443Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2508.19689"},"observation_digest":"sha256:7825af2e88128d22b31e6ecf0181b05662759451741ac94695c8618e68d51a8b","observation_id":"3458447c-c949-4e73-86cc-f05cb9dc9d8a","resolution":{"observed_at":"2026-08-05T15:38:47.219443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T15:26:33.452715Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19870","last_updated":"2025-08-27T13:33:35Z","snapshot_observed_at":"2026-08-05T15:26:32.026741Z","submitted_at":"2025-08-27T13:33:35Z","title":"Secure Multi-LLM Agentic AI and Agentification for Edge General Intelligence by Zero-Trust: A Survey","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:33.452715Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2508.19870"},"observation_digest":"sha256:4c1cebf54a07db96e1496785a9393ef3f2e0d5123a5e52b8643bd4ba5074914d","observation_id":"0a2d3a5b-5edf-4b34-abff-04629fb200f2","resolution":{"observed_at":"2026-08-05T15:26:33.452715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2509.06572","last_updated":"2026-05-01T11:41:26Z","snapshot_observed_at":"2026-07-06T22:25:48.473217Z","submitted_at":"2025-09-08T11:35:32Z","title":"Parasites in the Toolchain: A Large-Scale Analysis of Attacks on the MCP Ecosystem","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T18:43:35.072919Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2509.06572"},"observation_digest":"sha256:fd43e09b68be848afe1e0d2a2ccbfb8ebb49fd65742f3591952e209f78e91fd4","observation_id":"9425bf27-1adf-460c-9dd8-faba0bf5efc8","resolution":{"observed_at":"2026-05-18T18:46:45.269067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-04T23:09:41.513177Z","title":"Trustworthy llms: a survey and guide- line for evaluating large language models’ alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.513177Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:ef1e4ee0e9e35b7307bc5630a54a52448a0dc5ae26270f167367794872c566fb","observation_id":"64bd5f15-fa7e-4f0d-b2ed-e26b626adbd3","resolution":{"observed_at":"2026-08-04T23:09:41.513177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-04T23:03:16.359879Z","title":"Trustworthy llms: a survey and guideline for evaluating large language models’ alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06838","last_updated":"2025-09-08T16:08:31Z","snapshot_observed_at":"2026-08-06T12:07:18.275537Z","submitted_at":"2025-09-08T16:08:31Z","title":"EPT Benchmark: Evaluation of Persian Trustworthiness in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T23:03:16.359879Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2509.06838"},"observation_digest":"sha256:00165c729d44cf96c1fe41fdd267d654ff87ba0f7eafd825b64bbca45eca95bd","observation_id":"c987e023-83b4-4036-b350-9cf674e405a9","resolution":{"observed_at":"2026-08-04T23:03:16.359879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-04T21:33:54.414142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07925","last_updated":"2025-09-09T17:07:44Z","snapshot_observed_at":"2026-08-04T21:33:50.816452Z","submitted_at":"2025-09-09T17:07:44Z","title":"GENUINE: Graph Enhanced Multi-level Uncertainty Estimation for Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T21:33:54.414142Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2509.07925"},"observation_digest":"sha256:2046b7ebc491f53ffff1bc7f3852e49fe229c208bc44a434e59a1ef380324bda","observation_id":"f07f4fb3-2299-4f3c-8eb6-6e9a0d72efd6","resolution":{"observed_at":"2026-08-04T21:33:54.414142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-04T16:37:26.708756Z","title":"Trustworthy LLMs: a survey and guideline for evaluating large language models’ alignment.CoRR, abs/2308.05374, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12752","last_updated":"2026-06-10T12:19:54Z","snapshot_observed_at":"2026-08-04T16:37:21.461167Z","submitted_at":"2025-09-16T07:14:22Z","title":"Participatory AI: A Scandinavian Approach to Human-Centered AI","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T16:37:26.708756Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2509.12752"},"observation_digest":"sha256:171d02b6129a40e94e8b4435f70412d37134fa51905762431b00c9171c6ae925","observation_id":"e96ec60c-ca14-4e20-b5aa-047a8f2406a0","resolution":{"observed_at":"2026-08-04T16:37:26.708756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2510.07239","last_updated":"2026-05-17T13:01:38Z","snapshot_observed_at":"2026-08-02T19:25:51.433055Z","submitted_at":"2025-10-08T17:06:20Z","title":"Red-Bandit: Test-Time Adaptation for LLM Red-Teaming via Bandit-Guided LoRA Experts","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T20:53:58.198974Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2510.07239"},"observation_digest":"sha256:2ec7abbe3fd473d9c7273d32a9962f94bc5d43542fac0c1d1c2061ef04366720","observation_id":"f7384618-bb2e-40ea-8c1f-d7b2023f0900","resolution":{"observed_at":"2026-05-21T20:54:21.558206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2510.21293","last_updated":"2025-10-28T15:20:05Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T09:40:38Z","title":"Understanding AI Trustworthiness: A Scoping Review of AIES & FAccT Articles","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T04:58:03.198620Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2510.21293"},"observation_digest":"sha256:a1d5bae47e48b7cdfed232ed42ee73bb352410d1137e5c737a75202e97f4189e","observation_id":"fbc28f63-343f-40e5-aace-bcbe2c61c29f","resolution":{"observed_at":"2026-05-18T05:00:54.818170Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2511.10287","last_updated":"2026-04-07T03:18:14Z","snapshot_observed_at":"2026-08-06T15:36:32.422302Z","submitted_at":"2025-11-13T13:18:27Z","title":"OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T22:29:36.960961Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2511.10287"},"observation_digest":"sha256:04040492d6eddad47cf9f74e1178e15b722fae7316d7bf4aae3b4ba9ef792a28","observation_id":"55380fa7-9fa9-4b1c-b990-133244ef57da","resolution":{"observed_at":"2026-05-17T22:30:23.271111Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-03T20:37:39.306149Z","title":"InSocially Responsible Language Modelling Research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19166","last_updated":"2026-07-21T15:21:25Z","snapshot_observed_at":"2026-08-03T20:37:36.623362Z","submitted_at":"2025-11-24T14:28:50Z","title":"Epistemic Familiarity is Associated With Belief Stability in Large Language Models","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T20:37:39.306149Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2511.19166"},"observation_digest":"sha256:80140802cc5cf6b6facce63be61dd0f1a7000cd5a1a3341d7cc97c033077619b","observation_id":"c454e0c4-d206-4f71-b36f-2dbe54ee528b","resolution":{"observed_at":"2026-08-03T20:37:39.306149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.07655","last_updated":"2026-04-08T23:47:29Z","snapshot_observed_at":"2026-08-02T09:41:13.361711Z","submitted_at":"2026-04-08T23:47:29Z","title":"Guardian-as-an-Advisor: Advancing Next-Generation Guardian Models for Trustworthy LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T17:27:13.339411Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.07655"},"observation_digest":"sha256:67f9aa7f9705d678d224c84a752c494f368493805a1da0381e9cf44471499a83","observation_id":"db5f045e-7fe8-4033-b0a5-b173627bf467","resolution":{"observed_at":"2026-05-11T06:46:36.850370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.07754","last_updated":"2026-04-09T03:20:29Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T03:20:29Z","title":"The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T18:18:56.476698Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.07754"},"observation_digest":"sha256:7d77eefc71281f229cefea64599af1b7b1578a63bf4aeb6f0975c16dc758450a","observation_id":"380c624b-6948-44df-948d-29208e7b1e1c","resolution":{"observed_at":"2026-05-11T00:45:50.646401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.19016","last_updated":"2026-04-21T03:06:50Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:06:50Z","title":"AlignCultura: Towards Culturally Aligned Large Language Models?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-10T02:36:36.854805Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.19016"},"observation_digest":"sha256:99ba7858d881faadc37a7d353f8bff8f6ca2c0df355b483ac4aa85158a4a152a","observation_id":"693d6405-997d-48eb-b461-7c3aa8be26be","resolution":{"observed_at":"2026-05-11T12:56:04.622915Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.19018","last_updated":"2026-04-21T03:09:46Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:09:46Z","title":"Local Linearity of LLMs Enables Activation Steering via Model-Based Linear Optimal Control","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-10T02:31:07.932802Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.19018"},"observation_digest":"sha256:acbe28505c5ca024ed2cb336a4e17653846838e4e6c8ed2e32f718e8804bc89a","observation_id":"4c24c063-ffcb-42ef-a350-8708f222ee3a","resolution":{"observed_at":"2026-05-11T13:01:03.983287Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.27617","last_updated":"2026-05-29T06:33:49Z","snapshot_observed_at":"2026-08-03T00:41:30.252693Z","submitted_at":"2026-04-30T09:08:41Z","title":"Robust Lightweight Crack Classification for Real-Time UAV Bridge Inspection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-01T08:46:12.589636Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.27617"},"observation_digest":"sha256:35d2e742cb418d0d3c20e6f12415478d3509b02ba972cd213400ab0f82329313","observation_id":"563cc766-29b8-4e3f-891b-8f3890b22cd9","resolution":{"observed_at":"2026-07-01T08:55:35.003533Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.27618","last_updated":"2026-07-24T16:21:41Z","snapshot_observed_at":"2026-08-05T18:29:31.920749Z","submitted_at":"2026-04-30T09:08:58Z","title":"Math Education Digital Shadows for Investigating Learning with GenAI: Mathematics Performance, Anxiety, and Confidence in LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T05:24:51.914885Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.27618"},"observation_digest":"sha256:4a171af092b5b95a51da0e8f944af1a677cd85897c025fbc64e9b2bd5115d39e","observation_id":"4e3fd481-1945-446f-8eb3-e7828b980e7b","resolution":{"observed_at":"2026-05-12T10:36:30.514850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-02T15:14:39.209055Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.27618","last_updated":"2026-07-24T16:21:41Z","snapshot_observed_at":"2026-08-05T18:29:31.920749Z","submitted_at":"2026-04-30T09:08:58Z","title":"Math Education Digital Shadows for Investigating Learning with GenAI: Mathematics Performance, Anxiety, and Confidence in LLMs","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T15:14:39.209055Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.27618"},"observation_digest":"sha256:32b1473761eb5681bfc0f1d717c01935dbcb5958ed6aaf768427c05e634b1d91","observation_id":"af4d22c6-cdd9-4048-a40e-3bfe409b1587","resolution":{"observed_at":"2026-08-02T15:14:39.209055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2604.27624","last_updated":"2026-04-30T09:13:08Z","snapshot_observed_at":"2026-07-06T23:13:02.921765Z","submitted_at":"2026-04-30T09:13:08Z","title":"Mapping how LLMs debate societal issues when shadowing human personality traits, sociodemographics and social media behavior","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T07:47:45.964532Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2604.27624"},"observation_digest":"sha256:9c53b6f282fa89be41672d7eefd82bd895e342dcf2a29f247c3210a6a085428b","observation_id":"7c8738c3-8dc8-4df4-b0ff-bec3f9f4aa1e","resolution":{"observed_at":"2026-05-12T10:06:29.224052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.04243","last_updated":"2026-05-05T19:30:06Z","snapshot_observed_at":"2026-07-06T23:17:04.200299Z","submitted_at":"2026-05-05T19:30:06Z","title":"Temporal Reasoning Is Not the Bottleneck: A Probabilistic Inconsistency Framework for Neuro-Symbolic QA","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T17:45:44.270122Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.04243"},"observation_digest":"sha256:6063d5971e6b044b71b4943d1bea0d0798031736c07d341fbb29556e71f7ab64","observation_id":"cdf4023b-c91c-4f89-94e5-ada49c956573","resolution":{"observed_at":"2026-05-11T17:16:07.820357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.10622","last_updated":"2026-05-11T14:16:25Z","snapshot_observed_at":"2026-07-06T23:22:32.858399Z","submitted_at":"2026-05-11T14:16:25Z","title":"Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-12T05:15:34.156717Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.10622"},"observation_digest":"sha256:07cb9a51c8720bec8f01e0a3c56782d59d07e63b55616eab316f5c78d2c0a76d","observation_id":"883636bf-cbfa-40da-8a7d-62ff0b112b82","resolution":{"observed_at":"2026-05-12T05:16:24.376482Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.10639","last_updated":"2026-05-11T14:27:39Z","snapshot_observed_at":"2026-08-02T13:54:55.570407Z","submitted_at":"2026-05-11T14:27:39Z","title":"Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T05:28:45.453455Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.10639"},"observation_digest":"sha256:f7a8e662057a6f5734912fefc5dd6fbf9e2f477a5a478ea1c8b0b084a43f4b47","observation_id":"02f4f25c-da49-4333-bc6c-aac8e2b756cb","resolution":{"observed_at":"2026-05-12T05:31:23.886120Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.11920","last_updated":"2026-05-12T10:36:02Z","snapshot_observed_at":"2026-07-06T23:23:39.723268Z","submitted_at":"2026-05-12T10:36:02Z","title":"Domain Restriction via Multi SAE Layer Transitions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T05:54:21.707023Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.11920"},"observation_digest":"sha256:439710d11340f55048be5a0c965f50f654d8ad356f7afd648305ecd3aec497f2","observation_id":"29880c29-86e2-4153-8db0-a59042aec9c4","resolution":{"observed_at":"2026-05-13T06:02:23.746342Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.13875","last_updated":"2026-05-08T06:56:35Z","snapshot_observed_at":"2026-08-02T22:27:33.584660Z","submitted_at":"2026-05-08T06:56:35Z","title":"Common-agency Games for Multi-Objective Test-Time Alignment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-15T06:14:53.685486Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.13875"},"observation_digest":"sha256:4b9ee8d6273f4e3f6262467b10fb7817c4366387d1544aa2ff993e51ed8c206b","observation_id":"c2f96c2b-78e7-4763-b0d0-02232150cd3d","resolution":{"observed_at":"2026-05-15T06:15:06.339204Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.16776","last_updated":"2026-05-16T03:15:35Z","snapshot_observed_at":"2026-08-01T18:28:14.332482Z","submitted_at":"2026-05-16T03:15:35Z","title":"Distinguishable Deletion: Unifying Knowledge Erasure and Refusal for Large Language Model Unlearning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-19T21:49:07.440832Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.16776"},"observation_digest":"sha256:a395b5bb0dd5eb34da38a37baf4b4929911bb20b729c81743b3cd6aefe4b3dbf","observation_id":"f4fda42b-7ded-4d19-b72b-17fee65f0da7","resolution":{"observed_at":"2026-05-19T21:52:48.315527Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.23989","last_updated":"2026-05-17T10:26:37Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-17T10:26:37Z","title":"Towards trustworthy agentic AI: a comprehensive survey of safety, robustness, privacy, and system security","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T19:18:40.244556Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.23989"},"observation_digest":"sha256:72d1c0b3533682d6aa1d97cb815018b04d196279fd9e474c77f6d5f4989e6e49","observation_id":"73b28cf4-e67d-445a-8527-fa7aabc70d33","resolution":{"observed_at":"2026-06-30T19:45:01.681883Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2605.29473","last_updated":"2026-06-21T04:01:36Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:04:56Z","title":"Inform, Coach, Relate, Listen: Auditing LLM Caregiving Support Roles","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-29T05:54:39.899517Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2605.29473"},"observation_digest":"sha256:bb5eee3f024f09e99de3502f0c367b0a1ade8fa62ef508a6acf6ef1e7d09611d","observation_id":"0655bad0-9c60-4156-aa08-b56a0a44a312","resolution":{"observed_at":"2026-06-29T06:03:08.892014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2606.01212","last_updated":"2026-06-03T04:47:29Z","snapshot_observed_at":"2026-07-06T23:41:48.357871Z","submitted_at":"2026-05-31T13:03:47Z","title":"DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T17:43:41.256808Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2606.01212"},"observation_digest":"sha256:2469972350bbcd69cb9816d3b6b3af6f720fe827f1de77006885fa8c2e4a483e","observation_id":"f8c51b30-888b-4b18-b650-8a1294c4313e","resolution":{"observed_at":"2026-07-01T20:46:13.954372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2606.19744","last_updated":"2026-06-18T03:20:41Z","snapshot_observed_at":"2026-08-03T04:09:34.062205Z","submitted_at":"2026-06-18T03:20:41Z","title":"Beyond Uniform Forgetting: A Study of Sequential Direct Preference Optimization Across Preference Settings","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T18:02:52.726302Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2606.19744"},"observation_digest":"sha256:6843cf115d7c51300025f82d278c72397dbe01ce53d71261570bde4077d8522d","observation_id":"9a55e550-bcac-4e6e-93f2-5e0dd933a71e","resolution":{"observed_at":"2026-07-04T03:29:29.888170Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2606.19950","last_updated":"2026-06-18T08:49:11Z","snapshot_observed_at":"2026-08-06T06:19:12.690187Z","submitted_at":"2026-06-18T08:49:11Z","title":"Confidence Calibration for Multimodal LLMs: An Empirical Study through Medical VQA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T17:49:38.151224Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2606.19950"},"observation_digest":"sha256:ab5f6d0e776bbb393e8a23c35e5fb1a918f45b30cea43454e1501067aa5ec17d","observation_id":"b8cf4919-f76a-4102-807e-423245d1c865","resolution":{"observed_at":"2026-07-04T03:39:30.306955Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2606.21121","last_updated":"2026-06-19T05:47:44Z","snapshot_observed_at":"2026-08-04T13:33:33.678027Z","submitted_at":"2026-06-19T05:47:44Z","title":"Answer Engineering: Local Trajectory Editing for Protocol-Constrained Decision Making in Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-26T14:13:13.678245Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2606.21121"},"observation_digest":"sha256:3611bb5b639582aa83f7c9f8d9e0f18f2c3a4eb0287f376674e8182ecbb84539","observation_id":"5d1b266d-6424-4697-b00c-d40167d299d4","resolution":{"observed_at":"2026-06-26T14:19:31.006531Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-01T07:28:17.063799Z","title":"arXiv preprint arXiv:2308.05374 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21453","last_updated":"2026-07-24T02:14:44Z","snapshot_observed_at":"2026-08-03T14:01:50.133228Z","submitted_at":"2026-07-23T15:55:29Z","title":"Test-Time Scaling via Error Localization","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T07:28:17.063799Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2607.21453"},"observation_digest":"sha256:e07eabbb2e67ba56f65a68ada0789c6d978678d0f8692a0c93a5f55665fad449","observation_id":"33e7de85-4986-4395-ad31-e415250c34d9","resolution":{"observed_at":"2026-08-01T07:28:17.063799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-03T11:36:49.140976Z","title":"arXiv preprint arXiv:2308.05374 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29211","last_updated":"2026-07-31T09:30:33Z","snapshot_observed_at":"2026-08-05T23:12:52.496123Z","submitted_at":"2026-07-31T09:30:33Z","title":"Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-03T11:36:49.140976Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2607.29211"},"observation_digest":"sha256:d1e9d9330bc5a198b92223a7f6811f3828da866d8036ecb918e95c3dfa635064","observation_id":"51d48a3c-1fd4-4576-a9c5-e50ea845fffe","resolution":{"observed_at":"2026-08-03T11:36:49.140976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-04T10:56:17.217228Z","title":"Trustworthy llms: a survey and guideline for evaluating large language models’ alignment.arXiv preprint arXiv:2308.05374, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02238","last_updated":"2026-08-03T13:51:12Z","snapshot_observed_at":"2026-08-06T17:41:53.097143Z","submitted_at":"2026-08-03T13:51:12Z","title":"Trustworthy AI in Digital Health: A Comprehensive Review of Robustness and Explainability","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T10:56:17.217228Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2608.02238"},"observation_digest":"sha256:ef6434def2a043029d659fdb37752ae577bda2e0e7a6c8f893e85fec6db3ec57","observation_id":"ab61dac6-8463-454b-80d2-2f3b800d43f0","resolution":{"observed_at":"2026-08-04T10:56:17.217228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T13:40:56.184932Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03745","last_updated":"2026-08-04T14:38:06Z","snapshot_observed_at":"2026-08-06T17:54:46.551395Z","submitted_at":"2026-08-04T14:38:06Z","title":"Risky Business: Measuring The Faithfulness-Safety Tension","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T13:40:56.184932Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2608.03745"},"observation_digest":"sha256:50ffdc0beaea98172c5c57bfb0b5c9675eafcf99d1113a758cb8b76e1a277e56","observation_id":"0548d452-5576-43af-bac4-3635a75d744b","resolution":{"observed_at":"2026-08-05T13:40:56.184932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2308.05374/citation-record","integrity":"/paper/2308.05374/integrity","json":"/paper/2308.05374/citation-record.json","paper":"/paper/2308.05374"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"843d640e-e399-40c5-8e8f-789cae25da17","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:26c01bd8634db4383785c8e6bb035be3df5880532e615ea58757269c3983901e","observation_id":"e7b3b27a-885b-4a48-b591-c6d8e5609ebc","resolution":{"observed_at":"2026-05-17T22:32:11.894441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14659","last_updated":"2021-03-26T18:01:48Z","snapshot_observed_at":"2026-07-06T10:53:51.296957Z","submitted_at":"2021-03-26T18:01:48Z","title":"Alignment of Language Agents","version":1},"cited_work":{"arxiv_id":"2103.14659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.14659","snapshot_observed_at":"2026-07-04T06:49:37.659279Z","title":"Kenton, T","venue":null,"work_id":"2dc6ed25-0b66-42f5-b67e-eb7e67977011","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2103.14659","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:ca2524c2b5777841964ab9577c03e532be34b4daa56a3b2d919a519c6883b281","observation_id":"074ccdfc-8579-498d-ad3e-0ba673391cb4","resolution":{"observed_at":"2026-05-17T22:30:44.639582Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d644ff37-47a2-4b15-a9ab-83415b8a3a60","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:7f5d9378b67a6857057780723f34dfb376fd9c4c4b0844a94e325ade8908017f","observation_id":"599939dd-21a7-481e-8303-9f1a028499e2","resolution":{"observed_at":"2026-05-17T22:32:11.734435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the dangers of stochastic parrots: Can language models be too big? In Proceedings of the 2021 ACM conference on fairness, accountability, and transparency, pages 610–623","venue":null,"work_id":"3ad5196c-6f5c-4854-b3dd-8d67a2979292","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d5a6cc1e5bd94ca244b8c701a499a47c70d0b7a7bdf18dada3abe937b6d92414","observation_id":"f0920c74-d090-4fed-9a42-ca9d7d2cdc3d","resolution":{"observed_at":"2026-05-17T22:32:11.871653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"5fa609b3-1203-4f0e-a526-0110cb3f8046","year":2019},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:6bb4dae51701e68ed145aae506eabc5d978d9d7668718ab7aea7ad2aa9f32c82","observation_id":"733298b1-657f-4e7c-b01d-c3d164455c59","resolution":{"observed_at":"2026-05-17T22:32:11.731374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt-4 system card, https://cdn.openai.com/papers/gpt-4-system-card.pdf","venue":null,"work_id":"6773c014-fa15-4d30-927b-5465be92f467","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:0e8f8ef01dee40f9b13d4ba7c5abca0b35d697e7d8d4e9efc86cbe62ab7fe1c9","observation_id":"377695cb-39cd-43e6-883f-3cd9547023b6","resolution":{"observed_at":"2026-05-17T22:32:11.777739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"com/6253615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ea4b5a30-4975-429f-aa83-6d0beaf42540","year":null},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:728b404a84ea91406685bea42005e88233e85edfd889aaaea4e0aee00ebccb8f","observation_id":"35245115-8e4d-491f-9450-c60a3d57972a","resolution":{"observed_at":"2026-05-17T22:30:44.643962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:26:21.117928Z","title":"Language models are few-shot learners","venue":null,"work_id":"04bc68bc-b7df-4ec1-8599-da037bd4f085","year":1901},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f2e858c5d5b41903a0b6f5a3e12fa06121c414b4c3f5a9a74eb0287513b9ab07","observation_id":"ac30acc3-35b2-48dd-aeac-1b05e6c424d3","resolution":{"observed_at":"2026-05-17T22:32:11.711432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A systematic review of the relationship between internet use, self-harm and suicidal behaviour in young people: The good, the bad and the unknown","venue":null,"work_id":"cafc91de-3b2e-4298-9c0b-3c4b71b81222","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:e516ce1c72d8b09f0c20cc0e4e72de3f70468f89f20f43704db166e7c8bbb0fa","observation_id":"4b0ad4d0-fd3d-457c-99b5-a04470f7ab7d","resolution":{"observed_at":"2026-05-17T22:32:11.876772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The regulation of pornography and child pornography on the internet","venue":null,"work_id":"9381c366-fb1c-458a-911c-eba51699d646","year":1997},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f22118014b88e2290de5cf126b78762d95d88e57380978812568cf9a1e674805","observation_id":"c8638219-70de-4c9f-af91-c98f7ad36616","resolution":{"observed_at":"2026-05-17T22:32:11.912182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamics of hate based internet user networks","venue":null,"work_id":"0e840b66-984f-4311-99c8-c42aff31da91","year":2010},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d95c93653f0e2020e736a4f44b8677629592faa033671746d4654922be0cd61c","observation_id":"6954d4d9-84e2-43e5-9c45-1723195fd4ec","resolution":{"observed_at":"2026-05-17T22:32:11.781905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0fba5b40-64ee-44d7-9900-e0443f95c717","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:88370cae3717d647fb68271f50e91d67c58fc08e04f5e69e1e7dd2d5d93c403b","observation_id":"82b4a395-7131-4e3d-9c4b-d4e84332410e","resolution":{"observed_at":"2026-05-17T22:32:11.891712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is the internet causing political polarization? evidence from demographics","venue":null,"work_id":"6a74641f-2541-44c7-a8a8-4025a81a13ea","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:abfc1ac7e05ae8ac4a2972ebbae167e92f35cbc39f7cc5b13c211dc39d0d9947","observation_id":"c554d42c-d2ea-41c0-9720-502dedd13109","resolution":{"observed_at":"2026-05-17T22:32:11.685217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Regulating the internet of things: first steps toward managing discrimination, privacy, security and consent","venue":null,"work_id":"edf56b6a-069c-4710-9b0f-43b69f3678a3","year":2014},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:2a6dfa416e1bc334601a4a2559f0f52eb28bff6c0d834fcd048ed780ea125dcd","observation_id":"3e5d74c5-3251-42c7-b471-a0c7d2d3ed2a","resolution":{"observed_at":"2026-05-17T22:32:11.824455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Normative challenges of identification in the internet of things: Privacy, profiling, discrimination, and the gdpr","venue":null,"work_id":"442c8b88-dc2e-4e05-b720-a8b092f1a978","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:39035038c81eb43ecdcd814aeb8f784169126e8bbb0a87145c60348e3c747e81","observation_id":"b2e045ec-3e68-4c36-82af-00cf8d73636b","resolution":{"observed_at":"2026-05-17T22:32:11.773857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Misuse of the internet by pedophiles: Implications for law enforcement and probation practice","venue":null,"work_id":"1f78d5eb-bf8f-4a45-958d-1fa84d0f2766","year":1997},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f203121df6b67b7e81fea37a3a63f8ecf0e2cb03f4988d8f957f97bc4328fe3b","observation_id":"38de5a8c-6c78-47e7-a106-2dad26422fda","resolution":{"observed_at":"2026-05-17T22:32:11.688212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Controversies and legal issues of prescribing and dispensing medications using the internet","venue":null,"work_id":"8b543f0e-3857-4fd5-a0da-969521b65b11","year":2004},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d7fd9c906e2bbf65038302e236f3856369976b1b3d8932ca5b92448bbc24b6c5","observation_id":"5fc96d16-bafd-4081-9ef6-dfafcf2131c6","resolution":{"observed_at":"2026-05-17T22:32:11.705818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:732d10d255e5f6d3623b2e35c1120459343b1d42dfdf448b9979786300212a40","observation_id":"42bb7ee8-66ef-4ddb-af43-0137b93520fb","resolution":{"observed_at":"2026-05-17T22:30:44.648712Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":"c1c174f3-bfe7-43b5-b0fe-b43542017b19","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:b9c86694401c2bf799a751d6eab33f6da2204af1a27adcf8a70289c201783f66","observation_id":"41a85bc6-a9fa-4285-810e-9a3f3ed2426b","resolution":{"observed_at":"2026-05-17T22:32:11.736043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":"2112.00861","doi":"10.48550/arxiv.2112.00861","metadata_source":"pith","pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A General Language Assistant as a Laboratory for Alignment","venue":"cs.CL","work_id":"a43f9ea0-01be-47d5-b8ee-a1a9f73381c5","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:14babca0046d68b0c8fb97cfef24e004a9c4fbf87a28029eadad30a1fd9f4311","observation_id":"2bf38a14-e13b-4237-9b32-e5845148b276","resolution":{"observed_at":"2026-05-17T22:30:44.653923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":"2112.04359","doi":"10.48550/arxiv.2112.04359","metadata_source":"pith","pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ethical and social risks of harm from Language Models","venue":"cs.CL","work_id":"b4ce1c45-ef69-445a-a872-dbb785b485e9","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d636d96b9a180edc49cd9a25c587d0d98dcb444267b998ae693f5d10cf535743","observation_id":"dab974cb-08be-4cd4-a9c8-6bbce4451e7d","resolution":{"observed_at":"2026-05-17T22:30:44.659091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05949","last_updated":"2024-06-28T13:50:57Z","snapshot_observed_at":"2026-07-06T15:40:46.958199Z","submitted_at":"2023-06-09T15:05:13Z","title":"Evaluating the Social Impact of Generative AI Systems in Systems and Society","version":4},"cited_work":{"arxiv_id":"2306.05949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.05949","snapshot_observed_at":"2026-07-04T00:09:14.198655Z","title":"arXiv preprint arXiv:2306.05949 , year=","venue":null,"work_id":"eff3ec69-0f70-4d5b-83c1-ec66a7159575","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2306.05949","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:5adb9fa0b458dd741897c14fe7a47387310ec54ba5fcae37c3eedbc5ab252c8f","observation_id":"68fcf7ca-44f1-45fd-acb4-e2f5ca68447e","resolution":{"observed_at":"2026-05-17T22:30:44.665665Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":"2211.09110","doi":"10.1007/bf01194075","metadata_source":"pith","pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Holistic Evaluation of Language Models","venue":"cs.CL","work_id":"cc02a01e-7218-47dc-8e66-3333e7e4adec","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f4a8e66818df6da86d0db6db2627877c96ee2552346c61a338b91a65f170f547","observation_id":"4db573e6-6781-430a-b62c-0d42808378ed","resolution":{"observed_at":"2026-05-17T22:30:44.671076Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00612","last_updated":"2023-04-02T20:03:27Z","snapshot_observed_at":"2026-07-06T15:11:04.139563Z","submitted_at":"2023-04-02T20:03:27Z","title":"Eight Things to Know about Large Language Models","version":1},"cited_work":{"arxiv_id":"2304.00612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.00612","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eight things to know about large language models","venue":null,"work_id":"305902ba-afd1-4fca-ae6b-c06583e25131","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2304.00612","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:47070d667145631efadb396fe7ca4f931ecc86d28a8aa4226d969c3571a4609b","observation_id":"dcb24634-105e-4a14-aba2-a73be0d84226","resolution":{"observed_at":"2026-05-17T22:30:44.676823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning","venue":null,"work_id":"fd79256b-4308-4396-bef4-a173235f4acb","year":2016},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:38fc0f43a14a68662eae9f5f0fc05f6be56ef78e2f5d9207d1328a52f1188397","observation_id":"be754f5e-92f5-4c10-99f3-0424eca61794","resolution":{"observed_at":"2026-05-17T22:32:11.690979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The curious case of neural text degeneration","venue":null,"work_id":"8636ebb4-0291-431f-88b9-d0eca85f7724","year":2020},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:6a23ca73366b1c8afb33aaf1892b5fa678404e130c0e508d0e22a5a1a147ee76","observation_id":"7313c817-426b-44ce-a84d-82f5fb5b38a8","resolution":{"observed_at":"2026-05-17T22:32:11.693478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03872","last_updated":"2017-06-12T23:57:48Z","snapshot_observed_at":"2026-07-06T05:46:35.489905Z","submitted_at":"2017-06-12T23:57:48Z","title":"Six Challenges for Neural Machine Translation","version":1},"cited_work":{"arxiv_id":"1706.03872","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.03872","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Six Challenges for Neural Machine Translation","venue":"cs.CL","work_id":"a0aea09c-dadc-4009-8389-e54b076b5766","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1706.03872","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:bcf8fe5dd680d59f607210745c2ba68dc663813bbb823c86876a55fbd0f15b88","observation_id":"7a3e7d73-2574-481a-811f-7674ee1a47d5","resolution":{"observed_at":"2026-05-17T22:30:44.682327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":"2206.07682","doi":"10.48550/arxiv.2206.07682","metadata_source":"pith","pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emergent Abilities of Large Language Models","venue":"cs.CL","work_id":"6ea3375b-837c-4640-a175-be7525aa3c6d","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:78aceffead29ea43a7b927b47b13c59a719ffc58cdde66abefca83faef3e9f72","observation_id":"8955d826-60aa-4e4b-8e3c-0a45695e98e7","resolution":{"observed_at":"2026-05-17T22:30:44.687309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2201.11903","doi":"10.48550/arxiv.2201.11903","metadata_source":"pith","pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":"cs.CL","work_id":"d1cf6693-a082-403c-ada9-dac7b96341f9","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:0f3b07840a83f03f12dae47d7c2d55fea2ade5e6615f3762d0066884a6a49ee2","observation_id":"abff574e-d25a-4517-8ade-9712a76b1bb4","resolution":{"observed_at":"2026-05-17T22:30:44.692311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":"2210.11416","doi":"10.48550/arxiv.2210.11416","metadata_source":"pith","pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Instruction-Finetuned Language Models","venue":"cs.LG","work_id":"8405abb1-7558-4fdf-af24-f4c52fa77a06","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:9d6e1c5b0e981e31c6213a53084492a726665bcf56837374b7ae94e7a4670259","observation_id":"75882525-c7df-41a0-baf0-a52927992385","resolution":{"observed_at":"2026-05-17T22:30:44.696234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"9bd3bbb2-19dc-4951-9338-c840f8ac2505","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:b5367f12d09e1d71fa146a65f10bc88a2232be9424913a75d9fdc2fff344ee91","observation_id":"4a759d02-075c-4282-8e0e-5b3b5ea4f6db","resolution":{"observed_at":"2026-05-17T22:32:11.649849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":"1810.04805","doi":"10.1111/jofi.12885","metadata_source":"pith","pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"cs.CL","work_id":"ed240a10-5b19-406c-baa5-30803f465785","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:1ed5e1d5cc6062ccdb8b42793b928bc5f491cfb9e52311f4093e36ecb0fc8959","observation_id":"ed9ec4a3-5794-4707-91b6-b51f5735a742","resolution":{"observed_at":"2026-05-17T22:30:44.704064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-06T18:01:48.915710Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:6b8b07447a78ab1c70988d89d5a6c4ecc5ace9a3dff08b4b84da6506ea600033","observation_id":"cb940b30-38b4-4d3e-8b96-95adac8a6bf0","resolution":{"observed_at":"2026-05-17T22:30:44.708508Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T06:36:03.183974Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":"72bdd905-4f91-46af-883a-4c2849c99ffd","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:0ca1877fddbca98c553dcc7b6165366c6b10e4de635725d841d2de9cd9dbbef4","observation_id":"6412e7f4-8f84-4fa6-981f-9f387688205d","resolution":{"observed_at":"2026-05-17T22:32:11.654546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":"2205.01068","doi":"10.48550/arxiv.2205.01068","metadata_source":"pith","pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-07-11T03:37:45.880117Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":"cs.CL","work_id":"d7ff3b21-1fff-4cf4-952a-4714e3ef2307","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:6bf7544892e3368ab5c4aba771d3a232815c9022073edeac9af08fbfbb3a33b2","observation_id":"20e0c407-28f6-454b-8caf-4fb1cfdb9431","resolution":{"observed_at":"2026-05-17T22:30:44.714012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-02T04:26:53.194797Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"cited_work":{"arxiv_id":"2210.02414","doi":"10.48550/arxiv.2210.02414","metadata_source":"pith","pith_arxiv_id":"2210.02414","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","venue":"cs.CL","work_id":"b6ef9427-af31-4c7c-8c34-bee621978c23","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2210.02414","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:dc6511c374e0c952129fde52c908a0db7088a37e9d4e73e9bb3e7554e9848bd9","observation_id":"13ba5b76-0f13-4951-91ec-62df1b50a5e9","resolution":{"observed_at":"2026-05-17T22:30:44.718591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00536","last_updated":"2020-05-02T07:09:50Z","snapshot_observed_at":"2026-07-06T08:34:10.366215Z","submitted_at":"2019-11-01T18:16:54Z","title":"DialoGPT: Large-Scale Generative Pre-training for Conversational Response Generation","version":3},"cited_work":{"arxiv_id":"1911.00536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1911.00536","snapshot_observed_at":"2026-07-04T14:09:54.016221Z","title":"Deep learning ba sed recommender system: A survey and new perspectives","venue":null,"work_id":"9c16515d-e4f1-422d-9433-9b98d27049db","year":1911},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1911.00536","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d4dd329b55e9b6496e8ac54e22f3a8ef1038c4a1c20e13d7ec93a37be6c3c36b","observation_id":"7cc0abe7-9371-4f69-8f79-4607f998d12d","resolution":{"observed_at":"2026-05-17T22:30:44.724119Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:8ae1cf105e47ab6f051ff87051fa572a326f9c720fe23d90995d5c71b51d7982","observation_id":"056017d7-d5d7-47ab-9ffb-8f3245dfb36e","resolution":{"observed_at":"2026-05-17T22:30:44.729494Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-04T23:38:14.844517Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":"2304.05302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-06-30T23:15:07.886084Z","title":"arXiv preprint arXiv:2304.05302 , year=","venue":null,"work_id":"1212cf79-debd-44aa-a9b3-43c4c99b4db6","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:00e804bac10c238f90db2ad91a2fba6ceacd5e7a7e2573ff0e6b9d3b814a0ca7","observation_id":"e61a961f-06fa-44a7-8530-96ed0368ac11","resolution":{"observed_at":"2026-05-17T22:30:44.734358Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":"2304.06767","doi":"10.48550/arxiv.2304.06767","metadata_source":"pith","pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","venue":"cs.LG","work_id":"aeaccc45-69c1-4642-b5f9-72343ebbf9fc","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:2a944aced1b4b675056934e74c97901550571c0f703b126a0096290a85f48e00","observation_id":"6e655aed-d9e9-469d-9bd9-702e859d5918","resolution":{"observed_at":"2026-05-18T00:46:57.049485Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":"2305.18290","doi":"10.48550/arxiv.2305.18290","metadata_source":"pith","pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","venue":"cs.LG","work_id":"62105b61-411f-46e5-970a-bd322c6adbbc","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:c640ce6c29c952a329d92365d0a99d6f30d7ba50ebe8960497b9a7d1d392abfe","observation_id":"a5684575-2abb-4eba-9531-7bb4ae9352fb","resolution":{"observed_at":"2026-05-17T22:30:44.747264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:53:49.179087+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:53:49.179087+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16960","last_updated":"2023-10-28T09:02:39Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:17:36Z","title":"Training Socially Aligned Language Models on Simulated Social Interactions","version":3},"cited_work":{"arxiv_id":"2305.16960","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16960","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., Yang, D., and V osoughi, S","venue":null,"work_id":"2ce1f897-4702-487e-9888-4872cdae5fda","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2305.16960","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:8176479006308b9f7465cafbac24048f264fbd1cc56f846c50d297217ff29605","observation_id":"5740a7aa-827d-420b-86ee-d39e1e11a805","resolution":{"observed_at":"2026-05-17T22:30:44.753050Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models and software as a medical device","venue":null,"work_id":"cb56405e-7236-4698-8fdd-271e104ef8e8","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:a76a659bc274dcc1081712997b2c3c21dc9f5e069dccd7c569b2263a2df7d6da","observation_id":"69de4e5d-5f92-449c-aefc-fb822bba4926","resolution":{"observed_at":"2026-05-17T22:32:11.729216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are large language models ready for healthcare? a comparative study on clinical language understanding","venue":null,"work_id":"d77c0f1d-d176-4e4c-8704-b3d19e19b9b4","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:2a13df05918de132a26b889604b51609b30bdb20ee38c611473e6034c9954285","observation_id":"f0cc5c94-1e8a-4025-9647-4eca667455e6","resolution":{"observed_at":"2026-05-17T22:32:11.673054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How well do large language models support clinician information needs? https://hai.stanford.edu/news/how-well-do-large-language-models-support-clinician-information-needs","venue":null,"work_id":"23a5ea0d-de24-48d7-a90f-1803ad8a3953","year":null},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d9daf4bcaeced43f696ee00b8bde8c7b1e65ac39624105b3b61d83e822f58f29","observation_id":"aa371ff7-659b-4a6d-847d-68297efcb110","resolution":{"observed_at":"2026-05-17T22:32:11.659264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":"01684bb7-ae37-4269-a99c-ee9c3e423e33","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:1a6af1d988cdcd0c55048cfd8fab77c14679ab0f114f4c45c81ad8fcba53659e","observation_id":"d8dbb802-47da-42d0-adae-afee8a26e62c","resolution":{"observed_at":"2026-05-17T22:32:11.740017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fingpt: Open-source financial large language models","venue":null,"work_id":"119fddfe-5646-4976-a0ab-85542938394b","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:b8c0cfa79cff65837ab54ccb48def8523d13dd2b153e50c120105c6b3a1d4904","observation_id":"6f63398e-0733-4d21-9e4c-260c634d1e5f","resolution":{"observed_at":"2026-05-17T22:32:11.675286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":"2302.09664","doi":"10.48550/arxiv.2302.09664","metadata_source":"pith","pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","venue":"cs.CL","work_id":"d66d411b-c2c1-4cd6-8a6b-9fac872fa257","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:9399d4147ab3cc06a6598c3fd11bebe3309c1e9bdb1ad478a722022ef9888a65","observation_id":"bffb1347-4fbb-4f60-8697-6322eb238b70","resolution":{"observed_at":"2026-05-17T22:30:44.758222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03494","last_updated":"2023-04-03T20:02:26Z","snapshot_observed_at":"2026-07-06T14:49:15.927337Z","submitted_at":"2023-02-06T04:21:59Z","title":"A Categorical Archive of ChatGPT Failures","version":8},"cited_work":{"arxiv_id":"2302.03494","doi":"10.48550/arxiv.2302.03494","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03494","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A categorical archive of chatgpt failures","venue":"arXiv (Cornell University)","work_id":"b8a1b3d4-af5a-4df5-bd67-bf97bc517b2b","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2302.03494","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:83d1c79a90eed05ef5eeb12bcf1f8f2037f926502656f80595e3d5db7fd0730a","observation_id":"629db029-f5fd-4806-bdfe-3d96c7b2fb01","resolution":{"observed_at":"2026-05-17T22:30:44.763063Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatgpt and software testing education: Promises & perils","venue":null,"work_id":"994ec6b0-7d86-4e31-a07b-8b089bff0060","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:e1772da3081ffa5256bc5c199006690e613421c23e2e72ee5768e3457e6d8ebf","observation_id":"9341be85-4f1f-4bd4-b61d-389265895027","resolution":{"observed_at":"2026-05-17T22:32:11.715487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fake news detection on social media: A data mining perspective","venue":null,"work_id":"35aa21c6-48a2-479a-b994-fe27609f9bb8","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f56797639d4b98f4a4a6c25515aef3a994beb5986901c4c6e8e2feb45bb5ba90","observation_id":"147a402b-beef-4e8b-bda9-d0bd9f5bc20d","resolution":{"observed_at":"2026-05-17T22:32:11.644842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.07506","last_updated":"2017-04-25T01:20:40Z","snapshot_observed_at":"2026-08-04T16:24:52.374808Z","submitted_at":"2017-04-25T01:20:40Z","title":"Some Like it Hoax: Automated Fake News Detection in Social Networks","version":1},"cited_work":{"arxiv_id":"1704.07506","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.07506","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Some Like it Hoax: Automated Fake News Detection in Social Networks","venue":"cs.LG","work_id":"0a4b6944-6823-43f0-8987-1865df7c6544","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1704.07506","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:da5ac32369d7d269f7d4b423b78e8728fb2138f45b2efc824227340e6e7a9750","observation_id":"04c7151b-6645-4811-a796-62c9023a5dee","resolution":{"observed_at":"2026-05-17T22:30:44.767969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":"2202.07646","doi":"10.48550/arxiv.2202.07646","metadata_source":"pith","pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantifying Memorization Across Neural Language Models","venue":"cs.LG","work_id":"35487ec1-b90b-4ace-95bd-1bce30064b2e","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:cf3a5cadb41887b4bb3e3a8f29772bfa8829aee36389fb51c2240ccb45d519c2","observation_id":"15fb74a1-e99b-4151-b9af-dfb4982d8cbf","resolution":{"observed_at":"2026-05-17T22:30:44.772708Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A closer look at memorization in deep networks","venue":null,"work_id":"864f106b-4197-4717-a394-d10ff1966414","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:89f4c6368881429c616ab80197bdbe088cdc697e455327312958785855ddd673","observation_id":"e6c0b4f3-4fa6-4656-a88f-582b95957ddd","resolution":{"observed_at":"2026-05-17T22:32:11.661001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14251","last_updated":"2023-03-24T07:18:59Z","snapshot_observed_at":"2026-08-02T02:24:26.318853Z","submitted_at":"2022-07-28T17:36:24Z","title":"Measuring Causal Effects of Data Statistics on Language Model's `Factual' Predictions","version":2},"cited_work":{"arxiv_id":"2207.14251","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.14251","snapshot_observed_at":"2026-07-02T07:36:44.932058Z","title":"Measuring causal effects of data statistics on language model’sfactual’predictions","venue":null,"work_id":"890bb1f0-5c57-4122-a4ce-adee3f3697de","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2207.14251","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d94a6fb5dc4a6b522fe89e63a7e02e76ad4c661d2cc11eb9ec08e129f8b41f27","observation_id":"3a4e9f9f-e790-4517-8d2b-2cdd9feeb8d7","resolution":{"observed_at":"2026-05-17T22:30:44.777570Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10511","last_updated":"2023-07-02T07:21:59Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T18:30:15Z","title":"When Not to Trust Language Models: Investigating Effectiveness of Parametric and Non-Parametric Memories","version":4},"cited_work":{"arxiv_id":"2212.10511","doi":"10.48550/arxiv.2212.10511","metadata_source":"pith","pith_arxiv_id":"2212.10511","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When Not to Trust Language Models: Investigating Effectiveness of Parametric and Non-Parametric Memories","venue":"cs.CL","work_id":"5021c16e-c088-4765-8c10-3d0dd6e18bb0","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2212.10511","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:39547f57e42ff9d86d92ab2c6c9e1b094a12e2087639df93e3e257b5a3f93c4f","observation_id":"d4c38154-7b51-4e90-8a62-3f27536484b5","resolution":{"observed_at":"2026-05-18T11:33:08.656299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised dense information retrieval with contrastive learning","venue":null,"work_id":"6406f5a4-23e5-4dd6-b9ff-a6a020dc9ec1","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:38c9192563ddbaa5c3c4ae2a2cf94c7d4cfb78ee193f86bb4bf5f4e64736de8c","observation_id":"9eecb229-586c-4a9a-b0f9-184aa2c1c849","resolution":{"observed_at":"2026-05-17T22:32:11.702781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09150","last_updated":"2023-02-15T02:24:43Z","snapshot_observed_at":"2026-07-06T14:06:44.908737Z","submitted_at":"2022-10-17T14:52:39Z","title":"Prompting GPT-3 To Be Reliable","version":2},"cited_work":{"arxiv_id":"2210.09150","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.09150","snapshot_observed_at":"2026-07-02T05:16:39.646569Z","title":"Prompting gpt-3 to be reliable","venue":null,"work_id":"d0cd6f42-bf34-4efc-86a7-d4f7877604fe","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2210.09150","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:aac525f4149e23bf91e854d24fc68e158662ab8f4dbc6433f18eb47f77376c56","observation_id":"874910e9-8622-4fa1-a696-2f4c0ec2c1e2","resolution":{"observed_at":"2026-05-17T22:30:44.785699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"6be61240-2d76-4f4e-bc5c-e6915d40f1d8","year":2020},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:9926e8cb71ec45371559ca029e01486a529ae44b1c3954287da6d5acab0c58ee","observation_id":"c79ad24d-822f-4391-96fd-683afbd4f01d","resolution":{"observed_at":"2026-05-17T22:32:11.904933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Survey of hallucination in natural language generation.ACM Computing Surveys, 55(12):1–38","venue":null,"work_id":"f835a0e4-1be2-49b5-9905-a360907aeb69","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:b598b96f1a7cc5b923f5dbe2209be99b0572899eb6cb22fff1f93c88e92452dd","observation_id":"34706dc6-e7cb-4b52-9cb0-9098d0d4fc4d","resolution":{"observed_at":"2026-05-17T22:32:11.907967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Artificial hallucinations in chatgpt: implications in scientific writing","venue":null,"work_id":"043b6c8c-33a1-4694-aadb-fbbd1598a0e3","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:5e2d57be3006e140485e67abbaa46b82b4b4359c6f874d5482f23130938623df","observation_id":"808a0a7d-abb3-4356-bfdf-aab5754c891a","resolution":{"observed_at":"2026-05-17T22:32:11.889238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04023","last_updated":"2023-11-28T09:01:12Z","snapshot_observed_at":"2026-07-06T14:49:37.908412Z","submitted_at":"2023-02-08T12:35:34Z","title":"A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity","version":4},"cited_work":{"arxiv_id":"2302.04023","doi":"10.48550/arxiv.2302.04023","metadata_source":"pith","pith_arxiv_id":"2302.04023","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity","venue":"cs.CL","work_id":"41dff74c-00b2-4c77-a674-9f86030c06c8","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2302.04023","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:4fc8fafd06a94f4b8b37e1829346262d36eeaeefc2bc62d595c701fd6f3a97e3","observation_id":"72dc64b8-d5fd-411b-8a07-d6af7aa4477b","resolution":{"observed_at":"2026-05-17T22:30:44.789662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"False memories and confabulation","venue":null,"work_id":"1fc3d67a-a590-4b03-9e03-2d20120770dd","year":1998},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:08b00916c2f0999fae3b382ab7ce77e7eced11f580b5dc5d2e82f8f789c57f03","observation_id":"5e15fc46-ee83-421a-b1db-b0273c26512d","resolution":{"observed_at":"2026-05-17T22:32:11.866585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11506","last_updated":"2020-10-22T07:48:38Z","snapshot_observed_at":"2026-08-05T23:31:28.962040Z","submitted_at":"2020-10-22T07:48:38Z","title":"Calibrated Language Model Fine-Tuning for In- and Out-of-Distribution Data","version":1},"cited_work":{"arxiv_id":"2010.11506","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.11506","snapshot_observed_at":"2026-07-02T08:26:48.122920Z","title":"Calibrated language model fine-tuning for in-and out-of-distribution data","venue":null,"work_id":"3ce23b3f-f825-431f-b2e6-a2ba4f1dde4f","year":2010},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2010.11506","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:299b5cb555b20f72f55fac5bcf1854e636fc356f5b2906f25a1e550e6c5f7d3b","observation_id":"02fc6cbc-f215-4fa1-8e02-00973a04b52d","resolution":{"observed_at":"2026-05-17T22:30:44.794254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06963","last_updated":"2021-07-14T19:52:12Z","snapshot_observed_at":"2026-07-06T11:29:14.236629Z","submitted_at":"2021-07-14T19:52:12Z","title":"Increasing Faithfulness in Knowledge-Grounded Dialogue with Controllable Features","version":1},"cited_work":{"arxiv_id":"2107.06963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.06963","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Increasing faithfulness in knowledge- grounded dialogue with controllable features","venue":null,"work_id":"77043286-8cb6-46b7-8e82-90dc2e62131e","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2107.06963","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:8a56c7188ee5d5edd66b2330e6cc3c0bdda66568003a575f0121912446c0cc47","observation_id":"6456f4ca-bc64-4d26-adef-1b49796976e8","resolution":{"observed_at":"2026-05-17T22:30:44.799044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10513","last_updated":"2023-12-03T23:01:19Z","snapshot_observed_at":"2026-08-05T10:16:46.023452Z","submitted_at":"2023-04-20T17:48:43Z","title":"Why Does ChatGPT Fall Short in Providing Truthful Answers?","version":3},"cited_work":{"arxiv_id":"2304.10513","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.10513","snapshot_observed_at":"2026-07-05T17:21:18.041114Z","title":"Why does chatgpt fall short in answering questions faithfully?","venue":"cs.CL","work_id":"00b4449b-a0ed-48de-8625-3409669e67b9","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2304.10513","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:7d6754647d4f9696c24ea7d614fc48fb712c729f638142bba8381be26666fa30","observation_id":"66713c30-0eef-4360-816b-c1bb504bdd78","resolution":{"observed_at":"2026-05-17T22:30:44.803564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modeling fluency and faithfulness for diverse neural machine translation","venue":null,"work_id":"c35f5018-6b20-4e38-a913-09b2e5c59171","year":2020},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:0ed8e6499e7642fac3bd248ed729e9a0c9a7c2357bb2a982a907a1700f6afe7c","observation_id":"670cca5a-9b76-4d8a-a695-eed0ac67b77b","resolution":{"observed_at":"2026-05-17T22:32:11.871981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ensure the correctness of the summary: Incorporate entailment knowledge into abstractive sentence summarization","venue":null,"work_id":"5086536f-2b89-4561-bae9-3cd623d45541","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:eec145fdcc9be64933a36689ec413f7ab3b53a381ed99a6a6b3cf41e96708aa6","observation_id":"e9dfed57-79f4-458e-a4ce-25730ad8e526","resolution":{"observed_at":"2026-05-17T22:32:11.869147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08455","last_updated":"2021-09-14T12:00:18Z","snapshot_observed_at":"2026-07-06T11:00:50.937337Z","submitted_at":"2021-04-17T05:23:44Z","title":"Neural Path Hunter: Reducing Hallucination in Dialogue Systems via Path Grounding","version":2},"cited_work":{"arxiv_id":"2104.08455","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.08455","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2104.08455 , year=","venue":null,"work_id":"d9fba832-92ee-4784-8c64-121902788843","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2104.08455","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f7af46ae710f744f37cdb4212d6f97dc6540948bee50c739e2ccecdfeb49b0dc","observation_id":"c33b5f03-5f9a-4417-ab3a-ff9fcec4f355","resolution":{"observed_at":"2026-05-17T22:30:44.807993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05052","last_updated":"2022-01-12T02:41:09Z","snapshot_observed_at":"2026-08-06T11:50:44.723360Z","submitted_at":"2021-09-10T18:29:44Z","title":"Entity-Based Knowledge Conflicts in Question Answering","version":2},"cited_work":{"arxiv_id":"2109.05052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.05052","snapshot_observed_at":"2026-07-04T09:59:44.736383Z","title":"Entity-based knowledge conflicts in question answering","venue":null,"work_id":"daaf8693-a3e9-4d9e-868c-0cf983be0e6e","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2109.05052","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:6acc58bfc3cc06fd53a609d509f9b44a265e3ec31550d3dedb5c2ee392d32c42","observation_id":"c4105137-bd66-4b69-9b4f-b738a16b0e35","resolution":{"observed_at":"2026-05-17T22:30:44.812356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":"2303.08896","doi":"10.48550/arxiv.2303.08896","metadata_source":"pith","pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","venue":"cs.CL","work_id":"90efebf6-4006-4176-9bf1-21a876571751","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:f04aca7c47ccacaa69e43d687513bb248be5007e897703e2da72d308fadecdde","observation_id":"6a1dcc8c-42ec-4d4a-a8f1-975e1399a1ff","resolution":{"observed_at":"2026-05-17T22:30:44.816515Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":"aca82218-b8a0-4043-b62c-27903d55a13f","year":2004},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:952d87a138db91e99fbc0a025e09259abf5a8fc1a4266618a9803f4b1d1956be","observation_id":"14c6af36-9ca5-4d92-9fa0-aae38dd8018c","resolution":{"observed_at":"2026-05-17T22:32:11.886412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"61d34a5f-3525-4046-b217-7110c889eb7a","year":2002},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:7a6edc3db3bc58401281ae7a1ba11a57e9d0f7b8b8223cc1b4c518ee5de38b77","observation_id":"03f5684b-caa5-4397-afa5-63474dc81caf","resolution":{"observed_at":"2026-05-17T22:32:11.916660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":"2109.07958","doi":"10.48550/arxiv.2109.07958","metadata_source":"pith","pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","venue":"cs.CL","work_id":"22e3b047-a6e8-4c4c-b62e-173b545a1a45","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:48d9af3cec91a9daf9070948a58aa2cb940deac75e8cce316c0bad0b0f60837a","observation_id":"ee256259-4fd4-414d-9815-2272e9f1779d","resolution":{"observed_at":"2026-05-17T22:30:44.820343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:09.956602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:09.956602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05456","last_updated":"2022-10-04T21:27:41Z","snapshot_observed_at":"2026-07-31T02:57:48.103809Z","submitted_at":"2021-10-11T17:48:11Z","title":"Rome was built in 1776: A Case Study on Factual Correctness in Knowledge-Grounded Response Generation","version":2},"cited_work":{"arxiv_id":"2110.05456","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.05456","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rome was built in 1776: A case study on factual correctness in knowledge-grounded response generation","venue":null,"work_id":"01ed08d4-f9d0-4a50-83df-b39f32e78e0b","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2110.05456","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:870c727af38e4fc588377c74e05cd7b4473a7e7a1d910b217cda70d55aef4f74","observation_id":"74ed435e-2d94-42e8-93a9-b731b60e19ed","resolution":{"observed_at":"2026-05-17T22:30:44.824605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08202","last_updated":"2021-09-09T09:24:45Z","snapshot_observed_at":"2026-07-06T11:00:25.253720Z","submitted_at":"2021-04-16T16:21:16Z","title":"$Q^{2}$: Evaluating Factual Consistency in Knowledge-Grounded Dialogues via Question Generation and Question Answering","version":2},"cited_work":{"arxiv_id":"2104.08202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.08202","snapshot_observed_at":"2026-07-04T13:29:51.695582Z","title":"Q2: Evaluating factual consistency in knowledge-grounded dialogues via question generation and question answering","venue":null,"work_id":"4b61df76-3bd5-4878-bab6-bedd77804fe5","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2104.08202","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:104b6c9da3c142dd54a6a4691cb7467c0bc05bafb17ccb5d6e3d5c490a7687fe","observation_id":"2950262e-b343-48e0-9476-1b4dadae70d9","resolution":{"observed_at":"2026-05-17T22:30:44.829560Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09061","last_updated":"2021-04-19T05:39:24Z","snapshot_observed_at":"2026-07-06T11:01:29.967128Z","submitted_at":"2021-04-19T05:39:24Z","title":"Improving Faithfulness in Abstractive Summarization with Contrast Candidate Generation and Selection","version":1},"cited_work":{"arxiv_id":"2104.09061","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.09061","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving faithfulness in abstractive summarization with contrast candidate generation and selection","venue":null,"work_id":"60b6d137-cde2-444b-aa27-39954752213c","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2104.09061","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:e5076163cbdc4b09adf93480222ed97d425d484a44d53364b29346fc95042cbb","observation_id":"b32d646a-b87a-4cec-90de-9aa30812901b","resolution":{"observed_at":"2026-05-17T22:30:44.833676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple recipe towards reducing hallucination in neural surface realisation","venue":null,"work_id":"1657ed11-f11d-4028-b088-6f102d0cca30","year":2019},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:e4d562be28e45535f3365f4c8efcc98d157d9711babca7138ae66e855c0c2dea","observation_id":"78c1c276-8ea6-47bf-963d-1d545e771a40","resolution":{"observed_at":"2026-05-17T22:32:11.839843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Faithful to the original: Fact aware neural abstractive summarization","venue":null,"work_id":"e04d571c-72af-4b52-8be1-726a570fa33b","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:2c150d3f0bab061354b786eeaba1268ce470753b41458dea8eb4979703f5fb62","observation_id":"ce1f4cc0-3965-4d70-8760-102f92d4e621","resolution":{"observed_at":"2026-05-17T22:32:11.722181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14373","last_updated":"2020-10-06T06:07:06Z","snapshot_observed_at":"2026-07-06T09:16:20.653589Z","submitted_at":"2020-04-29T17:53:45Z","title":"ToTTo: A Controlled Table-To-Text Generation Dataset","version":3},"cited_work":{"arxiv_id":"2004.14373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.14373","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Totto: A controlled table-to-text generation dataset","venue":null,"work_id":"e3d416e1-ed6f-48e9-9eac-9ed2a9596f68","year":2004},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2004.14373","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:a9ccb3b18f823fd3ab9b5eaec0a8ef61589f7b1cb60a17142ddd927f791087bc","observation_id":"1e635715-428c-415b-b004-afa6b03104a6","resolution":{"observed_at":"2026-05-17T22:30:44.837758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06683","last_updated":"2021-04-14T08:09:57Z","snapshot_observed_at":"2026-08-04T16:17:43.104055Z","submitted_at":"2021-04-14T08:09:57Z","title":"The Curious Case of Hallucinations in Neural Machine Translation","version":1},"cited_work":{"arxiv_id":"2104.06683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.06683","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2104.06683 , year=","venue":null,"work_id":"fbfa33be-5200-43e8-b70e-64d2b11d5175","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2104.06683","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:64f95329a276e70cdabefacbc3da2bef427b05d443a18d4810b65c0c763e4748","observation_id":"0a3f5504-e489-403a-8f6e-5d560ba8626e","resolution":{"observed_at":"2026-05-17T22:30:44.842031Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05873","last_updated":"2020-10-12T17:25:02Z","snapshot_observed_at":"2026-07-06T10:03:43.754666Z","submitted_at":"2020-10-12T17:25:02Z","title":"Controlled Hallucinations: Learning to Generate Faithfully from Noisy Data","version":1},"cited_work":{"arxiv_id":"2010.05873","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.05873","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Controlled hallucinations: Learning to generate faithfully from noisy data","venue":null,"work_id":"f06c26e1-dbb9-46a3-960d-cd86586cb1b6","year":2010},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2010.05873","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:509e6180ad0d1eab530e5c5057f72bb1881848b17dde1678b6239d5f7ec7cddf","observation_id":"b9a7c6a6-42e4-42f4-b577-5eff600e7ed8","resolution":{"observed_at":"2026-05-17T22:30:44.846293Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Slot-consistent nlg for task-oriented dialogue systems with iterative rectification network","venue":null,"work_id":"cc1a55de-ba58-4dc6-8e58-22cc2b0a4943","year":2020},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:0898bf6f80dc499d23e265db15abd8b950c3ac5c94098f94787f4f28d2d21d73","observation_id":"4b76fccb-fa4a-4a2d-bbb5-f3c51739b498","resolution":{"observed_at":"2026-05-17T22:32:11.879562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01159","last_updated":"2020-05-03T18:23:06Z","snapshot_observed_at":"2026-08-06T03:31:44.082095Z","submitted_at":"2020-05-03T18:23:06Z","title":"Knowledge Graph-Augmented Abstractive Summarization with Semantic-Driven Cloze Reward","version":1},"cited_work":{"arxiv_id":"2005.01159","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2005.01159","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knowledge graph-augmented abstractive summarization with semantic-driven cloze reward","venue":null,"work_id":"0ae3a45f-c13e-44ce-86f3-b2a20daac315","year":2005},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2005.01159","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:652de19e9a50e0ae4fe09abc32f3aada57ea41c99c83c357623a84e153186b4a","observation_id":"fa5428b4-3014-45b4-ad57-2ae0ba3bd8a0","resolution":{"observed_at":"2026-05-17T22:30:44.850322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02745","last_updated":"2019-09-06T07:20:17Z","snapshot_observed_at":"2026-08-04T16:18:16.510752Z","submitted_at":"2019-09-06T07:20:17Z","title":"Incorporating External Knowledge into Machine Reading for Generative Question Answering","version":1},"cited_work":{"arxiv_id":"1909.02745","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.02745","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Incorporating external knowledge into machine reading for generative question answering","venue":null,"work_id":"e0863bc8-6ed5-4cf6-a5a8-92af3ed44598","year":1909},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1909.02745","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d2f806dcf9f53b3c82fa2824b8e726b9d603c7a06a7da74d597ec952aacff07a","observation_id":"bcb8eb64-85fe-4029-8b5d-db0c7e331a60","resolution":{"observed_at":"2026-05-17T22:30:44.854405Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08435","last_updated":"2019-10-18T14:23:03Z","snapshot_observed_at":"2026-07-06T08:30:32.946723Z","submitted_at":"2019-10-18T14:23:03Z","title":"Using Local Knowledge Graph Construction to Scale Seq2Seq Models to Multi-Document Inputs","version":1},"cited_work":{"arxiv_id":"1910.08435","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.08435","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using local knowledge graph construction to scale seq2seq models to multi-document inputs","venue":null,"work_id":"7f66fbb8-92d0-46fb-8edb-81666038585e","year":1910},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1910.08435","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:7ba472325197e18b34f300936a5a51b46dcb01aa66ddf824f22cea631653d2ac","observation_id":"29579a49-c9ec-4637-8fda-6f70ab426d05","resolution":{"observed_at":"2026-05-17T22:30:44.858762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07567","last_updated":"2021-04-15T16:24:43Z","snapshot_observed_at":"2026-08-04T18:10:02.288634Z","submitted_at":"2021-04-15T16:24:43Z","title":"Retrieval Augmentation Reduces Hallucination in Conversation","version":1},"cited_work":{"arxiv_id":"2104.07567","doi":"10.48550/arxiv.2104.07567","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.07567","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Retrieval augmentation reduces hallucination in conversation","venue":"arXiv (Cornell University)","work_id":"764f4422-9533-439b-857b-07eab22d3719","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2104.07567","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d60cf56f5a668cde876e82c3c3dce2762d11094196c382774120838480d385b0","observation_id":"02231977-b0b5-4d61-88a5-985c11f64d50","resolution":{"observed_at":"2026-05-17T22:30:44.863027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.08612","last_updated":"2021-03-15T00:40:15Z","snapshot_observed_at":"2026-08-06T02:12:33.714337Z","submitted_at":"2020-03-19T07:36:10Z","title":"Enhancing Factual Consistency of Abstractive Summarization","version":8},"cited_work":{"arxiv_id":"2003.08612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2003.08612","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Enhancing factual consistency of abstractive summarization","venue":null,"work_id":"dc92f3be-c51a-44cc-9356-8ed49ae3b477","year":2003},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2003.08612","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:9a40689f148d1efcb30d69350542fa26c105d4555dbf6307d45184d93df4f541","observation_id":"56916e3c-b0c6-491b-b26f-c02427b544c8","resolution":{"observed_at":"2026-05-17T22:30:44.867268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06273","last_updated":"2023-11-14T00:20:20Z","snapshot_observed_at":"2026-08-06T05:06:21.795803Z","submitted_at":"2023-03-11T01:19:01Z","title":"Consistency Analysis of ChatGPT","version":3},"cited_work":{"arxiv_id":"2303.06273","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.06273","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consistency analysis of chatgpt","venue":null,"work_id":"0ab9cc5b-a4d6-47f4-9771-e5f1a91c3b3a","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2303.06273","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:54fc979e63288dfdb12ff2d1878905f5bcfcbf97a710f96e2229aa28196cc8d9","observation_id":"1b77f43f-aa3e-4de7-beb3-0e3c31bd95b6","resolution":{"observed_at":"2026-05-17T22:30:44.871279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11662","last_updated":"2023-12-20T12:57:34Z","snapshot_observed_at":"2026-07-06T15:29:43.160744Z","submitted_at":"2023-05-19T13:23:51Z","title":"Separating form and meaning: Using self-consistency to quantify task understanding across multiple senses","version":3},"cited_work":{"arxiv_id":"2305.11662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.11662","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating task understanding through multilingual consistency: A chatgpt case study","venue":null,"work_id":"a39f83fe-81f7-4db6-ab63-5bcb7383795a","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2305.11662","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:2fe75ff0fe481a8f8ec7120799bf9b5919e9fa5d5570e8f3ce5c9e008e33e8da","observation_id":"c8924953-b885-402a-92be-5c02e67ddf98","resolution":{"observed_at":"2026-05-17T22:30:44.875331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring and improving consistency in pretrained language models","venue":null,"work_id":"e0e44d07-5483-41df-99ce-b4a80418e446","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:2aacf42f36096ccc158c68650403bdd011f2d8812fcc49e3732ff213f9096b94","observation_id":"9c73d7b8-2ced-4762-bb4d-3da0a5d40bfd","resolution":{"observed_at":"2026-05-17T22:32:11.882395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T04:45:59.168438Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4","venue":null,"work_id":"8cd156e8-51f5-4a9f-b83e-54c0aff56024","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:635828e78aae93b6ce2c803ee02e691819d79627e6344cd70fd3cce1ee994c98","observation_id":"5dd65978-ec96-44b1-8742-11c0bf1d85aa","resolution":{"observed_at":"2026-05-17T22:30:45.117582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13439","last_updated":"2023-11-13T18:10:16Z","snapshot_observed_at":"2026-07-06T14:56:01.000439Z","submitted_at":"2023-02-26T23:46:29Z","title":"Navigating the Grey Area: How Expressions of Uncertainty and Overconfidence Affect Language Models","version":2},"cited_work":{"arxiv_id":"2302.13439","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.13439","snapshot_observed_at":"2026-07-04T19:50:10.021449Z","title":"Navigating the grey area: Expressions of overconfidence and uncertainty in language models","venue":null,"work_id":"e139643d-b682-4790-b67f-fcc8c6af726a","year":2023},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2302.13439","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:0388ffa2dbd7ba47d309447269a33385a3eceffe3ce73878f3099018fa4b4e34","observation_id":"9fd397c7-18d8-45b3-94fd-b118aade8fd9","resolution":{"observed_at":"2026-05-17T22:30:44.880185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.11098","last_updated":"2021-05-31T15:57:08Z","snapshot_observed_at":"2026-08-03T13:24:57.874674Z","submitted_at":"2021-05-24T05:34:09Z","title":"Prevent the Language Model from being Overconfident in Neural Machine Translation","version":2},"cited_work":{"arxiv_id":"2105.11098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.11098","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prevent the language model from being overconfident in neural machine translation","venue":null,"work_id":"9f3d5ac4-95b2-447a-8154-fd5bc09d3fbd","year":2021},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2105.11098","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:e3c1346f93ffe5df034ba090e3f552c309765a042ce1608bd9a7031f7924f6fd","observation_id":"d43e9670-7748-49e1-bd15-4263adb43533","resolution":{"observed_at":"2026-05-17T22:30:44.884667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Examining emergent communities and social bots within the polarized online vaccination debate in twitter","venue":null,"work_id":"3beed42e-971b-4b75-810e-3e1cc30a5c94","year":2019},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:65144afe1ac7c73d814a37aafe353ba58b8890a664d1971a025a1efcef2aa64f","observation_id":"26cbaf25-ab1f-4d5a-85e2-b1cd377ab19e","resolution":{"observed_at":"2026-05-17T22:30:45.128497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reducing conversational agents’ overconfi- dence through linguistic calibration","venue":null,"work_id":"f92c56ce-17fb-447d-963d-dad4969b8de4","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:dc4d1258ce42f0f3ddf24af3bb91180e279efb358a524475b8cf90f7919e8efb","observation_id":"b7969b57-ac70-4196-94b8-33103c4273b1","resolution":{"observed_at":"2026-05-17T22:30:45.132002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T16:01:19.083848Z","title":"On calibration of modern neural networks","venue":null,"work_id":"97512e31-ff65-4e59-b932-09918e83e96d","year":2017},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:5cfd1699b29e3f1403bc1764305899e7b03a915514bf7e1886de47d22af7977c","observation_id":"6ecada0a-95cb-49fe-b77d-1cfaa1f99243","resolution":{"observed_at":"2026-05-17T22:30:45.135558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.07892","last_updated":"2020-10-15T17:04:21Z","snapshot_observed_at":"2026-07-06T09:05:23.015957Z","submitted_at":"2020-03-17T18:58:44Z","title":"Calibration of Pre-trained Transformers","version":3},"cited_work":{"arxiv_id":"2003.07892","doi":"10.48550/arxiv.2003.07892","metadata_source":"arxiv_reference","pith_arxiv_id":"2003.07892","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Calibration of pre-trained transformers","venue":null,"work_id":"7156f73b-08ce-4bdf-9def-bacf8b1264aa","year":2003},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2003.07892","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:d9edd39136b40d74f44676c46af5f6440d75c3e1d233dd3571f09f0695e5f07d","observation_id":"9fdc70a5-57a0-412d-aa66-1dd7164fce55","resolution":{"observed_at":"2026-05-17T22:30:44.889491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:44ae5a758699a92fb4ddb2b37119daea5aa32b352cda1cbc1b51d5c9d4a0578e","observation_id":"895642fb-a3ad-465c-b024-12598f92d6d8","resolution":{"observed_at":"2026-05-17T22:30:44.893945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14334","last_updated":"2022-06-13T05:04:53Z","snapshot_observed_at":"2026-08-03T04:20:54.522222Z","submitted_at":"2022-05-28T05:02:31Z","title":"Teaching Models to Express Their Uncertainty in Words","version":2},"cited_work":{"arxiv_id":"2205.14334","doi":"10.1093/jamiaopen/ooaf058","metadata_source":"pith","pith_arxiv_id":"2205.14334","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Teaching Models to Express Their Uncertainty in Words","venue":"cs.CL","work_id":"5dfa654a-4d1b-41c5-a6e0-769ffe4b7741","year":2022},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/2205.14334","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:9b19dc9322be24cbdb9dc62e5da090df6c54a510184d8b2ccbee5cb8d205aa98","observation_id":"5e4f8a73-8390-4d70-a51a-4f0b64b99cc0","resolution":{"observed_at":"2026-05-17T22:30:44.898544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":2,"verified_exact":48,"verified_fuzzy":43},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 52 inbound Pith citation observations for arXiv:2308.05374."}