{"as_of":"2026-08-07T18:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4420c69a47742021a038cfa3363ea92c74f05f952f6949434b6e54e2edd6c8e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:22:55.580256Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:50:11.115863Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-07T14:22:55.580256Z","title":"Huang, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19212","last_updated":"2026-07-24T14:18:32Z","snapshot_observed_at":"2026-08-07T14:16:33.031251Z","submitted_at":"2025-05-25T16:19:24Z","title":"When Ethics and Payoffs Diverge: LLM Agents in Morally Charged Social Dilemmas","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:55.580256Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2505.19212"},"observation_digest":"sha256:f8b9e351642aa7e7f484913436ef546d7633c754631181bbda38c8cfb08a88ee","observation_id":"162d771a-418c-4b4e-a320-87e3c17d1a75","resolution":{"observed_at":"2026-08-07T14:22:55.580256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-06T19:20:16.536212Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05965","last_updated":"2025-07-08T13:19:00Z","snapshot_observed_at":"2026-08-06T19:11:49.254960Z","submitted_at":"2025-07-08T13:19:00Z","title":"OpenFActScore: Open-Source Atomic Evaluation of Factuality in Text Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:20:16.536212Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2507.05965"},"observation_digest":"sha256:b8ae9c60487202202f6855dc5b41fc2646ee43aa7c56859e8639e46539403903","observation_id":"69224819-50eb-4cda-833f-5ad01ab6c371","resolution":{"observed_at":"2026-08-06T19:20:16.536212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-05T23:13:00.005776Z","title":"arXiv preprint arXiv:2306.11507 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05775","last_updated":"2026-07-27T20:50:40Z","snapshot_observed_at":"2026-08-05T23:12:57.691936Z","submitted_at":"2025-08-07T18:42:16Z","title":"Guardians and Offenders: A Survey on Harmful Content Generation and Safety Mitigation of LLM","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T23:13:00.005776Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2508.05775"},"observation_digest":"sha256:17c613f591dff0957890247860a7c0f6242221ca5827591384841b2a90a2f0ab","observation_id":"8b639068-14e2-43aa-bcb9-7271a1414879","resolution":{"observed_at":"2026-08-05T23:13:00.005776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-04T23:03:16.421385Z","title":"Trustgpt: A bench- mark for trustworthy and responsible large lan- guage models.arXiv preprint arXiv:2306.11507, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06838","last_updated":"2025-09-08T16:08:31Z","snapshot_observed_at":"2026-08-07T10:42:13.663735Z","submitted_at":"2025-09-08T16:08:31Z","title":"EPT Benchmark: Evaluation of Persian Trustworthiness in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T23:03:16.421385Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2509.06838"},"observation_digest":"sha256:674128779409fe8b5dbe6437cc16a953268225966d24e4db89beb598756e5334","observation_id":"bb7343bc-d8fc-43bc-8867-3e4323e6d0e2","resolution":{"observed_at":"2026-08-04T23:03:16.421385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2601.04389","last_updated":"2026-06-21T05:15:58Z","snapshot_observed_at":"2026-08-04T19:39:39.694972Z","submitted_at":"2026-01-07T20:53:18Z","title":"Safety Is Not Universal: The Selective Safety Trap in LLM Alignment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T16:03:21.391883Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2601.04389"},"observation_digest":"sha256:6629a7f8aeea181d31c92cfefe94822f70f7ae6d7e5d018551119b6a465db98c","observation_id":"29799214-f1d3-4d1d-9649-d2b5ecd02cb2","resolution":{"observed_at":"2026-05-16T16:08:04.813096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-03T12:08:44.317070Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.04389","last_updated":"2026-06-21T05:15:58Z","snapshot_observed_at":"2026-08-04T19:39:39.694972Z","submitted_at":"2026-01-07T20:53:18Z","title":"Safety Is Not Universal: The Selective Safety Trap in LLM Alignment","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T12:08:44.317070Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2601.04389"},"observation_digest":"sha256:28c83ebbc324be312de0d7b5998be5a09b8e5397fb9d5ef0803350eb31011b86","observation_id":"f9420c9b-c3fc-4a4f-a9f3-13835ab1c1fa","resolution":{"observed_at":"2026-08-03T12:08:44.317070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-03T11:08:23.419771Z","title":"2306.11507v1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07528","last_updated":"2026-06-19T11:23:20Z","snapshot_observed_at":"2026-08-07T09:26:25.028209Z","submitted_at":"2026-01-12T13:28:28Z","title":"From RAG to Agentic RAG for Faithful Islamic Question Answering","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:23.419771Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2601.07528"},"observation_digest":"sha256:09805da16884cc13728338d74d121727c80af1db48c55f96f5ec0b9f6c50b207","observation_id":"98745a4a-0145-48e9-b9ee-89b9cb6c67e5","resolution":{"observed_at":"2026-08-03T11:08:23.419771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2605.09803","last_updated":"2026-05-10T22:51:44Z","snapshot_observed_at":"2026-07-06T23:21:49.499951Z","submitted_at":"2026-05-10T22:51:44Z","title":"Insight: Enhancing Mobile Accessibility for Blind and Visually Impaired Users with LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T02:11:09.787984Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2605.09803"},"observation_digest":"sha256:7073137df75b50b0260a87bd585836847a90e334d5190d6b1a979925c68708fd","observation_id":"379c3a04-0776-476f-aa29-4ebb71d48d29","resolution":{"observed_at":"2026-05-12T02:11:15.302288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2605.10442","last_updated":"2026-05-12T10:07:26Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:12:28Z","title":"StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T04:50:17.399580Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2605.10442"},"observation_digest":"sha256:b283f1b49dc6c2b3e4d8a5bf057f2e1b97791a26f6aa8a9db6bb91a0f968dfd5","observation_id":"051922d9-5140-4680-97b0-23317a76243a","resolution":{"observed_at":"2026-05-12T05:51:27.418348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2605.10442","last_updated":"2026-05-12T10:07:26Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:12:28Z","title":"StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T07:20:32.494840Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2605.10442"},"observation_digest":"sha256:9e6b6e3dceb943b921dd88a34154ce4dbd76302ef1cc239a76b4d4e7688953ac","observation_id":"79ca632e-1935-4bf4-88a9-a6ef4e3eb072","resolution":{"observed_at":"2026-05-13T07:22:29.071324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-06T23:05:07.064301Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-25T20:58:53.119386Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:17592338b4a319a4105332be56e6dcc55911588e44ec9dbbc16e50476319c35f","observation_id":"1be6c546-25c7-4a0b-8668-7cfc56a920eb","resolution":{"observed_at":"2026-07-04T19:50:11.118037Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-02T10:16:36.314418Z","title":"arXiv preprint arXiv:2306.11507 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-06T23:05:07.064301Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T10:16:36.314418Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:f85c21d41b5572b14b42df74f349b4f0f8f254a78cb47e080e7bae6e344a5077","observation_id":"efcd11f5-2eff-45e5-985a-5ec9819e94c7","resolution":{"observed_at":"2026-08-02T10:16:36.314418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-03T00:55:28.889774Z","title":"arXiv preprint arXiv:2306.11507 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28636","last_updated":"2026-05-19T13:56:13Z","snapshot_observed_at":"2026-08-06T00:38:04.006327Z","submitted_at":"2026-05-19T13:56:13Z","title":"Chain-of-Models: Cross-Model Auditing for Bias-Robust LLM Judges","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-08-03T00:55:28.889774Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2607.28636"},"observation_digest":"sha256:442129aae17486d19d04dc589e23296c5f4859ef0588d988bc6784544e39bd9e","observation_id":"726877a8-a677-4263-843b-061db4ead206","resolution":{"observed_at":"2026-08-03T00:55:28.889774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.11507/citation-record","integrity":"/paper/2306.11507/integrity","json":"/paper/2306.11507/citation-record.json","paper":"/paper/2306.11507"},"outbound":[],"paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2306.11507."}