{"as_of":"2026-08-13T17:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10a65851257a9dd59d99cba9b615d16017e52cbe2c4886056cd6f85288b5cef5","coverage":[{"denominator":299,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:41:16.681006Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.03220/citation-record","integrity":"/paper/2412.03220/integrity","json":"/paper/2412.03220/citation-record.json","paper":"/paper/2412.03220"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.654804Z","title":"V aswani, N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.654804Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4b9296fd85ccb51726d11b347b985d9dc87741904bd6efd104bdf753b37dcbf7","observation_id":"82611677-ae5e-436f-b1aa-438dcd5f982e","resolution":{"observed_at":"2026-08-11T22:41:12.654804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.704741Z","title":"Radford, K","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.704741Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:3cc5b876f4cdc0ca1ed11a7ca96e2d7f9a365d95f63473350a73fa2dfd855220","observation_id":"43ea0d31-a3b9-4072-9b65-deae0d35c044","resolution":{"observed_at":"2026-08-11T22:41:12.704741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T22:41:12.751882Z","title":"Devlin, M.-W","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.751882Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e01c6796930335dea9e1b20de57133c1930925b74ab8ca916457c45632f1604e","observation_id":"b2d2ff06-58c2-4f13-8497-59922c64ba4b","resolution":{"observed_at":"2026-08-11T22:41:12.751882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-08-07T23:54:17.436969Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-08-11T22:41:12.804749Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.804749Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:9a16249f07ef44a5eae3645704671b34850e4a9ade3c4d6299cd80a44b3e2b7c","observation_id":"ea10a133-79cb-49cf-87d7-a5a2c1a4f68a","resolution":{"observed_at":"2026-08-11T22:41:12.804749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10845","last_updated":"2023-03-20T03:39:27Z","snapshot_observed_at":"2026-08-13T12:21:03.696747Z","submitted_at":"2023-03-20T03:39:27Z","title":"PanGu-{\\Sigma}: Towards Trillion Parameter Language Model with Sparse Heterogeneous Computing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10845","snapshot_observed_at":"2026-08-11T22:41:12.844818Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.844818Z"},"links":{"cited_paper":"/paper/2303.10845","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e4e5da191d38d6e9fb5a7fa6b416b46f2e371eb0faeed3b95c29c7a1134ccf2d","observation_id":"785180cf-d561-41d9-a1dd-051adb4e1950","resolution":{"observed_at":"2026-08-11T22:41:12.844818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.894756Z","title":"Graves and A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.894756Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:df2b7fcb9f17749781102adfeb5c1187952c51d78d7079c627b4ee65c34a61c2","observation_id":"45a56854-f1ee-4663-9cd4-9fe50f49e244","resolution":{"observed_at":"2026-08-11T22:41:12.894756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:12.954749Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.954749Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:d0275d857dc451a4e0de96bd30bd122e5437997006a179caf0b3b565a1688819","observation_id":"beec97a6-b5b1-4251-8163-1b42705b0516","resolution":{"observed_at":"2026-08-11T22:41:12.954749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07129","last_updated":"2019-06-04T11:35:58Z","snapshot_observed_at":"2026-08-10T10:51:04.299863Z","submitted_at":"2019-05-17T06:24:16Z","title":"ERNIE: Enhanced Language Representation with Informative Entities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07129","snapshot_observed_at":"2026-08-11T22:41:12.984953Z","title":"Zhang, X","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:12.984953Z"},"links":{"cited_paper":"/paper/1905.07129","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:010ba0a67af598b1446ba720b4998d2a65fde1235c84c393bded2aa925682d2a","observation_id":"3ea41689-74ee-46e8-8825-400a384a8d00","resolution":{"observed_at":"2026-08-11T22:41:12.984953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-11T22:41:13.034748Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.034748Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7657ef49e9a54ffab77a5ee2896973e105137b0d51c7f71f81fa0905dcf98656","observation_id":"9b4bc44d-42e1-46ef-a64b-154aa3eccc72","resolution":{"observed_at":"2026-08-11T22:41:13.034748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T22:41:13.094829Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.094829Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:8b6b05ca0a21cc22c487f235dce6ea5bb840c6ebdb98107859c39e300ceca5a0","observation_id":"99099306-cb37-49bd-848e-36068b8c5514","resolution":{"observed_at":"2026-08-11T22:41:13.094829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.142424Z","title":"Raffel, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.142424Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:566653a85877c156f8d0e7b7fb3dd59625689098899cb0d04abcb8513c8f2cfd","observation_id":"63994313-858f-4e82-9fa3-ea3eacf55217","resolution":{"observed_at":"2026-08-11T22:41:13.142424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10360","last_updated":"2022-03-17T11:49:55Z","snapshot_observed_at":"2026-07-06T10:51:12.871009Z","submitted_at":"2021-03-18T16:30:26Z","title":"GLM: General Language Model Pretraining with Autoregressive Blank Infilling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10360","snapshot_observed_at":"2026-08-11T22:41:13.194752Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.194752Z"},"links":{"cited_paper":"/paper/2103.10360","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:43fd2d8af2d8428b608c83af904af1e6e9edb3d77302d996a5afe03cbb3b90af","observation_id":"660fb039-eeaa-4248-bb64-82eb8c5e0c1b","resolution":{"observed_at":"2026-08-11T22:41:13.194752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T22:41:13.234747Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.234747Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:e21251d8808ef6db5c8e41bb13447e69c68beaf751a7f6decf57874d8dd7b8ae","observation_id":"3b3bf56c-dfb7-4c16-b88a-44762cdc999e","resolution":{"observed_at":"2026-08-11T22:41:13.234747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.284749Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.284749Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5d0f585feff629cd3ffbfc231eab0a8ad7e47c7db7a680246eb16423efeea698","observation_id":"0e41000f-db14-499d-8dc0-56e9af14a393","resolution":{"observed_at":"2026-08-11T22:41:13.284749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.464746Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.464746Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ec1f121d4e890d2d2950c9f88bf94b7876f12cb217b6cc9808790eaec19fa0fa","observation_id":"f85d7e6b-f2f5-4dce-928c-8424acba7147","resolution":{"observed_at":"2026-08-11T22:41:13.464746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.514751Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.514751Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:11fa84d2f647e9365403ef7d26b6fe6b101c167dad997afad3c58b09b993e7fd","observation_id":"2896e017-ae70-41e1-9447-ebebd127b13d","resolution":{"observed_at":"2026-08-11T22:41:13.514751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.576025Z","title":"Radford, L","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.576025Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:51c23280c94cff7f7e424c14d6da5d3ac368e9c1a1f86dd4e1328cec15de9079","observation_id":"d3b15ef5-dea0-4bf9-8c95-664d56f8ca0a","resolution":{"observed_at":"2026-08-11T22:41:13.576025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-08-12T18:51:00.108451Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-11T22:41:13.616190Z","title":"Mirza and S","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.616190Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:58129366d76c157cf3fd37d686640ba83127ac294b497e2aaad566c0af419b09","observation_id":"630bcbc0-0218-4c70-97d2-244c5e9d2920","resolution":{"observed_at":"2026-08-11T22:41:13.616190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-07-06T05:27:45.080675Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-11T22:41:13.664741Z","title":"Arjovsky, S","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.664741Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:9df7f9debb88a64b8c3fa0a4a27c02c1d91fe9bb5a55e8ef4119b647ce781447","observation_id":"c2df0cdc-0b73-4b14-9323-f10b16ec2019","resolution":{"observed_at":"2026-08-11T22:41:13.664741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.710992Z","title":"Gulrajani, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.710992Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:303dd27bd86cff66468b48cfd4430b7998f2d99e38ac7485aae9b01bd01b8594","observation_id":"e0270453-fb20-49b2-b7a4-69f4a3fd17bf","resolution":{"observed_at":"2026-08-11T22:41:13.710992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.744808Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.744808Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ae6626a3eb851f1360b3bb2e53d96597fbbea6a21de9fb9617efebbc5dc43a26","observation_id":"39a5fa45-b4ba-4d99-bb91-21e8a974ab59","resolution":{"observed_at":"2026-08-11T22:41:13.744808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.783949Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.783949Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1fd0ca390bb5d4a86d61481c9754fa5e9c4bdc8dc4ae9ed3b3f843a33310c10b","observation_id":"b0692ddb-1d52-400e-9fc6-5869f70f3fbd","resolution":{"observed_at":"2026-08-11T22:41:13.783949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.845286Z","title":"Karras, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.845286Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4f067bbc1f6e2c4258fbf8b7980c661484ab7cd2e7877b7d45cb67eb0757e96e","observation_id":"cc5a096a-1c3f-4961-a8bb-288705d9aa77","resolution":{"observed_at":"2026-08-11T22:41:13.845286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.883530Z","title":"Zhang, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.883530Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4aff960595b59ba5be8618d4b7fb2eaf9da06ff3aaf6d292053b507082d4c0b9","observation_id":"5bd0b2ca-f6fd-41e8-a770-9dbab1936d58","resolution":{"observed_at":"2026-08-11T22:41:13.883530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.925073Z","title":"Brock, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.925073Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1d00fbe5c053a849ff245e1e7f4af0032596074a8365160e661a58332cb8435d","observation_id":"7a3db675-eef9-4d9b-a15e-c8331eab7966","resolution":{"observed_at":"2026-08-11T22:41:13.925073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:13.974848Z","title":"Karras, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:13.974848Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:8c8e5609cfb4d2ea139a8a4df103a5d05780bea366ca0147649f5186e4413aea","observation_id":"389d6f84-5d39-4922-b9d3-bd96cf8367d0","resolution":{"observed_at":"2026-08-11T22:41:13.974848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.025423Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.025423Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:132f01940838478ef906f2c8be614fc3e6a6399f52a07c17f2f6cf6ba050f00f","observation_id":"c0c74810-f18b-4e4e-8348-09529137e5e7","resolution":{"observed_at":"2026-08-11T22:41:14.025423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.064745Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.064745Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a62648b9af2a74f1d905ae1a51018b6e3b9eb5f6567c1cd34b9828a2f9a543f7","observation_id":"cecc579d-fbd1-49f3-84e4-dac0751183ed","resolution":{"observed_at":"2026-08-11T22:41:14.064745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.114887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.114887Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:c2597e9b9274c0179318d2ec561b33e6f30087ec01b79fbe0a3a0f6e8823c594","observation_id":"6eb8058d-3ce2-4580-9cf8-7575eeaa4beb","resolution":{"observed_at":"2026-08-11T22:41:14.114887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.150250Z","title":"Creswell, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.150250Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:bc49e1c53cc417290fc22dd50fbbb41f5ed25c666056bcd7a751024f3c9c3e52","observation_id":"034b2214-39b0-4ad1-b00b-7a18157124c1","resolution":{"observed_at":"2026-08-11T22:41:14.150250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00770","last_updated":"2024-07-12T20:29:57Z","snapshot_observed_at":"2026-08-13T10:22:21.141230Z","submitted_at":"2023-09-02T00:32:55Z","title":"Bias and Fairness in Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00770","snapshot_observed_at":"2026-08-11T22:41:14.204747Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.204747Z"},"links":{"cited_paper":"/paper/2309.00770","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:17e98fa5459b79b78e9ecca7ccac5f00703d7850c306ec6fb225e7630a59a719","observation_id":"5b62a655-9e91-4f45-a9bd-e53ffa61f0f4","resolution":{"observed_at":"2026-08-11T22:41:14.204747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16789","last_updated":"2024-11-25T05:27:13Z","snapshot_observed_at":"2026-08-13T00:22:04.546556Z","submitted_at":"2024-04-25T17:38:57Z","title":"Continual Learning of Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16789","snapshot_observed_at":"2026-08-11T22:41:14.234747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.234747Z"},"links":{"cited_paper":"/paper/2404.16789","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:60a3c861abcf4d9118dc2dcb0fbe408bf16d85354566d2de24603d4e2d79125b","observation_id":"d945bd22-8c68-447c-8a5a-bb1a1f036d76","resolution":{"observed_at":"2026-08-11T22:41:14.234747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-11T22:41:14.294882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.294882Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a82381199e6d146bb685c37866d2e102222a9b5df0e0353c7e53b85d3161af27","observation_id":"31fc77eb-a1cc-426d-8a23-49dcc4162fa7","resolution":{"observed_at":"2026-08-11T22:41:14.294882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17944","last_updated":"2024-06-21T19:59:54Z","snapshot_observed_at":"2026-08-13T04:08:42.656756Z","submitted_at":"2024-02-27T23:59:01Z","title":"Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17944","snapshot_observed_at":"2026-08-11T22:41:14.345214Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.345214Z"},"links":{"cited_paper":"/paper/2402.17944","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5c1d49544f2e680d43ac3e6369ff8251fe89d32e184841debb5e06a0ba2de8da","observation_id":"d6db71df-c293-411f-a2e9-7beda3ae84e4","resolution":{"observed_at":"2026-08-11T22:41:14.345214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00888","last_updated":"2024-11-14T22:20:49Z","snapshot_observed_at":"2026-08-13T04:32:07.137910Z","submitted_at":"2024-01-30T04:00:54Z","title":"Security and Privacy Challenges of Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00888","snapshot_observed_at":"2026-08-11T22:41:14.395130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.395130Z"},"links":{"cited_paper":"/paper/2402.00888","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:aeeb6b4269daf18cd74fab9b8b7579cf5d1c38c1e43e0aae7c99707dbe28e2f5","observation_id":"724fe2e1-587a-4765-a1d6-789ba37618ea","resolution":{"observed_at":"2026-08-11T22:41:14.395130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.424222Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.424222Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f4afbb8ea5c4f0049477e8fa446c28edcfaf2bc09ef6bec8f9fae4c762d7f231","observation_id":"0974a574-cc52-4b13-a953-84ab8c59dd33","resolution":{"observed_at":"2026-08-11T22:41:14.424222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19860","last_updated":"2024-06-18T08:07:01Z","snapshot_observed_at":"2026-08-13T11:28:25.252997Z","submitted_at":"2023-05-31T13:51:26Z","title":"A Survey on Large Language Models for Recommendation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19860","snapshot_observed_at":"2026-08-11T22:41:14.472686Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.472686Z"},"links":{"cited_paper":"/paper/2305.19860","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:9cc6224a652054b7d409bebe27872ba46d394b6929fef54d7ad7863cb3044cbb","observation_id":"aee479cc-df80-4ae9-b7a1-071c7fafa703","resolution":{"observed_at":"2026-08-11T22:41:14.472686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16651","last_updated":"2024-04-25T14:42:12Z","snapshot_observed_at":"2026-08-13T00:22:14.278705Z","submitted_at":"2024-04-25T14:42:12Z","title":"Evolutionary Large Language Models for Hardware Security: A Comparative Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16651","snapshot_observed_at":"2026-08-11T22:41:14.514845Z","title":"Akyash and H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.514845Z"},"links":{"cited_paper":"/paper/2404.16651","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:74bd7c457cd663a50bab285cc22bae6639510b2bea0988530185a77e7eba73ff","observation_id":"1eb92f68-c294-476d-9b6c-34e876e79e0a","resolution":{"observed_at":"2026-08-11T22:41:14.514845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16640","last_updated":"2024-07-18T09:01:52Z","snapshot_observed_at":"2026-08-12T23:57:42.090430Z","submitted_at":"2024-05-26T17:31:21Z","title":"A Survey of Multimodal Large Language Model from A Data-centric Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16640","snapshot_observed_at":"2026-08-11T22:41:14.554744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.554744Z"},"links":{"cited_paper":"/paper/2405.16640","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b5eadffca10a7ead147602dd09eb660e7b237f71462466c53bae0c95c79da14b","observation_id":"c883a0dd-0216-4117-9b13-51557488ce14","resolution":{"observed_at":"2026-08-11T22:41:14.554744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08603","last_updated":"2024-12-30T15:08:23Z","snapshot_observed_at":"2026-08-13T00:07:59.803422Z","submitted_at":"2024-05-14T13:42:05Z","title":"A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08603","snapshot_observed_at":"2026-08-11T22:41:14.590275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.590275Z"},"links":{"cited_paper":"/paper/2405.08603","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:c1b7ad2e9baffcad6d1a9eb303f59dbd7b82316ba4bac91934552710e79306fb","observation_id":"0cefb2fc-e9cc-4b33-8bb7-133ebc5a3dc1","resolution":{"observed_at":"2026-08-11T22:41:14.590275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10825","last_updated":"2024-09-16T05:09:57Z","snapshot_observed_at":"2026-08-13T00:05:03.645081Z","submitted_at":"2024-05-17T14:46:13Z","title":"Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10825","snapshot_observed_at":"2026-08-11T22:41:14.594639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.594639Z"},"links":{"cited_paper":"/paper/2405.10825","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:dc92788028f1e7b1a7d69f9bcb15e40a8e831fac3e0d611e0d14957eebafb439","observation_id":"75dc30b6-818b-482d-a0a7-73089081f7d4","resolution":{"observed_at":"2026-08-11T22:41:14.594639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15777","last_updated":"2024-05-29T15:50:43Z","snapshot_observed_at":"2026-08-13T00:23:09.137603Z","submitted_at":"2024-04-24T09:55:24Z","title":"A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15777","snapshot_observed_at":"2026-08-11T22:41:14.602344Z","title":"Huang, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.602344Z"},"links":{"cited_paper":"/paper/2404.15777","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4ddb51fe81fa1b009848e2c553ef78ace2bd47f6b7d11ab177cd83c8433e7627","observation_id":"e638447b-cd3d-4beb-b3a1-b9def98e536c","resolution":{"observed_at":"2026-08-11T22:41:14.602344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17935","last_updated":"2024-11-04T15:07:18Z","snapshot_observed_at":"2026-08-12T23:56:25.127377Z","submitted_at":"2024-05-28T08:01:26Z","title":"Tool Learning with Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17935","snapshot_observed_at":"2026-08-11T22:41:14.606247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.606247Z"},"links":{"cited_paper":"/paper/2405.17935","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:6c82af020526de295afcde5db63f2ee4fcb81c2be2bd89b3f61fd4472b58b91b","observation_id":"460b2754-3430-4ff0-bd86-fa64385ab668","resolution":{"observed_at":"2026-08-11T22:41:14.606247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12819","last_updated":"2025-08-25T02:35:43Z","snapshot_observed_at":"2026-08-13T00:02:56.561615Z","submitted_at":"2024-05-21T14:24:01Z","title":"Large Language Models Meet NLP: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12819","snapshot_observed_at":"2026-08-11T22:41:14.635156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.635156Z"},"links":{"cited_paper":"/paper/2405.12819","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:70482cd343f82b8f9f1da9dd0ea80bdc7f0ce291192ffaf0ba8499f3bb505aaa","observation_id":"edb33011-29a2-415c-9eee-5e4335c19aa1","resolution":{"observed_at":"2026-08-11T22:41:14.635156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02357","last_updated":"2025-02-21T03:14:05Z","snapshot_observed_at":"2026-08-13T00:15:43.164547Z","submitted_at":"2024-05-03T02:54:43Z","title":"Large Language Models for Mobility Analysis in Transportation Systems: A Survey on Forecasting Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02357","snapshot_observed_at":"2026-08-11T22:41:14.674740Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.674740Z"},"links":{"cited_paper":"/paper/2405.02357","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:54290fbc752898ede443ae42896ab0aa4e18b69f24fc66f8d9cec8b57326c1c1","observation_id":"579a6357-7262-4508-b0ed-5939fd1e1c19","resolution":{"observed_at":"2026-08-11T22:41:14.674740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:14.724749Z","title":"Kukreja, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.724749Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:9791ed1e4b7e8e850368c25f8cbb30e19599edd2c8c3e9fedfbc6a13abc7c0da","observation_id":"e55d65d3-270b-4d54-8e7f-6c571e9316eb","resolution":{"observed_at":"2026-08-11T22:41:14.724749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04925","last_updated":"2024-04-07T11:52:44Z","snapshot_observed_at":"2026-08-13T00:35:36.874116Z","submitted_at":"2024-04-07T11:52:44Z","title":"Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04925","snapshot_observed_at":"2026-08-11T22:41:14.774825Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.774825Z"},"links":{"cited_paper":"/paper/2404.04925","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:6afd2c4e610a8b2161ea497ada9cf86421cf124cbe4fbd1e4bc323710acf43e1","observation_id":"863bc4ed-d05c-4429-9d07-57ab6a0035c9","resolution":{"observed_at":"2026-08-11T22:41:14.774825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11457","last_updated":"2024-08-21T17:23:03Z","snapshot_observed_at":"2026-08-13T00:28:08.722362Z","submitted_at":"2024-04-17T15:05:03Z","title":"Bias and Unfairness in Information Retrieval Systems: New Challenges in the LLM Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11457","snapshot_observed_at":"2026-08-11T22:41:14.824752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.824752Z"},"links":{"cited_paper":"/paper/2404.11457","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:669b555bd79fecd86420dfa4ccaa5ea8bdefd4b0a2a3dbb4729aab4958c5edfe","observation_id":"1b096fbc-c65c-4343-8040-bfec3a2eef95","resolution":{"observed_at":"2026-08-11T22:41:14.824752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-11T22:41:14.874745Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.874745Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:adb5f04d409d66e0443868a19599af47bbbb63cd84dde12aecf9198a919ee892","observation_id":"e9d26b44-ab36-48fa-822f-5968a4bd48b9","resolution":{"observed_at":"2026-08-11T22:41:14.874745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13501","snapshot_observed_at":"2026-08-11T22:41:14.914745Z","title":"Zhang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.914745Z"},"links":{"cited_paper":"/paper/2404.13501","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:6a1b2b999669fec21703ed7d074db0400d23c8cd45c0c94f2bd8033afb8e68cf","observation_id":"64ed5af9-8f63-4bce-a8ed-faf5267955d7","resolution":{"observed_at":"2026-08-11T22:41:14.914745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02039","last_updated":"2026-06-08T03:25:04Z","snapshot_observed_at":"2026-08-13T00:39:11.868035Z","submitted_at":"2024-04-02T15:34:18Z","title":"A Survey on Large Language Model-Based Game Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02039","snapshot_observed_at":"2026-08-11T22:41:14.964744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:14.964744Z"},"links":{"cited_paper":"/paper/2404.02039","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f72d37247289d7d65ff7b2dcb5a599f148e731feea970c9afd246a9b6005cb49","observation_id":"43f602a8-4800-4c2d-8af6-5a55cf5dcfba","resolution":{"observed_at":"2026-08-11T22:41:14.964744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-11T22:41:15.014745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.014745Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b4b320ce4a2383be4d30a8469dba87e1c98fc2b61df1ee76c30eee9cc49966ed","observation_id":"aa9547f7-a026-404b-9fab-c124a91e0759","resolution":{"observed_at":"2026-08-11T22:41:15.014745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10981","last_updated":"2024-08-23T00:17:02Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T01:27:42Z","title":"A Survey on Retrieval-Augmented Text Generation for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10981","snapshot_observed_at":"2026-08-11T22:41:15.054746Z","title":"Huang and J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.054746Z"},"links":{"cited_paper":"/paper/2404.10981","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:de5720700657fb3958986524b8a76fa70c921a6a2fa490f23ef9eb28bec8dd0b","observation_id":"037f8e6f-bcc6-479b-8f5d-da5d8d6c0faf","resolution":{"observed_at":"2026-08-11T22:41:15.054746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.095938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.095938Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f7658f707d17d45d8c032e04c15a63fad4bb337e7ec39bb3534a51147850d9d7","observation_id":"e3e3287d-fa30-4525-b692-d25fffbf3da7","resolution":{"observed_at":"2026-08-11T22:41:15.095938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-11T22:41:15.144746Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.144746Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:5a58b397e4c0ee6176cc13bceb790b30ea405655d51352cb7ba6a1af3a33a2a4","observation_id":"87bdff43-1290-4a18-92f9-803331f1d049","resolution":{"observed_at":"2026-08-11T22:41:15.144746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.193425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.193425Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1c01873c62fce6784fefb339447a19a070e9559324e8e3c8668b6467c02fc8b7","observation_id":"f794ce7d-b28e-4206-981c-695466e0df31","resolution":{"observed_at":"2026-08-11T22:41:15.193425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.234819Z","title":"Chang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.234819Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:59974b16540754017536b1886c8b603876dd6d1fd4db2e02c5c48fcd8844fa7e","observation_id":"2c7e704d-cdb1-475a-b9c1-44061ce33790","resolution":{"observed_at":"2026-08-11T22:41:15.234819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-11T22:41:15.264745Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.264745Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:aa8fc267bdf2ead53316cecd2589e891a97c823d1b0f4f9526b78966092919e4","observation_id":"a19ad175-8681-47b6-8b8b-287325f74473","resolution":{"observed_at":"2026-08-11T22:41:15.264745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.316149Z","title":"Zhang, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.316149Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:85bbd37897d57ba4e7e0c70f349f4e816e2a07237a3c33b07083b015c4fe1fa7","observation_id":"dc0edaa1-11b1-443b-8435-0d87662b1b3d","resolution":{"observed_at":"2026-08-11T22:41:15.316149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.364751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.364751Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7536b1a738c3e638495a379ba83d22feec2efb154193b49ad70e26dea7ef0eed","observation_id":"ac9af0bd-0cbd-4429-8d80-afebba180588","resolution":{"observed_at":"2026-08-11T22:41:15.364751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05156","last_updated":"2024-03-14T14:17:57Z","snapshot_observed_at":"2026-08-13T00:59:28.434753Z","submitted_at":"2024-03-08T08:47:48Z","title":"On Protecting the Data Privacy of Large Language Models (LLMs): A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05156","snapshot_observed_at":"2026-08-11T22:41:15.424747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.424747Z"},"links":{"cited_paper":"/paper/2403.05156","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4b256a20d8b9652b8b51ba800e9bf185a8fa628c00990c98bfa77b93e3e6b6a7","observation_id":"2705337f-f043-49da-ae83-88da001d3f9e","resolution":{"observed_at":"2026-08-11T22:41:15.424747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00282","last_updated":"2024-10-30T02:22:46Z","snapshot_observed_at":"2026-08-13T00:41:00.933176Z","submitted_at":"2024-03-30T08:28:08Z","title":"Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00282","snapshot_observed_at":"2026-08-11T22:41:15.474746Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.474746Z"},"links":{"cited_paper":"/paper/2404.00282","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b331cec16decb8382fca22e5bfc358b58a3eced25ababbd7d57d5570978a6cc9","observation_id":"e361eef6-ebf3-4e4b-b2f3-f2944eba3770","resolution":{"observed_at":"2026-08-11T22:41:15.474746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09606","last_updated":"2025-03-21T04:57:45Z","snapshot_observed_at":"2026-08-13T00:54:04.016167Z","submitted_at":"2024-03-14T17:47:20Z","title":"Large Language Models and Causal Inference in Collaboration: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09606","snapshot_observed_at":"2026-08-11T22:41:15.524927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.524927Z"},"links":{"cited_paper":"/paper/2403.09606","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b9bc4f64c4a801a12be73f28b1cb66855d4d789f25f2ff339b4b4b5944d13691","observation_id":"fa2d271b-7d3e-4450-b6f3-4ea87f91180f","resolution":{"observed_at":"2026-08-11T22:41:15.524927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.574737Z","title":"Esmradi, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.574737Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:cf49077801ce9854d446e042b59894a7c0afc5c61ed0b693de56ae50205a5114","observation_id":"d2fcd1c0-4f7c-4b9a-a6b5-0ca6d394a36b","resolution":{"observed_at":"2026-08-11T22:41:15.574737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.614892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.614892Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:1b76180031d500aaddcef23b6324b13b4a55e56322964cb78ed72a4253efb495","observation_id":"1cb29da8-099c-48e0-a0a1-cb2a643a3f97","resolution":{"observed_at":"2026-08-11T22:41:15.614892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09136","last_updated":"2023-03-16T08:01:22Z","snapshot_observed_at":"2026-08-13T12:23:35.027818Z","submitted_at":"2023-03-16T08:01:22Z","title":"A Short Survey of Viewing Large Language Models in Legal Aspect","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09136","snapshot_observed_at":"2026-08-11T22:41:15.655796Z","title":"Sun, ‘‘A short survey of viewing large language models in legal aspect,’’ arXiv preprint arXiv:2303.09136, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.655796Z"},"links":{"cited_paper":"/paper/2303.09136","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0d077fd1e15f435c6fbccbc7e2f11b1c1a354376bde628886d78c9819c846c80","observation_id":"4c064255-8a07-4034-92bd-1a1827bac0c9","resolution":{"observed_at":"2026-08-11T22:41:15.655796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.694733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.694733Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:006cbc940ac3d27cd14f43ff793680737d721a674d99e9163afe694407d21336","observation_id":"20b011b1-5dd7-49be-b612-5e5d6fd24875","resolution":{"observed_at":"2026-08-11T22:41:15.694733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.744742Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.744742Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:24b6f146acd5ab8b2bd006a7632a55a2c0c2003061d3b154e41a93de1361277b","observation_id":"99119285-170e-4c1d-88eb-08859e1d5815","resolution":{"observed_at":"2026-08-11T22:41:15.744742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16765","last_updated":"2024-01-30T06:04:04Z","snapshot_observed_at":"2026-08-13T04:32:04.658955Z","submitted_at":"2024-01-30T06:04:04Z","title":"A Cross-Language Investigation into Jailbreak Attacks in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16765","snapshot_observed_at":"2026-08-11T22:41:15.794741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.794741Z"},"links":{"cited_paper":"/paper/2401.16765","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:139cfb0da71851956f22893078907834e7eea2e44686358d6edc3857db68d82a","observation_id":"6dadc31c-c90f-409c-8059-92e570f396f2","resolution":{"observed_at":"2026-08-11T22:41:15.794741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-11T22:41:15.834839Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.834839Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:4942792455dd63ca4ff4ce39c4f11c33d42a7477ed5b4fdf0a91bd36ed49a98d","observation_id":"191fc505-7715-4e55-a1f0-09fe7e69f831","resolution":{"observed_at":"2026-08-11T22:41:15.834839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-11T22:41:15.864583Z","title":"Huang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.864583Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b83dea0baaf315200c5673d012e4f4480456e8ba58ebf86d0a8dca8a11c83e0b","observation_id":"5fd2d318-4117-4ba3-8955-dd53254813b0","resolution":{"observed_at":"2026-08-11T22:41:15.864583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10844","last_updated":"2023-10-16T21:37:24Z","snapshot_observed_at":"2026-08-13T05:48:02.836662Z","submitted_at":"2023-10-16T21:37:24Z","title":"Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10844","snapshot_observed_at":"2026-08-11T22:41:15.914751Z","title":"Shayegani, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.914751Z"},"links":{"cited_paper":"/paper/2310.10844","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a9ac20800774daf97f68c9c501faa31e35ff27822298ffce6d4337f76b1455ba","observation_id":"abe44304-5351-4a34-8d76-63fee4073b07","resolution":{"observed_at":"2026-08-11T22:41:15.914751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:15.965401Z","title":"Zhang, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:15.965401Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:176ceb55b260bc569ebc51cc2f368a6f5380405eb455644099a0661ba428bfb6","observation_id":"05ba6c55-8832-47b0-a5ff-faee2c3304e4","resolution":{"observed_at":"2026-08-11T22:41:15.965401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.005506Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.005506Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:00bebd9cfc2bb2e97cf5a5df2a3960762f93568d21d7cf75953f808c0c566cd7","observation_id":"dd7e8289-44f3-42fa-90bb-7ebb5ddce20f","resolution":{"observed_at":"2026-08-11T22:41:16.005506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-11T22:41:16.054823Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.054823Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:78f02d318f732e08b06f6c9d15b104e7d0ff918dc2bb65a26a5d4dedf62ab238","observation_id":"33653165-f121-4212-9a00-869967d74eb0","resolution":{"observed_at":"2026-08-11T22:41:16.054823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-13T10:34:25.802574Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T22:41:16.084747Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.084747Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:edce91006120759a32d2d4dac0d4fc903aab8854341b3d56dcd0d606757db17f","observation_id":"b4d59a57-c4c1-485d-9f12-a06f45e2ba99","resolution":{"observed_at":"2026-08-11T22:41:16.084747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.122350Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.122350Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:2006f7b2de220a508be61deec05b79c23ea3b01b4f2a4f3f87d06250a2ed3fe1","observation_id":"f4f921ca-48d9-4c02-bbaa-9a88d19fab9d","resolution":{"observed_at":"2026-08-11T22:41:16.122350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.156378Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.156378Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ca92a2be9f542aaae1f5cabe7921b04401d7d34fa1b29774475b178d49cefdec","observation_id":"abe42053-0a7c-4ec0-ba0d-6b2bcff4c689","resolution":{"observed_at":"2026-08-11T22:41:16.156378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10403","last_updated":"2023-05-26T17:59:33Z","snapshot_observed_at":"2026-08-06T19:23:30.079167Z","submitted_at":"2022-12-20T16:29:03Z","title":"Towards Reasoning in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10403","snapshot_observed_at":"2026-08-11T22:41:16.194745Z","title":"Huang and K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.194745Z"},"links":{"cited_paper":"/paper/2212.10403","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:6fca112090aad215e470af43ca2f8c058169348f1072a267b100b0cf12a27a77","observation_id":"9dc52745-a088-4959-a298-77e8fb2851ae","resolution":{"observed_at":"2026-08-11T22:41:16.194745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.206532Z","title":"Kasneci, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.206532Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:8949c874c9344e301b1561dcdfa8542e02f6db99de5a349ef94d30521d7b6d37","observation_id":"ab47a09b-ffe1-4490-a8d3-c47be1317bbe","resolution":{"observed_at":"2026-08-11T22:41:16.206532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-11T22:41:16.213831Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.213831Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f5e962924759f1e026a1673aa343a806b0905470610364927813019a4a1febf0","observation_id":"f5588410-6792-4c2a-be41-5526930efce6","resolution":{"observed_at":"2026-08-11T22:41:16.213831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07842","last_updated":"2023-02-15T18:25:52Z","snapshot_observed_at":"2026-07-30T02:11:00.198428Z","submitted_at":"2023-02-15T18:25:52Z","title":"Augmented Language Models: a Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07842","snapshot_observed_at":"2026-08-11T22:41:16.232176Z","title":"Mialon, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.232176Z"},"links":{"cited_paper":"/paper/2302.07842","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:d634c22bb8f11b68d65a576709eee96ed4d3172006ed88696a8dc3e49eb45d2d","observation_id":"d12345bc-dcef-4d67-a2d7-6654e0c0de12","resolution":{"observed_at":"2026-08-11T22:41:16.232176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.250430Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.250430Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:65611dd2346bd00eef6f76a7a9995ba33a9c73eb3f408ee682c10be57e38cce5","observation_id":"6b3aa84c-15ec-46a4-a165-78190aa69561","resolution":{"observed_at":"2026-08-11T22:41:16.250430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05542","last_updated":"2021-08-28T05:59:16Z","snapshot_observed_at":"2026-08-10T20:10:16.431097Z","submitted_at":"2021-08-12T05:32:18Z","title":"AMMUS : A Survey of Transformer-based Pretrained Models in Natural Language Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05542","snapshot_observed_at":"2026-08-11T22:41:16.258290Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.258290Z"},"links":{"cited_paper":"/paper/2108.05542","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:b21ca62090d4d8441344fecf35738b7cfc60aa248fcc95d7fb093e8469878d68","observation_id":"09fd1a7a-03b5-4a91-b73a-35df04ebdd5a","resolution":{"observed_at":"2026-08-11T22:41:16.258290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.274751Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.274751Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f8965f89dfdd8b2c6c29ce0063dcc8808c724fc2bac6cc837a0c2777b636561c","observation_id":"ac054396-6170-4c4c-82ab-04d2055111d9","resolution":{"observed_at":"2026-08-11T22:41:16.274751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.324731Z","title":"Houlsby, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.324731Z"},"links":{"citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7bd75836010add2a4da7ae870322b13a9e3be4ce5817238e0e949ccb89362545","observation_id":"9c039228-d497-45a1-9c32-d9ddf0504227","resolution":{"observed_at":"2026-08-11T22:41:16.324731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04366","last_updated":"2022-02-02T16:39:23Z","snapshot_observed_at":"2026-08-09T04:45:04.547249Z","submitted_at":"2021-10-08T20:22:26Z","title":"Towards a Unified View of Parameter-Efficient Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04366","snapshot_observed_at":"2026-08-11T22:41:16.374738Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.374738Z"},"links":{"cited_paper":"/paper/2110.04366","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f2ce2ce14840bff7c408a454347f7ad69591855d8e6b58335dca760d69f9676f","observation_id":"14852458-c03e-4c7e-ac72-5d804c625d8c","resolution":{"observed_at":"2026-08-11T22:41:16.374738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08154","last_updated":"2021-09-12T09:10:43Z","snapshot_observed_at":"2026-08-07T09:24:32.417029Z","submitted_at":"2021-04-16T14:58:28Z","title":"Counter-Interference Adapter for Multilingual Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08154","snapshot_observed_at":"2026-08-11T22:41:16.415363Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.415363Z"},"links":{"cited_paper":"/paper/2104.08154","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0d84b30f80bcec857d628e697f8d557e649383b64f8cff300364e34be7ccf4df","observation_id":"ba337ff2-8ee6-4a83-9ed4-f84e8b50637d","resolution":{"observed_at":"2026-08-11T22:41:16.415363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04947","last_updated":"2023-11-26T22:00:36Z","snapshot_observed_at":"2026-08-13T12:05:18.889476Z","submitted_at":"2023-04-11T03:17:37Z","title":"Conditional Adapters: Parameter-efficient Transfer Learning with Fast Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04947","snapshot_observed_at":"2026-08-11T22:41:16.457033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.457033Z"},"links":{"cited_paper":"/paper/2304.04947","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:67d2dad54a948539c7e2c2b3854249af50b3f1924ab8d896c01de35b84ae68c7","observation_id":"34a495c4-b219-4dcf-b47b-bf9f681490d0","resolution":{"observed_at":"2026-08-11T22:41:16.457033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00247","last_updated":"2021-01-26T12:54:33Z","snapshot_observed_at":"2026-08-11T03:47:32.551562Z","submitted_at":"2020-05-01T07:03:42Z","title":"AdapterFusion: Non-Destructive Task Composition for Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00247","snapshot_observed_at":"2026-08-11T22:41:16.462542Z","title":"Pfeiffer, A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.462542Z"},"links":{"cited_paper":"/paper/2005.00247","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:7848ed043c62fdbf9d9fdf3ac06ba85178e137d9fed0d8a0d57f1fa11410ca05","observation_id":"4146b7c1-5000-4f5c-a439-2159422a874e","resolution":{"observed_at":"2026-08-11T22:41:16.462542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12410","last_updated":"2022-11-02T02:47:17Z","snapshot_observed_at":"2026-08-13T15:37:41.574768Z","submitted_at":"2022-05-24T23:41:22Z","title":"AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12410","snapshot_observed_at":"2026-08-11T22:41:16.467494Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.467494Z"},"links":{"cited_paper":"/paper/2205.12410","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:355732a87c89332ecae060bc4cdf0eeef56da00b9978804b08cf24a7c64daf00","observation_id":"974e048c-665b-4ab3-ab8f-79e91617b58c","resolution":{"observed_at":"2026-08-11T22:41:16.467494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11670","last_updated":"2023-11-11T15:30:30Z","snapshot_observed_at":"2026-08-13T05:47:11.344758Z","submitted_at":"2023-10-18T02:42:17Z","title":"Prototype-based HyperAdapter for Sample-Efficient Multi-task Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11670","snapshot_observed_at":"2026-08-11T22:41:16.473853Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.473853Z"},"links":{"cited_paper":"/paper/2310.11670","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:58a76d60b588c8aba78ded61a574945e664261530a36eaf080a6ce7b152166c5","observation_id":"eacfd047-015a-494b-aa2e-c9f059ce2dc7","resolution":{"observed_at":"2026-08-11T22:41:16.473853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07027","last_updated":"2023-03-28T13:37:54Z","snapshot_observed_at":"2026-08-13T12:44:46.344750Z","submitted_at":"2023-02-14T13:09:23Z","title":"AdapterSoup: Weight Averaging to Improve Generalization of Pretrained Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07027","snapshot_observed_at":"2026-08-11T22:41:16.479105Z","title":"Chronopoulou, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.479105Z"},"links":{"cited_paper":"/paper/2302.07027","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:60e3628a8a1a4ee902dfdbbc05f04e53984cafdc8bb1da226621543bab53644a","observation_id":"813512e1-cfec-4f35-9daf-e5d650e76c64","resolution":{"observed_at":"2026-08-11T22:41:16.479105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15982","last_updated":"2023-08-30T12:10:17Z","snapshot_observed_at":"2026-08-13T10:24:15.479407Z","submitted_at":"2023-08-30T12:10:17Z","title":"MerA: Merging Pretrained Adapters For Few-Shot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15982","snapshot_observed_at":"2026-08-11T22:41:16.499358Z","title":"He, R.-Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.499358Z"},"links":{"cited_paper":"/paper/2308.15982","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:c1b94d8f826f1982f245fc3f83718ae0f8b032b064b77dc2954ba4ae2d6dc852","observation_id":"0bdc982a-e757-470b-b333-b8ea50432b9e","resolution":{"observed_at":"2026-08-11T22:41:16.499358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04489","last_updated":"2021-06-08T16:16:40Z","snapshot_observed_at":"2026-08-12T03:50:49.826717Z","submitted_at":"2021-06-08T16:16:40Z","title":"Parameter-efficient Multi-task Fine-tuning for Transformers via Shared Hypernetworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04489","snapshot_observed_at":"2026-08-11T22:41:16.521964Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.521964Z"},"links":{"cited_paper":"/paper/2106.04489","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:59722a5631e3925c7598b0d57d7a4a1bbddc49737c3cee4396c9975b5284754f","observation_id":"dce691b8-f18f-4294-b7e6-b9f7fa9d4771","resolution":{"observed_at":"2026-08-11T22:41:16.521964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-08-12T12:37:28.207761Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-11T22:41:16.554754Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.554754Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:ce9515affc1ea0e580480b1092662fe918c26927cc5b24996c3ed3ba59d19e99","observation_id":"b67e66eb-8e30-46b8-be79-95256142c204","resolution":{"observed_at":"2026-08-11T22:41:16.554754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12086","last_updated":"2023-05-24T21:13:24Z","snapshot_observed_at":"2026-08-13T11:38:20.560389Z","submitted_at":"2023-05-20T04:07:06Z","title":"Prefix Propagation: Parameter-Efficient Tuning for Long Sequences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12086","snapshot_observed_at":"2026-08-11T22:41:16.590001Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.590001Z"},"links":{"cited_paper":"/paper/2305.12086","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:a7274b7182b6a3ab96bd19dd1e8f1154af92a15af8d301b608d5fa509ff21a17","observation_id":"a2aa64af-2cac-4ca4-966f-58d0ac4201c8","resolution":{"observed_at":"2026-08-11T22:41:16.590001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-10T14:24:20.137867Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-11T22:41:16.599307Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.599307Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:771919936eac78101e51c230e0a5dbd370853b610cbe4706d5eca1c5733a1b52","observation_id":"54cb2d41-b1e8-4cfd-b900-b284415c9fed","resolution":{"observed_at":"2026-08-11T22:41:16.599307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15212","last_updated":"2023-05-24T14:51:01Z","snapshot_observed_at":"2026-08-13T11:34:22.973849Z","submitted_at":"2023-05-24T14:51:01Z","title":"Towards Adaptive Prefix Tuning for Parameter-Efficient Language Model Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15212","snapshot_observed_at":"2026-08-11T22:41:16.654757Z","title":"Zhang, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.654757Z"},"links":{"cited_paper":"/paper/2305.15212","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:0c4d99a41b5c499bfbfb5d9c3f869fc89a79b05b3ba792702fd22244e34ce551","observation_id":"c29b0258-87af-44c8-a039-369587852d2b","resolution":{"observed_at":"2026-08-11T22:41:16.654757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10385","last_updated":"2023-10-25T06:15:58Z","snapshot_observed_at":"2026-08-10T18:45:39.374133Z","submitted_at":"2021-03-18T17:13:50Z","title":"GPT Understands, Too","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10385","snapshot_observed_at":"2026-08-11T22:41:16.681006Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.681006Z"},"links":{"cited_paper":"/paper/2103.10385","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:f940e139c3bdad3e79872f085a541caf260b3825816dce68b3d87195ac229fbe","observation_id":"f01d68d0-c585-41fb-a770-58a43cec40ea","resolution":{"observed_at":"2026-08-11T22:41:16.681006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T12:49:26.822661Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":299},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 299 outbound references and 0 inbound Pith citation observations for arXiv:2412.03220."}