{"as_of":"2026-08-09T03:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a455b3013f9dbd3d7dd8bf39b2b1ce64b6b6d86f14f5b05fbea780f9386484be","coverage":[{"denominator":186,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T18:43:34.392938Z","state":"measured"},{"denominator":107,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":107,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:35:42.887822Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T07:06:44.072099Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-08-07T11:35:42.887822Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02203","last_updated":"2025-06-02T19:43:40Z","snapshot_observed_at":"2026-08-07T11:26:20.584154Z","submitted_at":"2025-06-02T19:43:40Z","title":"Constrained Sliced Wasserstein Embedding","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:42.887822Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2506.02203"},"observation_digest":"sha256:08e02c4f21a729aca30783642ecb0cb7ddb081eb092959492e399ccd13a6ba38","observation_id":"77004d3b-9afb-4cc3-8130-603cb1174248","resolution":{"observed_at":"2026-08-07T11:35:42.887822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":"2502.06881","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-07-02T07:06:44.072099Z","title":"arXiv preprint arXiv:2502.06881 , year=","venue":null,"work_id":"fd73e73b-7480-47f0-a3cf-8dc88a8d36b5","year":2025},"citing_paper":{"arxiv_id":"2605.21485","last_updated":"2026-05-20T17:59:16Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:59:16Z","title":"EvoStruct: Bridging Evolutionary and Structural Priors for Antibody CDR Design via Protein Language Model Adaptation","version":1},"reference_index":187,"source":"arxiv_source","source_observed_at":"2026-05-21T05:06:06.626303Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2605.21485"},"observation_digest":"sha256:0f7dd973505b61a68bad8bb6a7b48933a84358b633427d249090937ac7ce2820","observation_id":"5431070d-026a-4d5d-8813-4b2f22649764","resolution":{"observed_at":"2026-05-21T05:09:38.648033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":"2502.06881","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-07-02T07:06:44.072099Z","title":"arXiv preprint arXiv:2502.06881 , year=","venue":null,"work_id":"fd73e73b-7480-47f0-a3cf-8dc88a8d36b5","year":2025},"citing_paper":{"arxiv_id":"2605.21600","last_updated":"2026-06-26T01:06:09Z","snapshot_observed_at":"2026-08-03T03:48:18.044746Z","submitted_at":"2026-05-20T18:04:32Z","title":"ConTact: Contact-First Antibody CDR Design via Explicit Interface Reasoning","version":1},"reference_index":187,"source":"arxiv_source","source_observed_at":"2026-05-22T09:29:45.993792Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2605.21600"},"observation_digest":"sha256:8a8531720a5d739e50ea9e567d771ca9fb00c0bdb692a686276c1e303f71d950","observation_id":"0e843f8a-ddfc-4e73-ab03-042923c60f45","resolution":{"observed_at":"2026-05-22T09:31:22.672907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":"2502.06881","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-07-02T07:06:44.072099Z","title":"arXiv preprint arXiv:2502.06881 , year=","venue":null,"work_id":"fd73e73b-7480-47f0-a3cf-8dc88a8d36b5","year":2025},"citing_paper":{"arxiv_id":"2605.21610","last_updated":"2026-05-20T18:16:52Z","snapshot_observed_at":"2026-07-31T20:59:05.760224Z","submitted_at":"2026-05-20T18:16:52Z","title":"AgForce Enables Antigen-conditioned Generative Antibody Design","version":1},"reference_index":187,"source":"arxiv_source","source_observed_at":"2026-05-22T09:21:17.324165Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2605.21610"},"observation_digest":"sha256:caa888ffbe66c707b9db6230821be6a0a888d15458735cac592d9df9abff81ed","observation_id":"47c3dbb9-aeaf-4806-b9f2-91ddebf5e44e","resolution":{"observed_at":"2026-05-22T09:21:20.586566Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":"2502.06881","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-07-02T07:06:44.072099Z","title":"arXiv preprint arXiv:2502.06881 , year=","venue":null,"work_id":"fd73e73b-7480-47f0-a3cf-8dc88a8d36b5","year":2025},"citing_paper":{"arxiv_id":"2606.04154","last_updated":"2026-06-02T19:20:25Z","snapshot_observed_at":"2026-08-03T10:59:46.260266Z","submitted_at":"2026-06-02T19:20:25Z","title":"EpiFormer: Learning Antigen-Antibody Interactions for Epitope Prediction via Geometric Deep Learning","version":1},"reference_index":163,"source":"arxiv_source","source_observed_at":"2026-06-28T07:12:15.396602Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2606.04154"},"observation_digest":"sha256:4f5ac45b5c15c7737c51f5136f9bbddb0385737e4c8f8a7f000ac52c20ba06e4","observation_id":"1ef55337-6f40-4eb1-9f3e-8f846ca6ad92","resolution":{"observed_at":"2026-07-02T07:06:44.073690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":"2502.06881","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-07-02T07:06:44.072099Z","title":"arXiv preprint arXiv:2502.06881 , year=","venue":null,"work_id":"fd73e73b-7480-47f0-a3cf-8dc88a8d36b5","year":2025},"citing_paper":{"arxiv_id":"2606.29529","last_updated":"2026-06-28T17:51:13Z","snapshot_observed_at":"2026-07-07T00:03:31.715960Z","submitted_at":"2026-06-28T17:51:13Z","title":"Modeling Protein Evolution with Generative Models: from Extant Sequence Data to Evolutionary Dynamics","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-30T01:50:58.030760Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2606.29529"},"observation_digest":"sha256:c82ea19ea803bb012b908245ff0556eb26a9022c79e48c78cc5d23ce92a5273b","observation_id":"59436795-4f5c-4c1d-ba50-858edd3fc86f","resolution":{"observed_at":"2026-06-30T03:04:14.439520Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06881","snapshot_observed_at":"2026-07-13T00:48:08.651522Z","title":"A comprehensive review of protein language models.arXiv preprint arXiv:2502.06881, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09039","last_updated":"2026-07-10T02:11:43Z","snapshot_observed_at":"2026-08-02T23:13:10.516801Z","submitted_at":"2026-07-10T02:11:43Z","title":"Variable-Length Generative Protein Design via Generalized Poisson Flow","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T00:48:08.651522Z"},"links":{"cited_paper":"/paper/2502.06881","citing_paper":"/paper/2607.09039"},"observation_digest":"sha256:43446ce14da717eb4d9393514d34431b9c0f85997d7e6c007bc9de4a4a1d6ccc","observation_id":"b2895b3d-195a-4315-9541-e90f20a91c83","resolution":{"observed_at":"2026-07-13T00:48:08.651522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06881/citation-record","integrity":"/paper/2502.06881/integrity","json":"/paper/2502.06881/citation-record.json","paper":"/paper/2502.06881"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.899330Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.899330Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:23362b8768b92a7fc81e351239e0d9e2e7991ab18ac148fcc427b55668559afa","observation_id":"9506a499-0d3c-4819-a821-4e38557e5769","resolution":{"observed_at":"2026-08-08T18:43:33.899330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.905857Z","title":"Nomenclature and symbolism for amino acids and pep- tides","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.905857Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:e920dc856a484e934532d74cef972363ab87c3c6dfccc646e203ca8e163a838a","observation_id":"7941504c-75bf-406c-8597-c697546204f3","resolution":{"observed_at":"2026-08-08T18:43:33.905857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.911012Z","title":"Principles that govern the folding of protein chains","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.911012Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:e846928b310332bfac59a4981caca7eddd0a2bc3ce2bef9fb1cd3472aafcbd70","observation_id":"3197ab4f-8b6e-49a3-a5b8-f65817a4cfa9","resolution":{"observed_at":"2026-08-08T18:43:33.911012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.916033Z","title":"Learning the pro- tein language: Evolution, structure, and function","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.916033Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:0f9fe25102f8e145b6ef146c8de1fa9adf05cf3e9b899bd9610f1183067feb87","observation_id":"f0380ed8-7b96-4aff-ba5d-f11dae933479","resolution":{"observed_at":"2026-08-08T18:43:33.916033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.920814Z","title":"Biolog- ical structure and function emerge from scaling un- supervised learning to 250 million protein sequences","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.920814Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:2f07e478069ea564cfaa0a8141f9cf4e90fbe9b337b035bfce0ee5aab8ccea2b","observation_id":"e90b71d6-4249-46fa-a14f-f6515fc6f892","resolution":{"observed_at":"2026-08-08T18:43:33.920814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.926162Z","title":"Prottrans: Toward understanding the language of life through self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.926162Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:49a492ff974b6d6a577df315b4e70ca4341b5cd693ee50f084bff63d0e415626","observation_id":"e7658d47-99b3-46cc-a296-f2a86f60d935","resolution":{"observed_at":"2026-08-08T18:43:33.926162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.931822Z","title":"Fine-tuning protein language models boosts pre- dictions across diverse tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.931822Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:30be065313f3e97eefd1f6424de1f987bcb2b2015031e8a433cd0556faed8f1b","observation_id":"54be4bbd-26e2-4c54-b2fe-bfbbce837f3f","resolution":{"observed_at":"2026-08-08T18:43:33.931822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.936783Z","title":"Lm-gvp: an extensible sequence and structure informed deep learning frame- work for protein property prediction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.936783Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:2a93d2c144262263e4b5505ea305632b57645a20a4d7b561f98555e1fcf2701e","observation_id":"d7b071e0-1b44-471d-82d4-37d7fbbcab06","resolution":{"observed_at":"2026-08-08T18:43:33.936783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.941449Z","title":"Deep learning in bioinformatics: Introduction, application, and perspective in the big data era","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.941449Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:bfadf00cc94bafa0fdf4a8db3579f052d22a2245e564fbf15a7156fc2fcf0aa8","observation_id":"1767bf09-21c0-4b0e-a5a2-fc4f1e7d6038","resolution":{"observed_at":"2026-08-08T18:43:33.941449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-08T18:43:33.946308Z","title":"Efficient estimation of word represen- tations in vector space","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.946308Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:c20752793a966efcf5503a589ce9fa90274a9d4892c05b7af6d03cfe1b480b64","observation_id":"fc224fc3-4498-49cd-b384-9490468146b9","resolution":{"observed_at":"2026-08-08T18:43:33.946308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.951747Z","title":"Con- tinuous distributed representation of biological se- quences for deep proteomics and genomics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.951747Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:25e4e5a39803356d949905a7ffae099f8aadd79ce973fc993a76531c6389aa88","observation_id":"f3a27974-6307-4baf-82ef-3480aa6623c8","resolution":{"observed_at":"2026-08-08T18:43:33.951747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.956348Z","title":"Uniprotkb/swiss-prot, the manually annotated section of the uniprot knowledgebase: how to use the entry view","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.956348Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:8d1fda5c480e8d96117d37531386adaee97e012fbc4670cfa6e5506f9a9eada3","observation_id":"e9891b56-af93-4d25-a1b4-b6f64212ba8b","resolution":{"observed_at":"2026-08-08T18:43:33.956348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.961006Z","title":"Probabilistic variable-length segmen- tation of protein sequences for discriminative motif dis- JOURNAL OF LATEX CLASS FILES, VOL","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.961006Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:09c4ff93f497e125fb5ceaed8e7c7d7ceca0c0c35dc012193c5f659c88325394","observation_id":"0012902e-8fd9-495e-bba6-02220087430b","resolution":{"observed_at":"2026-08-08T18:43:33.961006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.965780Z","title":"seq2vec: Analyzing sequential data using multi-rank embedding vectors","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.965780Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:4791397397b1dcae017ccaa3b877c57b74741d3511c31b47d390af408560a034","observation_id":"da9ba811-a7ac-4002-9d3b-1a9591a40ba7","resolution":{"observed_at":"2026-08-08T18:43:33.965780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.970510Z","title":"Distributed represen- tations of sentences and documents","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.970510Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:b147ac45a034d592c28cd6fde90a749cd328bb55dc0b4023b1264f4ad03e2b35","observation_id":"c45a8149-4569-48f1-b552-d71abf153247","resolution":{"observed_at":"2026-08-08T18:43:33.970510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.975474Z","title":"Masked inverse folding with sequence transfer for protein representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.975474Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:8b1e43f570a34ec336d56fd0c52eb1e48841f7e27a4f8241c39dc0c367ba1dae","observation_id":"6180566f-c7b7-4a90-98cb-db91b40ee3bc","resolution":{"observed_at":"2026-08-08T18:43:33.975474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.979999Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.979999Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:850f87d1133ef8f12b72bcf5527965254a879646bd83754223518e12afdb36a7","observation_id":"e2376884-fff0-48ec-8fc7-e72333079481","resolution":{"observed_at":"2026-08-08T18:43:33.979999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.984885Z","title":"The graph neural network model","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.984885Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:26b3872163e9e87f520dae925bf5d8b7f7e5bb10fb0ec6d9e78d5e20f216741e","observation_id":"454c6c68-5f52-4c0e-a0db-a0dea44a74e0","resolution":{"observed_at":"2026-08-08T18:43:33.984885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.989689Z","title":"Convo- lutions are competitive with transformers for protein sequence pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.989689Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:53a09725d2dd2019d381a32ea65af3353ebffd70e1dc52d93422665ddd70e17e","observation_id":"7bba43f0-7eec-497e-be86-b8cc9ec4cbb4","resolution":{"observed_at":"2026-08-08T18:43:33.989689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.2329","last_updated":"2015-02-19T14:46:00Z","snapshot_observed_at":"2026-07-06T03:53:48.417405Z","submitted_at":"2014-09-08T13:08:00Z","title":"Recurrent Neural Network Regularization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.2329","snapshot_observed_at":"2026-08-08T18:43:33.994570Z","title":"Recurrent neural network regular- ization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.994570Z"},"links":{"cited_paper":"/paper/1409.2329","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:1c05df9bb89ebdb5362155ffdbf5ef1769dffaba3d17c454b97af96ee93a09d3","observation_id":"1c1fb4e4-dd36-4d90-8021-013580ce4a92","resolution":{"observed_at":"2026-08-08T18:43:33.994570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:33.999682Z","title":"Long short-term mem- ory","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:33.999682Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:8a0234e34f1f9b934edbe6f366f6a52ffa4b51b8aa041b643760c865e5da6ef8","observation_id":"bc704e6f-937f-418b-8fde-498479950427","resolution":{"observed_at":"2026-08-08T18:43:33.999682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.004799Z","title":"Unified rational protein engineering with sequence-based deep representation learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.004799Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:8ae87a7dfa61b6d82e601c716330942de3a4aa4c4818c25030487c5d4c90555b","observation_id":"bd14fc15-ea33-4add-9869-b3197f4225c7","resolution":{"observed_at":"2026-08-08T18:43:34.004799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07959","last_updated":"2017-10-12T17:05:47Z","snapshot_observed_at":"2026-07-06T05:12:12.264453Z","submitted_at":"2016-09-26T13:12:51Z","title":"Multiplicative LSTM for sequence modelling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07959","snapshot_observed_at":"2026-08-08T18:43:34.009780Z","title":"Multiplicative lstm for sequence modelling","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.009780Z"},"links":{"cited_paper":"/paper/1609.07959","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:b2571431ad808fd2878801edfdaeff9889c30a06d23a54326fef764cb4dbbd4d","observation_id":"438b8f6d-afe6-4ecf-8899-2b4d2f33b7ff","resolution":{"observed_at":"2026-08-08T18:43:34.009780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.014953Z","title":"Uniref: comprehensive and non-redundant uniprot reference clusters","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.014953Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:ed12b41fa3ebb01be4c385a7691e05ca71b418edc1f717d3127f295339e781c2","observation_id":"79a602e8-ffcc-4903-b575-961b4c989134","resolution":{"observed_at":"2026-08-08T18:43:34.014953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.019893Z","title":"Uniref clusters: a comprehensive and scalable alternative for improving sequence similarity searches","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.019893Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:1cdbe75f0231a27dfdbf6a35db5a92b189c7b4e7eb467e7d73342d4d86f0b8e0","observation_id":"a9abca92-154b-4bad-a78b-988a5a54d5ba","resolution":{"observed_at":"2026-08-08T18:43:34.019893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.024856Z","title":"Udsmprot: universal deep sequence models for protein classification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.024856Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:d386a5ae454dd785a28df41cbfd8bde7e7040507bc753cd3510d700ec3bd6a6d","observation_id":"3293e77c-8f89-4081-8d0a-616e1edd1675","resolution":{"observed_at":"2026-08-08T18:43:34.024856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02182","last_updated":"2017-08-07T16:03:44Z","snapshot_observed_at":"2026-08-08T05:04:03.207604Z","submitted_at":"2017-08-07T16:03:44Z","title":"Regularizing and Optimizing LSTM Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02182","snapshot_observed_at":"2026-08-08T18:43:34.029534Z","title":"Regularizing and optimizing lstm language models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.029534Z"},"links":{"cited_paper":"/paper/1708.02182","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:61886c66db92cee2a96750fa6c9a8c4830605feea1ad1b5904d310bef58e062c","observation_id":"8103956c-2e20-4752-aafc-b403f37c35af","resolution":{"observed_at":"2026-08-08T18:43:34.029534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05365","last_updated":"2018-03-22T21:59:40Z","snapshot_observed_at":"2026-07-06T06:23:28.649177Z","submitted_at":"2018-02-15T00:05:11Z","title":"Deep contextualized word representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05365","snapshot_observed_at":"2026-08-08T18:43:34.034835Z","title":"Peters, Mark Neumann, Mohit Iyyer, Matt Gardner, Christopher Clark, Kenton Lee, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.034835Z"},"links":{"cited_paper":"/paper/1802.05365","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:3c0a88746c5c91e7101f60cb8e0aa7a3b805e431bed44d09827b35f3ae47d858","observation_id":"00f01d15-13d9-4813-8534-8c109a30060e","resolution":{"observed_at":"2026-08-08T18:43:34.034835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.040158Z","title":"Modeling aspects of the language of life through transfer-learning protein sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.040158Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:f2d72a78d28d2f8a0df8d0adc06f6f2ce4aab123ff5fa2c083561152d7fdbabe","observation_id":"47b42730-e0d1-46df-bf19-6e9d1278db0d","resolution":{"observed_at":"2026-08-08T18:43:34.040158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.044957Z","title":"Faster and smaller n-gram language models","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.044957Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:c5d03b88260546997131ef096717d822505c8ab333739d3244d801e4ae62c720","observation_id":"8f603199-a788-41bf-b54a-76f73d22e180","resolution":{"observed_at":"2026-08-08T18:43:34.044957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.049769Z","title":"Optimizing multi-gpu parallelization strategies for deep learning training","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.049769Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:d9e095d58f1cce47e71c4a953a427765d24644b737cf9733a3255f62a8317833","observation_id":"bccd6946-0298-4b69-bdd4-9f2ae9336f64","resolution":{"observed_at":"2026-08-08T18:43:34.049769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.054280Z","title":"Transformer-based deep learning for predicting protein properties in the life sciences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.054280Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:debc43f0b67fcdb1fda78418fc53aba29c1737a1a09020784147694a1dbde9f0","observation_id":"51d3a103-5dbf-4707-a139-14d12fff911b","resolution":{"observed_at":"2026-08-08T18:43:34.054280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.058625Z","title":"Enhancing efficiency of protein language models with minimal wet-lab data through few-shot learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.058625Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:64c62c4b71136debe37bbd80bb5daed9332a7f37bbdfee39c16f1003b0472515","observation_id":"bc55f031-d568-4b8a-8f1b-40ec6da50759","resolution":{"observed_at":"2026-08-08T18:43:34.058625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T18:43:34.063178Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.063178Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:31971d6644844ab08feee7b4a2b58dd5fe180a20077eb8189d8c93a95e4e2b9e","observation_id":"cf01d89c-412f-4911-b39a-777567db62cd","resolution":{"observed_at":"2026-08-08T18:43:34.063178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.03130","last_updated":"2017-03-09T04:42:30Z","snapshot_observed_at":"2026-08-01T16:29:44.580051Z","submitted_at":"2017-03-09T04:42:30Z","title":"A Structured Self-attentive Sentence Embedding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.03130","snapshot_observed_at":"2026-08-08T18:43:34.071961Z","title":"A structured self-attentive sentence embedding","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.071961Z"},"links":{"cited_paper":"/paper/1703.03130","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:b33b5ebaa3e59bb5ac7a542a1489920086accf81e515b21e63cd1c793959d3e0","observation_id":"55f8035b-fd29-430f-b10f-01fed8e52a10","resolution":{"observed_at":"2026-08-08T18:43:34.071961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.076714Z","title":"Deciphering the protein landscape with protflash, a lightweight language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.076714Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:430b375f9396b3322fe64ec0db63ec7f4585611051b747510f8e87680c2b01c0","observation_id":"960e461a-8439-4784-b32c-e7641bdeccde","resolution":{"observed_at":"2026-08-08T18:43:34.076714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.081006Z","title":"Unified language model pre-training for nat- ural language understanding and generation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.081006Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:2f0b12ccdf4777e7ee8c13ec0ae6153f205a08458db8d39c8a91e5703667bc52","observation_id":"73773085-8046-4d01-b929-b942cf24fb8f","resolution":{"observed_at":"2026-08-08T18:43:34.081006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.085179Z","title":"Language models en- able zero-shot prediction of the effects of mutations on protein function","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.085179Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:3a820361936513c2ede61619ac6d208c4e2011a48c0985d11b8f7e33b4937f9f","observation_id":"83030382-ff35-4344-b907-907c4f118203","resolution":{"observed_at":"2026-08-08T18:43:34.085179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.094574Z","title":"Simulating 500 million years of evolution with a language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.094574Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:9f6d9096ebb4874a9adb3f6dbac5c85512069561df010e414ca8de879d82c7cd","observation_id":"9608dbcf-b965-435c-aea7-11690444b3d7","resolution":{"observed_at":"2026-08-08T18:43:34.094574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.099937Z","title":"Esm cambrian: Revealing the mysteries of proteins with unsupervised learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.099937Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:46b8699d427724f718ac7d07ee89c41536b43c7bfe47acd3012da1e5d1c33072","observation_id":"d70d67bc-70da-4074-abf6-e63be147f4a0","resolution":{"observed_at":"2026-08-08T18:43:34.099937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.104690Z","title":"Audio albert: A lite bert for self-supervised learning of audio representation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.104690Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:fa3592b3c30c7f86154aba15e606a0eaab6e2c97f3d332568f50dfa8ef62d15e","observation_id":"6dac531c-e36c-4d89-8748-f700b28bbca9","resolution":{"observed_at":"2026-08-08T18:43:34.104690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10555","last_updated":"2020-03-23T21:17:42Z","snapshot_observed_at":"2026-08-06T14:37:14.514749Z","submitted_at":"2020-03-23T21:17:42Z","title":"ELECTRA: Pre-training Text Encoders as Discriminators Rather Than Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10555","snapshot_observed_at":"2026-08-08T18:43:34.109567Z","title":"Electra: Pre-training text encoders as dis- criminators rather than generators","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.109567Z"},"links":{"cited_paper":"/paper/2003.10555","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:0cda074b33704052dd9a7dbb62ceeb3a68f5535d8dbdd3773f0f52c744604553","observation_id":"11a93bd5-564e-404a-96c3-fe232cf36a63","resolution":{"observed_at":"2026-08-08T18:43:34.109567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.114498Z","title":"Protein-level assembly increases protein sequence re- covery from metagenomic samples manyfold","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.114498Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:a49243779b1e85a00500696fad14f2abc0030c47c57721c33b07735c91d2c736","observation_id":"90293a2a-9c8a-4d3d-9ac0-7ee7070bb30e","resolution":{"observed_at":"2026-08-08T18:43:34.114498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.119163Z","title":"Distilprot- bert: a distilled protein language model used to distin- guish between real proteins and their randomly shuffled counterparts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.119163Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:671b4778365a6e82bf1f0c60db5a9378c071ece215a0c09f129cc3d56730ec7c","observation_id":"a33b3e27-9110-4e0a-9609-1ffef01c154d","resolution":{"observed_at":"2026-08-08T18:43:34.119163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07435","last_updated":"2021-12-07T16:16:24Z","snapshot_observed_at":"2026-08-08T19:36:57.493296Z","submitted_at":"2021-08-17T04:13:11Z","title":"Modeling Protein Using Large-scale Pretrain Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07435","snapshot_observed_at":"2026-08-08T18:43:34.123895Z","title":"Modeling protein using large-scale pre- train language model","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.123895Z"},"links":{"cited_paper":"/paper/2108.07435","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:32f77a7251bb1cf0bf5fb78c86cad38bb82b0ac0004e374a67d4b30e0da81799","observation_id":"44919c6a-eb9f-4d6a-912a-a3d2bd92157b","resolution":{"observed_at":"2026-08-08T18:43:34.123895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.129069Z","title":"Transforming the language of life: transformer neural networks for protein prediction tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.129069Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:4bf241d8eadfc8d1214d624822d042ba348d9402ed823df31a6f905aebd7689c","observation_id":"46378def-76f6-42db-8087-58a0c68b62f9","resolution":{"observed_at":"2026-08-08T18:43:34.129069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-08T18:43:34.133924Z","title":"Roberta: A robustly optimized bert pre- training approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.133924Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:e0654995496132bc91b738c0ca39a0d103dc7efe2b803623429ddee11dc1d9aa","observation_id":"c24e211d-49da-4fdd-b5dd-122e3c69a13c","resolution":{"observed_at":"2026-08-08T18:43:34.133924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.00962","last_updated":"2020-01-03T06:53:00Z","snapshot_observed_at":"2026-07-06T07:43:06.427641Z","submitted_at":"2019-04-01T16:53:35Z","title":"Large Batch Optimization for Deep Learning: Training BERT in 76 minutes","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.00962","snapshot_observed_at":"2026-08-08T18:43:34.139245Z","title":"Large batch optimization for deep learning: Training bert in 76 minutes","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.139245Z"},"links":{"cited_paper":"/paper/1904.00962","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:40c5c09ddededafbaaea4423466b40a575823ff3447114818af3674138b3e915","observation_id":"bc60c4df-83d7-46bb-9fc9-d30e4d2de92d","resolution":{"observed_at":"2026-08-08T18:43:34.139245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15527","last_updated":"2021-10-29T04:01:32Z","snapshot_observed_at":"2026-07-06T12:03:17.964795Z","submitted_at":"2021-10-29T04:01:32Z","title":"Pre-training Co-evolutionary Protein Representation via A Pairwise Masked Language Model","version":1},"cited_work":{"arxiv_id":"2110.15527","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.15527","snapshot_observed_at":"2026-08-08T18:43:35.224955Z","title":"Pre-training Co-evolutionary Protein Representation via A Pairwise Masked Language Model","venue":"cs.CL","work_id":"d1cdff29-cbdd-486d-9f86-801392f2551f","year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.144350Z"},"links":{"cited_paper":"/paper/2110.15527","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:f993282dc1766a43945f8f78d480a95412c4c6a019d580df513b447ebdd2054d","observation_id":"6082ccd6-fdd9-4fb1-b39b-def9ca085843","resolution":{"observed_at":"2026-08-08T18:43:35.230517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.149904Z","title":"Proteinbert: a universal deep-learning model of protein sequence and function","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.149904Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:7ca5238d9dc75db2c72223d77a9dbd008199c8857bfef579e000b5a23929ef31","observation_id":"c5e5874e-738c-4960-86b2-683c2dd3d149","resolution":{"observed_at":"2026-08-08T18:43:34.149904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.154737Z","title":"Single-sequence protein structure prediction using a language model and deep learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.154737Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:23ce1aef2384b93757292729785bed0da7d1dadcbdd46fb1201720f3df872a34","observation_id":"7a0546b1-e954-4b8f-a235-c68ae423a1c1","resolution":{"observed_at":"2026-08-08T18:43:34.154737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.159352Z","title":"Multi- level protein structure pre-training via prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.159352Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:734d3c55a1ad1949e873962d382e692cefb5ee1f9ab5c4f7749e5740cf22619c","observation_id":"48c0c323-36e3-4491-80d6-269f05093b6b","resolution":{"observed_at":"2026-08-08T18:43:34.159352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.163935Z","title":"Esm all-atom: Multi-scale protein lan- guage model for unified molecular modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.163935Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:dbd60bd0d08f139ac349b1f4ccc998d3f8fe2480192c57cf472ca4030a3a4bae","observation_id":"201355d1-a39a-49c7-a39c-6037889f9814","resolution":{"observed_at":"2026-08-08T18:43:34.163935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.168834Z","title":"Tcr-bert: learning the grammar of t-cell receptors for flexible antigen-binding analyses","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.168834Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:cd71453a579e874ac79ff1975e830ea9b6233f1cecf2ef7e3d77eec8ea678290","observation_id":"c6f21fdd-0692-477f-acee-521b86bbbc99","resolution":{"observed_at":"2026-08-08T18:43:34.168834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.173981Z","title":"Deciphering the language of antibodies using self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.173981Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:7708734d32e1818398774ad94cc94295087c5bae5fc25075b8bd4325041cbc71","observation_id":"b739e9f9-091c-478d-8eab-06b9ff8c305b","resolution":{"observed_at":"2026-08-08T18:43:34.173981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07782","last_updated":"2021-12-14T23:05:01Z","snapshot_observed_at":"2026-07-06T12:18:49.237645Z","submitted_at":"2021-12-14T23:05:01Z","title":"Deciphering antibody affinity maturation with language models and weakly supervised learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.07782","snapshot_observed_at":"2026-08-08T18:43:34.178697Z","title":"Deciphering antibody affinity maturation with language models and weakly supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.178697Z"},"links":{"cited_paper":"/paper/2112.07782","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:776fdf5953db44c6dd948780134874ee6dd925bbc6dccc351349541e629618f9","observation_id":"2ef574c4-8c7a-4756-afc7-e3aa4de430eb","resolution":{"observed_at":"2026-08-08T18:43:34.178697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.188441Z","title":"Accurate prediction of antibody func- tion and structure using bio-inspired antibody language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.188441Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:51661809e4ee72068a32508c033a2c9aeba4724ac3577262d65ef8a1b11dba9c","observation_id":"44e2019d-5f65-4e17-88ac-c4a1dbb960d1","resolution":{"observed_at":"2026-08-08T18:43:34.188441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.193378Z","title":"Large scale paired antibody language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.193378Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:d2e4cf167e3fd89740c9e4a19653fac80b1f3ed9fd1d7d181d12e6e84d3b97ab","observation_id":"9e687226-eca3-45f5-8e22-f6e64e34adaa","resolution":{"observed_at":"2026-08-08T18:43:34.193378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.198188Z","title":"Saprot: Protein language modeling with structure-aware vocabulary","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.198188Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:4090da1365ab3ff4e70e1f1faf3cc392538449ea293080eb25395c08af261447","observation_id":"e3773199-d3fe-4e6d-96f6-6c0cb64537be","resolution":{"observed_at":"2026-08-08T18:43:34.198188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.203042Z","title":"Petribert: Augmenting bert with tridimensional encoding for inverse protein folding and design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.203042Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:94a7562125a156978576cbdbd5ac20a871d1331c5a32762f673eed3218866f0a","observation_id":"52d6ccd6-c8f7-4225-bee7-6a20a388db58","resolution":{"observed_at":"2026-08-08T18:43:34.203042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.207604Z","title":"Msa transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.207604Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:489c6c80d04b76455f5f1b03d7fbd3306e7d9828424264db279330e28893f1f7","observation_id":"1e7067d9-37ee-415d-b677-ebe1ace0ed2c","resolution":{"observed_at":"2026-08-08T18:43:34.207604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01824","last_updated":"2023-06-02T14:13:50Z","snapshot_observed_at":"2026-08-01T20:14:02.115324Z","submitted_at":"2023-06-02T14:13:50Z","title":"Enhancing the Protein Tertiary Structure Prediction by Multiple Sequence Alignment Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01824","snapshot_observed_at":"2026-08-08T18:43:34.212199Z","title":"Enhancing the protein tertiary structure prediction by multiple sequence alignment generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.212199Z"},"links":{"cited_paper":"/paper/2306.01824","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:ab6ac6e8fac44fad716e1198a5426a39823ba42354a2cf63936ae71eacc92e42","observation_id":"72d8c624-9048-442a-8b5e-ec340dcf34b6","resolution":{"observed_at":"2026-08-08T18:43:34.212199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03497","last_updated":"2020-03-08T04:27:16Z","snapshot_observed_at":"2026-07-06T09:10:40.408664Z","submitted_at":"2020-03-08T04:27:16Z","title":"ProGen: Language Modeling for Protein Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03497","snapshot_observed_at":"2026-08-08T18:43:34.217184Z","title":"Progen: Language modeling for protein generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.217184Z"},"links":{"cited_paper":"/paper/2004.03497","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:0266b465d4faf4e675b4a428c30ac8f4ac13e54074a174eed706ba9c73aa6251","observation_id":"3bbe578f-da88-4276-a860-345c045ea0cb","resolution":{"observed_at":"2026-08-08T18:43:34.217184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.222053Z","title":"Progen2: exploring the boundaries of protein language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.222053Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:150e4b95d9b0b6a77c78e55acd7a0bbf5a77b3fa15d4e6d7f6027b8dca4f8030","observation_id":"8c8cf0b7-db1a-450a-8561-1440eeefb6eb","resolution":{"observed_at":"2026-08-08T18:43:34.222053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05789","last_updated":"2022-07-14T21:46:47Z","snapshot_observed_at":"2026-07-06T13:09:07.045333Z","submitted_at":"2022-05-11T22:06:03Z","title":"RITA: a Study on Scaling Up Generative Protein Sequence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05789","snapshot_observed_at":"2026-08-08T18:43:34.226380Z","title":"Rita: a study on scaling up generative protein sequence models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.226380Z"},"links":{"cited_paper":"/paper/2205.05789","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:d483c47ce56081d87a5b211330a3c6a18537551a24fd78c034fce5ab601c25f1","observation_id":"0626e956-7ee8-448c-9970-274d184071c9","resolution":{"observed_at":"2026-08-08T18:43:34.226380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.231175Z","title":"Prot- gpt2 is a deep unsupervised language model for protein design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.231175Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:936cdc38fd37a98aca4189830ee6b7da06c392ae0ebdef7691a42e5bee3af708","observation_id":"e555a9d1-d0a1-4bfe-ade4-41517af50007","resolution":{"observed_at":"2026-08-08T18:43:34.231175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.235519Z","title":"Poet: A generative model of protein families as sequences-of- sequences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.235519Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:4aa18014daa963f5c3793ad78ad3aca2219d25a197f481c424b3dee2ec890710","observation_id":"456d726e-c5f3-422a-a152-9748085611a5","resolution":{"observed_at":"2026-08-08T18:43:34.235519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.240072Z","title":"Generative language modeling for antibody design","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.240072Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:e6f0d0e6a15721a82bdc05fc5115cc25f0b3fd489e85c4bbb2608173754a3f98","observation_id":"2cfd5ce1-15ee-4e3c-9ff1-486b3ae99d4b","resolution":{"observed_at":"2026-08-08T18:43:34.240072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.244770Z","title":"Zymctrl: a conditional language model for the controllable generation of artificial enzymes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.244770Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:975b772612c355a3517bf016da92f06ea91227d200e2b6d980752f13a8449e71","observation_id":"55b4e733-7b5f-4d29-b5d6-a7d9da6fcaac","resolution":{"observed_at":"2026-08-08T18:43:34.244770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16445","last_updated":"2025-09-14T04:03:16Z","snapshot_observed_at":"2026-08-06T05:54:41.091470Z","submitted_at":"2024-02-26T09:43:52Z","title":"ProLLaMA: A Protein Large Language Model for Multi-Task Protein Language Processing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16445","snapshot_observed_at":"2026-08-08T18:43:34.249521Z","title":"Prollama: A protein large language model for multi-task protein language processing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.249521Z"},"links":{"cited_paper":"/paper/2402.16445","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:65469c87aae200cceba4f8835f8471947cc573c5af92362129ad72217d87f092","observation_id":"18e4cc5a-99cd-4914-84d0-07076bc6e039","resolution":{"observed_at":"2026-08-08T18:43:34.249521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02748","last_updated":"2023-11-20T19:45:49Z","snapshot_observed_at":"2026-07-06T14:38:13.498613Z","submitted_at":"2023-01-06T23:34:52Z","title":"Generative Antibody Design for Complementary Chain Pairing Sequences through Encoder-Decoder Language Model","version":4},"cited_work":{"arxiv_id":"2301.02748","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.02748","snapshot_observed_at":"2026-08-08T18:43:35.102370Z","title":"Generative Antibody Design for Complementary Chain Pairing Sequences through Encoder-Decoder Language Model","venue":"q-bio.BM","work_id":"19f561c9-5f92-40f9-b168-edc49b0b3132","year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.254566Z"},"links":{"cited_paper":"/paper/2301.02748","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:da91f906fb12a5efe5e73db080e7e7c6d63ebee1ae4bc5b6a22c1d3c4976acd4","observation_id":"6b812a0f-5952-44a1-9e7e-ee1edca3b148","resolution":{"observed_at":"2026-08-08T18:43:35.107929Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.259377Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.259377Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:50a13e0d35280d832cfd19ef5bb89401023c45c91d8a5fd2e2537d2ed50aed1a","observation_id":"35028b98-79ec-45d2-818f-f23ecc27a02f","resolution":{"observed_at":"2026-08-08T18:43:34.259377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06199","last_updated":"2024-12-09T02:44:44Z","snapshot_observed_at":"2026-07-06T17:14:28.456108Z","submitted_at":"2024-01-11T15:03:17Z","title":"xTrimoPGLM: Unified 100B-Scale Pre-trained Transformer for Deciphering the Language of Protein","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06199","snapshot_observed_at":"2026-08-08T18:43:34.263934Z","title":"xtrimopglm: unified 100b-scale pre-trained transformer for deciphering the language of protein","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.263934Z"},"links":{"cited_paper":"/paper/2401.06199","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:aad3ed2531c5b30cbe94f2667b6e0b0f854d5678fb585c238e8ad2fe61aa6778","observation_id":"633162ec-5106-4113-8b4c-babe38927d2a","resolution":{"observed_at":"2026-08-08T18:43:34.263934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10360","last_updated":"2022-03-17T11:49:55Z","snapshot_observed_at":"2026-07-06T10:51:12.871009Z","submitted_at":"2021-03-18T16:30:26Z","title":"GLM: General Language Model Pretraining with Autoregressive Blank Infilling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10360","snapshot_observed_at":"2026-08-08T18:43:34.269002Z","title":"Glm: General language model pretraining with autoregressive blank infilling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.269002Z"},"links":{"cited_paper":"/paper/2103.10360","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:c43e7af626368178171bcfacaa5526ed1d4308e9037fa1741f053a9f5087f450","observation_id":"9fce844a-5f83-4b3e-b875-582be6dd2bcb","resolution":{"observed_at":"2026-08-08T18:43:34.269002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.273928Z","title":"Efficient and accurate sequence generation with small-scale protein language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.273928Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:6c5e1119d626de4b9bc7ce62f40c278fee9d2d0c4d7c1ad60eab593fc9ac675f","observation_id":"3772ab28-fe58-4f2c-8df7-12460b7c159a","resolution":{"observed_at":"2026-08-08T18:43:34.273928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.06568","last_updated":"2023-01-16T19:04:45Z","snapshot_observed_at":"2026-07-06T14:41:48.410302Z","submitted_at":"2023-01-16T19:04:45Z","title":"Ankh: Optimized Protein Language Model Unlocks General-Purpose Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.06568","snapshot_observed_at":"2026-08-08T18:43:34.278481Z","title":"Ankh: Optimized protein language model unlocks general-purpose mod- elling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.278481Z"},"links":{"cited_paper":"/paper/2301.06568","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:333f85249e1f7865a82ee8de22fce60cf8f70494bdc1c9dbe8de86f30e1939a8","observation_id":"061453d0-7864-4f50-89f0-a2f476cc9292","resolution":{"observed_at":"2026-08-08T18:43:34.278481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.283362Z","title":"Bilingual language model for protein sequence and structure","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.283362Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:af9a8a943130438b7326fb70b5e054fad5305f05206bf558bebad3dda1dd1886","observation_id":"32c8086e-2fb3-4c8c-be6f-3bc0c69702b2","resolution":{"observed_at":"2026-08-08T18:43:34.283362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.288014Z","title":"Prosst: Protein language modeling with quantized structure and disentangled attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.288014Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:9c8d68882f30e4f0e614a658a364c176126aedbdf9fe6a861214abeaad9dcfae","observation_id":"172c9dfd-c34d-4087-b65a-d36d5e042d43","resolution":{"observed_at":"2026-08-08T18:43:34.288014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.292888Z","title":"Structure-informed language models are protein designers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.292888Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:276b78466f481e9892601dde291b1721161488adfbc61807cbdbcc52403c726b","observation_id":"e8be2a3a-fdea-46d9-acb8-3dc215812321","resolution":{"observed_at":"2026-08-08T18:43:34.292888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02155","last_updated":"2018-04-12T18:51:33Z","snapshot_observed_at":"2026-07-06T06:26:51.386842Z","submitted_at":"2018-03-06T13:13:11Z","title":"Self-Attention with Relative Position Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02155","snapshot_observed_at":"2026-08-08T18:43:34.297603Z","title":"Self- attention with relative position representations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.297603Z"},"links":{"cited_paper":"/paper/1803.02155","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:b3b97bc2e3a84f16b4bf1fadc469c768a451126892c437b4072b2c4101c425f9","observation_id":"2a6279b4-cf7f-4719-ab76-6aa728168b1c","resolution":{"observed_at":"2026-08-08T18:43:34.297603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12574","last_updated":"2022-10-23T00:00:04Z","snapshot_observed_at":"2026-08-07T23:24:04.993330Z","submitted_at":"2022-10-23T00:00:04Z","title":"The Curious Case of Absolute Position Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12574","snapshot_observed_at":"2026-08-08T18:43:34.302311Z","title":"The curious case of absolute position embeddings","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.302311Z"},"links":{"cited_paper":"/paper/2210.12574","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:95894e451f7d726614b284f23f033a3e268e214ba6baa7dd5c2d2c066c69009f","observation_id":"4f3a8f41-3c39-4353-b3e1-26eaf60080f0","resolution":{"observed_at":"2026-08-08T18:43:34.302311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.307386Z","title":"Roformer: Enhanced trans- former with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.307386Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:4c4958489196c2100e7b3d11f1b82c2d3d0290edad53f761bf524c40b273c6d6","observation_id":"8ee2ab4f-7a3d-469f-b06d-fb9bd6dc62a0","resolution":{"observed_at":"2026-08-08T18:43:34.307386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02860","last_updated":"2019-06-02T21:21:48Z","snapshot_observed_at":"2026-07-06T07:25:48.468658Z","submitted_at":"2019-01-09T18:28:19Z","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02860","snapshot_observed_at":"2026-08-08T18:43:34.312222Z","title":"Transformer-xl: Attentive language mod- els beyond a fixed-length context","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.312222Z"},"links":{"cited_paper":"/paper/1901.02860","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:00b9a136c719eea89f075a368d704c3207ebf822e9cfd75e8edc823ff00e1722","observation_id":"9f5937da-e400-49d6-b7cc-d0dcede75bc4","resolution":{"observed_at":"2026-08-08T18:43:34.312222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-08T18:43:34.317097Z","title":"Deberta: Decoding-enhanced bert with disentangled attention","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.317097Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:642b24c4fbb6d3046826adcb40f67fefe6ddb6b700c9734d51276f440f2b54b7","observation_id":"1d948662-9eb2-4e4e-9610-846b9efda4f0","resolution":{"observed_at":"2026-08-08T18:43:34.317097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-08T18:43:34.321890Z","title":"Train short, test long: Attention with linear biases enables input length extrapolation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.321890Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:3822cea37c73d9f88acc74567178802be5270d230a4f65028bdfa7f011537b1d","observation_id":"c502715a-2d8f-493c-a977-04b52d759047","resolution":{"observed_at":"2026-08-08T18:43:34.321890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.326662Z","title":"Multilingual elmo and the effects of corpus sampling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.326662Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:475345566bed46eb22c3d81e74e56741a57eadd1896c1b7d613902b63f97522f","observation_id":"c6246150-68e4-45f0-a9b8-cac5f9dd3345","resolution":{"observed_at":"2026-08-08T18:43:34.326662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.331524Z","title":"Protein language models: Is scaling necessary? bioRxiv, pages 2024–09, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.331524Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:44d85bc79a12675a8665f75571ce350ee7d077d9e18490fbb0bbd8d81dc57ca0","observation_id":"91dc9350-4611-4b55-be11-d306bb3456b7","resolution":{"observed_at":"2026-08-08T18:43:34.331524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-08T18:43:34.336220Z","title":"Scal- ing laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.336220Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:8398b50714a4d7f09992282ed645af90b79ae233bc75d64a39eea0183caa10de","observation_id":"76e59554-0053-467a-a237-f31180872b95","resolution":{"observed_at":"2026-08-08T18:43:34.336220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.341073Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.341073Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:f90b6c7a10fdf1e015bd81c8eeb19256ecd5e8417475e7b92afec44e9291cb00","observation_id":"519f0d3b-b7b5-4b5f-8043-883ac9a38e26","resolution":{"observed_at":"2026-08-08T18:43:34.341073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.345512Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.345512Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:d80467856e37e963a52d05dbd0d78d6e68c1daf07ad185679281894eb9890d14","observation_id":"5d6ac91d-10c9-4c01-b167-4b0d18cf3b4c","resolution":{"observed_at":"2026-08-08T18:43:34.345512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-08T18:43:34.350306Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.350306Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:492f96117dfd327301ea4b2d6b47f3827c3b5e01485a2dd35fa1aedaf7f0e047","observation_id":"8090d6bb-9496-425a-b7b8-8655a749889b","resolution":{"observed_at":"2026-08-08T18:43:34.350306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.355159Z","title":"JOURNAL OF LATEX CLASS FILES, VOL","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.355159Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:a80560f592be8ce2d6f315ea29f0067d8d61174fb9202768cc7cb0c9db66abcd","observation_id":"6015ba23-38d8-4728-8c39-369c6f247e6a","resolution":{"observed_at":"2026-08-08T18:43:34.355159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.359597Z","title":"Uniprot: a worldwide hub of pro- tein knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.359597Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:284a7ae886d892f8b49fde30d8243f143eb896f606659007a3992348e226a85f","observation_id":"36941bf3-b8d3-4144-94a0-21035bfcd42c","resolution":{"observed_at":"2026-08-08T18:43:34.359597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.364016Z","title":"Edittotrembl: a distributed approach to high- quality automated protein sequence annotation","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.364016Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:fc1e5a7e57da8c97efbc70da419508aeb4d4b560cdafaea56e746dbc76a6d9c3","observation_id":"29589f7d-e10b-46cc-b58e-4645010fe05d","resolution":{"observed_at":"2026-08-08T18:43:34.364016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.369161Z","title":"Uniclust databases of clustered and deeply anno- tated protein sequences and alignments","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.369161Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:2066d08acf0fce545cf98e1123f25e18d92c690b39491c4c79264176e28cf7ae","observation_id":"cf204d54-84b0-40bd-80fc-20fd0d5a0d11","resolution":{"observed_at":"2026-08-08T18:43:34.369161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.373711Z","title":"Highly accurate protein structure prediction with alphafold","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.373711Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:0bdde5b8e9d160f79eb3f7fb728f17edeffdc76c94a431e91041bd10661b79ca","observation_id":"a2807fe6-b7ec-4981-829b-f9e8ae396036","resolution":{"observed_at":"2026-08-08T18:43:34.373711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.378583Z","title":"Uniprot archive","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.378583Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:a193733e40f4d212ec58338c99b1d5f3fa537136e0944d7e34849dd3ce6191ee","observation_id":"ca998bbf-5cd0-4c61-aed2-ac1ceabdbccb","resolution":{"observed_at":"2026-08-08T18:43:34.378583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.383225Z","title":"Pfam: The protein families database in 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.383225Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:a53daa592fbfaca43a24e15925a18c94da6a087baced23d8bc7befec9bd53599","observation_id":"498023bb-10ea-425d-b990-7c84d7462416","resolution":{"observed_at":"2026-08-08T18:43:34.383225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.388119Z","title":"Pfam: the protein families database","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.388119Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:4d1c169c8c25176292754ea003711d620883376c0d23c5dea66015e041ea7fb3","observation_id":"3ec340bb-7a8f-4bb3-9bd9-74b0025b87c1","resolution":{"observed_at":"2026-08-08T18:43:34.388119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:43:34.392938Z","title":"Evaluating protein transfer learning with tape","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-08T18:43:34.392938Z"},"links":{"citing_paper":"/paper/2502.06881"},"observation_digest":"sha256:e73ad028b6f3bf9f46ce5eff06affb4335a60b1ccf3a9dbf7371808a76d2d619","observation_id":"c90aeb7d-4075-45a5-92ab-c7b072f4072c","resolution":{"observed_at":"2026-08-08T18:43:34.392938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06881","last_updated":"2025-02-08T14:59:06Z","latest_version":1,"primary_category":"q-bio.BM","snapshot_observed_at":"2026-08-08T19:26:24.824524Z","submitted_at":"2025-02-08T14:59:06Z","title":"A Comprehensive Review of Protein Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":186},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 186 outbound references and 7 inbound Pith citation observations for arXiv:2502.06881."}