{"as_of":"2026-08-13T17:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:474162b70069244c506b75e29ab4672e9344ebff03efdcb237865ee5cfa43266","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:57:41.076689Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17669/citation-record","integrity":"/paper/2411.17669/integrity","json":"/paper/2411.17669/citation-record.json","paper":"/paper/2411.17669"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.410636Z","title":"Transforming the language of life: transformer neural net works for protein prediction tasks,","venue":null,"work_id":"060cc38d-75a2-4c06-af59-c831c085be41","year":2020},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.975655Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:e332f6ede466516a0ec5361f3d131d00594454a6ba5b25191cd4e662eb9728d4","observation_id":"76ff52db-4d43-400e-9e0f-f39a58967edc","resolution":{"observed_at":"2026-08-12T11:57:41.414210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.399700Z","title":"Biological structure and function emerge from scaling unsupervised learning to 250 million protein s equences,","venue":null,"work_id":"921d8631-d28b-4d34-b804-4faf5baf7a23","year":2021},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.979927Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:4695f3ec632a2bf7f8d6131d753ae6a7deaea7aa53ac10735f07e1b26c4b26d2","observation_id":"ea6049a1-f1cd-4771-a621-2544317de0d4","resolution":{"observed_at":"2026-08-12T11:57:41.403792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.388086Z","title":"Prottrans: Toward understanding the language of life through self-supervise d learning,","venue":null,"work_id":"c16e6638-27d8-4fa5-aa6c-63b07905737f","year":2021},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.983607Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:eaab875fe450b4678bcfb687929f7a01542823285936610c821d56c23c850991","observation_id":"de6e54a1-2312-4974-a851-6eb7d8f86011","resolution":{"observed_at":"2026-08-12T11:57:41.391493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.378226Z","title":"The language of prote ins: Nlp, machine learning & protein sequences,","venue":null,"work_id":"2d3a303b-4a46-4aac-98ed-0067d78c02de","year":2021},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.987423Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:2f6a0c888173eb5a8e5cd0f1283f4b72221cec8db57db362288ec1891d31f203","observation_id":"8389e490-bddb-44c2-9998-8f2ea675177b","resolution":{"observed_at":"2026-08-12T11:57:41.381899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.367178Z","title":"Proteinbert: a universal deep-learning model of protein sequence and fun ction,","venue":null,"work_id":"7d278072-a2ba-4e88-b2f9-043186d9d0cc","year":2022},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.991478Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:41c89b5bc8e08e743576f5f2f77ab6f515f457ad1972dc3d2edf379e4f6e6faf","observation_id":"db9c60d2-a273-4e60-a921-67a16b3d8d11","resolution":{"observed_at":"2026-08-12T11:57:41.370982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.357438Z","title":"Evolutionary-scale prediction of atomic- level protein structure with a language model,","venue":null,"work_id":"6cf142a4-9a8e-4d07-b9c8-33e5389189a3","year":2023},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.994996Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:421e73dda7cf8776daebd7731c55f9fc27e2a2d32bd12a189153c12b5f358705","observation_id":"6455a2c0-e70e-4094-81ae-71d4f8ad64d7","resolution":{"observed_at":"2026-08-12T11:57:41.361134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.06568","last_updated":"2023-01-16T19:04:45Z","snapshot_observed_at":"2026-08-13T13:03:36.757580Z","submitted_at":"2023-01-16T19:04:45Z","title":"Ankh: Optimized Protein Language Model Unlocks General-Purpose Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.06568","snapshot_observed_at":"2026-08-12T11:57:40.998637Z","title":"Ankh: Optimized protein languag e model unlocks general-purpose modelling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:40.998637Z"},"links":{"cited_paper":"/paper/2301.06568","citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:458d649c20d65e992eb11507e049cc12a868b24511aa7d9d8a8d2ebdc4284c92","observation_id":"0fe3da6f-ef84-45e2-bf50-df1cb35790f5","resolution":{"observed_at":"2026-08-12T11:57:40.998637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17415","last_updated":"2023-10-26T14:20:44Z","snapshot_observed_at":"2026-08-13T15:19:29.929424Z","submitted_at":"2023-10-26T14:20:44Z","title":"PETA: Evaluating the Impact of Protein Transfer Learning with Sub-word Tokenization on Downstream Applications","version":1},"cited_work":{"arxiv_id":"2310.17415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.17415","snapshot_observed_at":"2026-08-12T11:57:41.123215Z","title":"PETA: Evaluating the Impact of Protein Transfer Learning with Sub-word Tokenization on Downstream Applications","venue":"cs.CL","work_id":"02c98dea-4eb0-4be6-a3d6-ada6d484eee8","year":2023},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.002409Z"},"links":{"cited_paper":"/paper/2310.17415","citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:12a6b96830ada8b1219fb190d086b51601f19e5f462d5a32c0cf39d89bad45ab","observation_id":"35c7243d-f71c-4328-9eec-67290902e2ae","resolution":{"observed_at":"2026-08-12T11:57:41.129445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.347060Z","title":"Effect o f tokenization on transformers for biological sequences,","venue":null,"work_id":"258d3aee-8bbf-4451-93ba-22140a946e28","year":2024},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.006175Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:475526d4ccff6e105c13aaf82d0fcd8f9c6ce1e32a282dbcd8c00d4328b04e25","observation_id":"b799efa8-bcf0-4e9d-a622-c2e84545f277","resolution":{"observed_at":"2026-08-12T11:57:41.350937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.337133Z","title":"Protein langu age models meet reduced amino acid alphabets,","venue":null,"work_id":"f7f0b99e-66e5-4561-9d8e-ee329445c1e3","year":2024},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.009824Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:3fbea630cfbbe2b34b51fa750b9c895aad38679b1b45f3d7b205877a65639203","observation_id":"e7977724-d930-4994-a4b6-d5ed98409ef4","resolution":{"observed_at":"2026-08-12T11:57:41.340696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.15222","last_updated":"2021-03-28T21:56:26Z","snapshot_observed_at":"2026-08-11T18:11:52.650488Z","submitted_at":"2020-06-26T21:50:17Z","title":"BERTology Meets Biology: Interpreting Attention in Protein Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.15222","snapshot_observed_at":"2026-08-12T11:57:41.013343Z","title":"Bertology meets biology: Interpreting attention in prote in language models,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.013343Z"},"links":{"cited_paper":"/paper/2006.15222","citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:4b8b7f34814178adfa4671502b499a505a9192da117138a106364a0f11daaa44","observation_id":"85d7566b-4d83-4bbf-9976-83707e44f944","resolution":{"observed_at":"2026-08-12T11:57:41.013343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.326345Z","title":"Transformer protein language models are unsupervised structure learne rs,","venue":null,"work_id":"d3adde8a-4639-4d24-a4c5-dfeb1579dae9","year":2020},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.017156Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:c5abb60fb24041fc70ad64bc20faed1ca6c81da84989cd53fb6dd8819fb1e518","observation_id":"4dd0b20f-b526-495c-873f-94a2e4bdfb59","resolution":{"observed_at":"2026-08-12T11:57:41.330074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.315314Z","title":"Exploring data-driven chem ical smiles tokenization approaches to identify key protein–ligand bi nding moieties,","venue":null,"work_id":"0a199b35-c154-411c-97f8-6c65bf2162ca","year":2024},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.020269Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:11185c022fe1e603853bdb94c90dbc3dfdc038eecda1594e31d2b17ffa731f4b","observation_id":"ccb9840c-07c9-431f-82ed-91d9eacafbab","resolution":{"observed_at":"2026-08-12T11:57:41.319052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.305212Z","title":"The organization of domains in proteins obeys menzerath-altmann’s law of lan guage,","venue":null,"work_id":"81116003-1189-44e7-9ff1-65eb0054c882","year":2015},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.023378Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:6c33ed7e8a678e7945d135d8ebf4ddfa2e0409d79f5777c09b092348cfae2c71","observation_id":"0914d502-03b6-47f3-8275-7ad58ac4cc5c","resolution":{"observed_at":"2026-08-12T11:57:41.308970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.295591Z","title":"Ling uistic laws in biology,","venue":null,"work_id":"f793c167-fe27-4a40-b7a3-ec453bb91dd6","year":2022},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.026459Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:d8db61af3a099cd06e4ab1570ec0f22ce8f4dceac9234131d0399649c8291c40","observation_id":"45257caf-bcca-4b05-85df-6947a33aeed0","resolution":{"observed_at":"2026-08-12T11:57:41.299240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.285156Z","title":"Sapr ot: Protein language modeling with structure-aware vocabulary,","venue":null,"work_id":"e5e1f200-47c1-4458-9728-48261f4e5a8b","year":2023},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.029686Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:9691291b4ac8d23c6e5c7d3007138cdb84c2904537fd03227fc7518a0e290066","observation_id":"d86ec17f-0f09-4a1c-be31-d27329d7977f","resolution":{"observed_at":"2026-08-12T11:57:41.289176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.275586Z","title":"Bilingual language model for pr otein sequence and structure,","venue":null,"work_id":"e521a1c5-57a0-4ea7-be40-89a27a7a0197","year":2023},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.032867Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:2e231d3de5d07cab05342c6c1b4485549e68be07b4ff52d2a4c43e4e0227e44d","observation_id":"3b43bea3-5741-4482-a8a0-736bf77d234b","resolution":{"observed_at":"2026-08-12T11:57:41.279029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.265339Z","title":"Fast and accurate protein structure search with foldseek,","venue":null,"work_id":"7b1ec18f-9f3c-42cc-9cb4-c337d8ee9369","year":2024},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.036167Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:e6beaf75fad6298ec7f2113e8852801b7c4811a4d2b012216e4ba6e505dc8352","observation_id":"990981be-718c-488b-99e1-db602752f0b3","resolution":{"observed_at":"2026-08-12T11:57:41.269181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.255750Z","title":"Neural machine tr anslation of rare words with subword units,","venue":null,"work_id":"e75abf50-b40e-4363-be8e-992d2b524a39","year":2016},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.039342Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:b39636fbdafa64fa0113cb4d67dc8955c30c0fc68acea992ef264029eb00eb2f","observation_id":"e9eafabb-18ee-4383-a2d5-9a8f545daad9","resolution":{"observed_at":"2026-08-12T11:57:41.259454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-12T11:57:41.042802Z","title":"Google’s neural machine translation system: Bridging the gap between human and machine translation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.042802Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:8e75c8b19877c0676fe8379d9cb454be5a2d9f207706adf18486ccca92f19511","observation_id":"7b3f1669-51f6-4054-8424-b6b2c5fd8c81","resolution":{"observed_at":"2026-08-12T11:57:41.042802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.245057Z","title":"Sentencepiece: A simple and language inde- pendent subword tokenizer and detokenizer for neural text p rocessing,","venue":null,"work_id":"88d06e4b-904e-450c-a69e-3ebcaf178693","year":2018},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.046227Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:5043da093984c3e050f54fa943e03e8ef22219b0400c65a5f69227c8c0dc49d5","observation_id":"6dfb1f17-ffec-4bbe-b604-c682942cb75b","resolution":{"observed_at":"2026-08-12T11:57:41.249087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.233312Z","title":"Subword regularization: Improving neural ne twork transla- tion models with multiple subword candidates,","venue":null,"work_id":"46e3895c-d423-43af-9824-050964d7f5a8","year":2018},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.049621Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:0392b74c20226ad20990e66eb829560bde66b1b90f24aba75f15fc3d55696f97","observation_id":"f1419a2c-ecf4-433b-9e76-be8d05484eef","resolution":{"observed_at":"2026-08-12T11:57:41.237662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.222469Z","title":"Uniref: comprehensive and non-redundant uniprot referen ce clusters,","venue":null,"work_id":"ae75ed92-fa47-42e6-a153-90629b5632ec","year":2007},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.052970Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:f20f82e66fdeea89e2593b0a11d0240e17f60343178e812c872122bf17441b43","observation_id":"ce91a240-4115-4a1b-845f-37bedf444533","resolution":{"observed_at":"2026-08-12T11:57:41.226498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.211947Z","title":"Pointe r sentinel mixture models,","venue":null,"work_id":"4c11aaf2-c5aa-4c7d-98ff-7df24859cd80","year":2016},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.056286Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:98bde5a4e732cfb5c1677bad874c98acaacf3d68422db6aa950565e2d58c0664","observation_id":"6a45fb72-dc20-4921-b016-9734300e88a7","resolution":{"observed_at":"2026-08-12T11:57:41.215697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.200701Z","title":"Incorporating context into subword vocabu- laries,","venue":null,"work_id":"05d1052e-3f7a-4dcd-957f-8d8cddbe3ccd","year":2023},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.059664Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:eda75370090e65b6ca699034fba6a023628c0d130cedf6ebcb9092547da8378c","observation_id":"1538b3ee-5d28-4265-af2f-d6fd3102e88a","resolution":{"observed_at":"2026-08-12T11:57:41.204674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.189989Z","title":"New and continuing develo pments at prosite,","venue":null,"work_id":"3554eca4-8dc9-4c06-8278-66a31b879225","year":2012},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.062868Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:2b262c848f0fda763d661e90c9c39e2713f19dbce77125e795403c28ac5b1838","observation_id":"59f4f506-49ca-4391-931c-e2ae6116cbc2","resolution":{"observed_at":"2026-08-12T11:57:41.193591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.179174Z","title":null,"venue":null,"work_id":"f1e62b04-ed47-4add-8c48-8c9828ece9d2","year":1949},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.066591Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:7434f37380b3ba4f7063b52a828f27bfc0df267870f1a0ad0059b4a7e8bf5d95","observation_id":"b15398e9-4ed9-4f74-b9d9-076da6246af1","resolution":{"observed_at":"2026-08-12T11:57:41.183329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.168119Z","title":"On the physical origin of linguistic laws and lo gnormality in speech,","venue":null,"work_id":"7facdb25-88fb-435d-a564-043d224a2db8","year":2019},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.070176Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:f25f15ec3d6ff942afdc4d22d72e81b01a2d45692db14136aea2c17a5aa351c7","observation_id":"db8860f0-9487-455b-91e4-9eb26da019df","resolution":{"observed_at":"2026-08-12T11:57:41.172103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.157585Z","title":null,"venue":null,"work_id":"1da0de3f-2ece-4101-91a5-fb631960686a","year":1978},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.073421Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:3a7cece6f880e9cb832094c3c2b2c65e6b21bdc62e51d737fa32e128705d8893","observation_id":"236c4f65-26d4-4746-8d2c-d205aff38675","resolution":{"observed_at":"2026-08-12T11:57:41.160960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:41.146653Z","title":"Prolegomena to menzerath’s law,","venue":null,"work_id":"f561c80e-8183-4cfb-847b-5928cd9e3fef","year":1980},"citing_paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:41.076689Z"},"links":{"citing_paper":"/paper/2411.17669"},"observation_digest":"sha256:a5ef42877719eb33c9e1d0ee50b29673829f23cf455e235be9ed6c1df8a91c5c","observation_id":"250c5b75-d9c9-4177-86d1-1cd61dd288f7","resolution":{"observed_at":"2026-08-12T11:57:41.150180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17669","last_updated":"2024-11-26T18:30:20Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T15:57:32.665692Z","submitted_at":"2024-11-26T18:30:20Z","title":"Linguistic Laws Meet Protein Sequences: A Comparative Analysis of Subword Tokenization Methods"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2411.17669."}