{"as_of":"2026-08-06T16:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98f274d905e732cc5dcb199f57518c7ce4a09ff82287be6b4d5454961428024d","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:38:15.296419Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22543/citation-record","integrity":"/paper/2507.22543/integrity","json":"/paper/2507.22543/citation-record.json","paper":"/paper/2507.22543"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T11:38:15.049608Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.049608Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:027b633e1dfa2e1392707962316930984a4b6d80f6c7b386955c73b20bf1dac2","observation_id":"24bec1fc-763a-4638-b4e4-56ed26cd1cf9","resolution":{"observed_at":"2026-08-06T11:38:15.049608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:16.114888Z","title":null,"venue":null,"work_id":"0615e354-6c10-4053-adc4-6f18b8483a93","year":2024},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.056215Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:b09d8c7e2a3c8768234290391b9d6c5671d5bc49a72fd9458f891eb466744106","observation_id":"56e20eeb-51e0-42c5-8938-75496767eb93","resolution":{"observed_at":"2026-08-06T11:38:16.119569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:16.098967Z","title":null,"venue":null,"work_id":"567b2e48-5485-4ca6-97d6-a8d79fc37d6d","year":1999},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.062617Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:c46fe81ed350ff21060dbbdeea8a41b9e24b657754b8b248bf2168dad40626e5","observation_id":"0a7db36f-ff81-4e67-875b-95792f40b6fe","resolution":{"observed_at":"2026-08-06T11:38:16.103581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:16.082627Z","title":null,"venue":null,"work_id":"d534c0ec-8d87-493b-978f-0a188bc9e362","year":2016},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.082579Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:5e49d824e3a3703b0b102a31e55f17732349ae8597434d148b5676fba92047f0","observation_id":"1161ec4a-843d-42f4-8b56-42e4a54015ab","resolution":{"observed_at":"2026-08-06T11:38:16.087466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.090319Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.090319Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:0d6bbe8be184891affb2c71d8679a83f3c37eb2dc74e11d1d4d6f2730fb420c6","observation_id":"a9e37b75-5c51-49dc-b8b2-5260f90f83f2","resolution":{"observed_at":"2026-08-06T11:38:15.090319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.095873Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.095873Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:c3f01f62546ccd8000be5fb13aa504a232f8e74f2bd95c5cff088f8a639e244d","observation_id":"11b7424e-abf7-4c66-bc83-1a1c71fef2d4","resolution":{"observed_at":"2026-08-06T11:38:15.095873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:16.034290Z","title":null,"venue":null,"work_id":"8b08841f-4898-4350-84d9-b91bb9c897a3","year":2017},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.102642Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:b6f5d3555b10b712ddf54e98072b5dcb1b95c006f9f08937e3740d549079619c","observation_id":"6f160a82-cd5e-478d-86b8-4f855c685c4a","resolution":{"observed_at":"2026-08-06T11:38:16.041168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:16.013839Z","title":null,"venue":null,"work_id":"edf52ce7-7e2f-4b49-b169-888cf57fe1f3","year":2015},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.107230Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:5fa9ec27c72528bd830fa6898916442af0b0bb0261a47ca53ca74c2523cc7416","observation_id":"63891e74-e7c4-491f-af5f-581e9a5901b0","resolution":{"observed_at":"2026-08-06T11:38:16.019796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.997690Z","title":null,"venue":null,"work_id":"2fa99084-645d-4a2b-abf1-3fdef8711b88","year":2014},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.113291Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:c2b11513da862d39ae24ef1b93f92d40427a05a38c5f6476bdfc1ee8b1c0906a","observation_id":"491216d3-c2cc-4940-ba9c-03d9bd8d9361","resolution":{"observed_at":"2026-08-06T11:38:16.002451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.124500Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.124500Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:0af5aaad8338c1b19c80cad7dcabed87892b2d76bbc1da9bdef4f7ba0b3be4a8","observation_id":"36cabb95-48c0-4a8a-9e7b-7606991761df","resolution":{"observed_at":"2026-08-06T11:38:15.124500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.980453Z","title":null,"venue":null,"work_id":"809af405-7bfe-4f98-b856-0725b6e0681a","year":2019},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.132289Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:b3c175bb5e4d3a62506dd60a897a26ae6019a54258221311f51922d9b2eeca03","observation_id":"6ae55c5f-8406-4543-8aee-33d66fafabc2","resolution":{"observed_at":"2026-08-06T11:38:15.986229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.138277Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.138277Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:96e8b7feb6c7736a3e3e7e2838464f76e3fb09732b46557beb2cee5ba8f94838","observation_id":"3900c201-b89e-456b-80bd-b675cb796a93","resolution":{"observed_at":"2026-08-06T11:38:15.138277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.143479Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.143479Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:18cb8d2ce1fd17481cab1445f10ba46647408b78b9d90dc4bb1978a78b34801f","observation_id":"c80011af-a0c7-4af2-95f3-56d9c3722094","resolution":{"observed_at":"2026-08-06T11:38:15.143479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.937028Z","title":null,"venue":null,"work_id":"d8f3ff2a-9954-43f3-8bef-5c623107aaf5","year":2019},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.152626Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:f164ee01e6f0e106038830bcb52ece902d2f08fc5310b443eee630c41466cc46","observation_id":"202e332f-0bea-41ef-9a87-dc7537472211","resolution":{"observed_at":"2026-08-06T11:38:15.941737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.160207Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.160207Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:f90b388e4ce1122fc851fdf4d2a1ca970150c496f725b58bccba045f45ad8304","observation_id":"de1ce512-293a-491c-97fc-77f41666d10b","resolution":{"observed_at":"2026-08-06T11:38:15.160207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.920233Z","title":null,"venue":null,"work_id":"4b03bf70-6f44-4bd0-b0c3-b019a13ddb41","year":2005},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.166526Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:5d22fc1ac1c1f853f6a61ea1e2046bc60ccdb2b3fa3c5944adc4c012f068849b","observation_id":"c5951ee3-565c-49cd-b11b-5487120fa3a4","resolution":{"observed_at":"2026-08-06T11:38:15.924961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.903291Z","title":null,"venue":null,"work_id":"f5af5e8b-b467-4434-ba7f-9dfd49d9dd0d","year":2001},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.171667Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:c2dd7d8f788dcdb75a234023cbddc454c9d7de50c83bd0a0e984af2b9b3b5227","observation_id":"387b5e66-5c90-4827-82a5-08c832551209","resolution":{"observed_at":"2026-08-06T11:38:15.907902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.885559Z","title":null,"venue":null,"work_id":"ca498601-f93d-44b3-9938-55edcd61acd8","year":2021},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.177392Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:8f54e512a76ad3a81bf4695655890dbc9b12d872ced21610cfda322339052230","observation_id":"96fa3240-a05e-492d-b122-558a3e8a56d8","resolution":{"observed_at":"2026-08-06T11:38:15.890829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.181754Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.181754Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:8501ea19c6a6e933be9236eefa438c1a27dff9c0216e7037e04bdb3069dc3767","observation_id":"d85659be-d18a-44f1-b0e9-72b21eca1ea3","resolution":{"observed_at":"2026-08-06T11:38:15.181754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.187073Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.187073Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:498c674ee973a15ecde6535b8342079be3caac4427d0322ce8e84de653da7f32","observation_id":"bb48377e-f6a2-4e62-82c5-bc2d1399ca8b","resolution":{"observed_at":"2026-08-06T11:38:15.187073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.868418Z","title":null,"venue":null,"work_id":"0e3093d6-3428-4861-913f-432e7041aa7a","year":2001},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.191956Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:977f1cf145f297ab74bc578f1f53cd64b57840955b0c8720ea3d4db769ec1bfe","observation_id":"f677aaad-5f60-43b2-82c7-a245224f1f1d","resolution":{"observed_at":"2026-08-06T11:38:15.873182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.198682Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.198682Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:675346fc58a49739c46403d183131377fe54abfa796528e27720009b896b1d4b","observation_id":"0763fa26-a1c3-4797-9063-5b6ed22110e4","resolution":{"observed_at":"2026-08-06T11:38:15.198682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.851554Z","title":null,"venue":null,"work_id":"43f8ee3d-2723-4680-a22f-36f66b9983a3","year":1964},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.203453Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:842369f5c9b9a1a15cc88f18ab21805e585bf37a59c0469f6c844e2cc28d833e","observation_id":"57fb4c99-beca-4be9-b934-27743e2ef512","resolution":{"observed_at":"2026-08-06T11:38:15.856726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.833764Z","title":null,"venue":null,"work_id":"9e7cc24d-cf52-4973-9198-8d25fd031673","year":1998},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.209351Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:1145823e99800f590cc9bb09a6cfd77129e7995765991acc4f735545a46dae55","observation_id":"f1bd5f8a-ec10-4aab-a4f2-874caaa3b9ea","resolution":{"observed_at":"2026-08-06T11:38:15.839372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.215211Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.215211Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:82040b85ff054f63d9d3f1ccef7062084106da28256ef4359066c9fcafa53eb9","observation_id":"50cf70c1-ee31-4227-98d9-dd8dc7ea4f60","resolution":{"observed_at":"2026-08-06T11:38:15.215211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.814334Z","title":null,"venue":null,"work_id":"eb07a01b-53c8-4b57-a96e-530a277a794d","year":2023},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.220978Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:ee940cb1095429538ef21da05c2432f06544a886430f2ba04df6672058d9db5b","observation_id":"2fad7d23-3158-4f4a-9532-ed18b2d8806f","resolution":{"observed_at":"2026-08-06T11:38:15.819933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.791462Z","title":null,"venue":null,"work_id":"13b91413-e47e-4983-a325-eebf1dc6f60c","year":2019},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.226228Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:745ae3cc0f09443884acb4adbce3698d5d71ef2c3c5e377af82b2af597f87192","observation_id":"101f99c9-2b55-40ec-b926-c304fcbc9b86","resolution":{"observed_at":"2026-08-06T11:38:15.797610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.232486Z","title":"Peters, Swabha Swayamdipta, and Thomas Wolf","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.232486Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:9717bd7924510e2253dc904458c9cef0dd201ca0a42086cda03a1bb456406bd1","observation_id":"02d3b8db-7bac-4def-99f5-b0dfbd452bb7","resolution":{"observed_at":"2026-08-06T11:38:15.232486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2012.62890","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.578367Z","title":null,"venue":null,"work_id":"6992f07b-8e8b-4651-846a-3d78f2d0adac","year":2012},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.238218Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:7f768c7841de23df779d00a19ccb31bd2bad08f59e8e4813be19730a8a97b31f","observation_id":"c983c211-9f62-4a2f-b907-1eaf5ce382df","resolution":{"observed_at":"2026-08-06T11:38:15.588447Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.243417Z","title":"Hunter, Costas Bekas, and Alpha A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.243417Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:28c6afb4599407e05e300e1b1147375d274d3d259ebc13f560f868f6bb114504","observation_id":"d4ead22b-1575-45b0-ab58-279c217b5441","resolution":{"observed_at":"2026-08-06T11:38:15.243417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.249708Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.249708Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:1a117202a7a64ee993c7d3ecfd524dc65d1098de7d745964f2d6f6487ca8de9e","observation_id":"d737177c-60bb-4397-95fc-2c54f2535e20","resolution":{"observed_at":"2026-08-06T11:38:15.249708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.258132Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.258132Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:effe13a3ddaad053aa0bd763d3b72eddf87c6a1ac1b08035c1f23110b6dcf71e","observation_id":"3e7395d8-b5f0-488c-83e1-d85ff33e2ee7","resolution":{"observed_at":"2026-08-06T11:38:15.258132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-06T11:38:15.263657Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.263657Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:5c5487de954f7596dd46aad2a37bfe00dd5283655ffaf12875ea34956a4577f2","observation_id":"a3d0a284-2be6-42c9-81a5-5a9f18eb367d","resolution":{"observed_at":"2026-08-06T11:38:15.263657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.773174Z","title":null,"venue":null,"work_id":"e704f32d-70f7-4d19-ab03-3f05f23ad4d3","year":2024},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.269989Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:5cac17de1524b8d8a707967b0ce88f51ec6912165bcb4f53c7c3c35defe06284","observation_id":"3dfecbe8-4782-45f6-aa63-860e934aef0e","resolution":{"observed_at":"2026-08-06T11:38:15.778836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.755282Z","title":null,"venue":null,"work_id":"41b24f82-84a7-4a07-aa3f-1b73c0360496","year":2015},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.276602Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:74482aeedb52921b309a4df2750033b6bac242d5c671fc2f89f0bd8cb56e1440","observation_id":"cf5ff81c-0912-4c76-b0a0-6646d718d3e5","resolution":{"observed_at":"2026-08-06T11:38:15.760265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.736889Z","title":null,"venue":null,"work_id":"fec11810-f6a7-4c63-a272-c5f5fed4a243","year":2013},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.284491Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:a966896ba584746a2965e02e0b4c03decd8bd05cc7be283787b8ffdf60880fb7","observation_id":"e975e55e-93cc-481d-9267-b59630980266","resolution":{"observed_at":"2026-08-06T11:38:15.742122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.290274Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.290274Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:30592b6f440288601962c9ea1e28b6d3476a69b9517ff2cd8766ab15986c5adc","observation_id":"74d731c1-0925-4e8e-9d4c-2a7dbb475075","resolution":{"observed_at":"2026-08-06T11:38:15.290274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:38:15.296419Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T11:38:15.296419Z"},"links":{"citing_paper":"/paper/2507.22543"},"observation_digest":"sha256:532ac7e5cd22a0175ee0466cefedef1e67fa74088fefd886fa51bfba06ed97af","observation_id":"af5d87e1-364e-4309-9d72-1f427b740be1","resolution":{"observed_at":"2026-08-06T11:38:15.296419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22543","last_updated":"2025-07-30T10:16:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T11:38:08.240273Z","submitted_at":"2025-07-30T10:16:23Z","title":"Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2507.22543."}