{"as_of":"2026-08-09T20:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf11d9680638ca3bd9cced9a95537518fa0222d9c0a1c17ccade150cba429c74","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:07:41.620884Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.15190/citation-record","integrity":"/paper/2508.15190/integrity","json":"/paper/2508.15190/citation-record.json","paper":"/paper/2508.15190"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:37.702547Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:37.702547Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:ad3e0447b3f892bc86217467809a4caddca66b28172481aef2cf6b5dae6862a5","observation_id":"bc6b2515-b39d-43e6-ae51-6e33c688dbf4","resolution":{"observed_at":"2026-08-05T18:07:37.702547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:37.818997Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:37.818997Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:9397e22689b3c6d0f8b16f1f1224fe042beafe7070b79ca830056a646a4e04a4","observation_id":"c2ee23a1-dd8d-4e1a-930e-098a85da92d6","resolution":{"observed_at":"2026-08-05T18:07:37.818997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:37.989006Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:37.989006Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:d18562b773c1b10f4133fd1fd7b9a68ff47dd5282f6a1cb3fb79e8371c116580","observation_id":"17a9bd0e-08d7-4897-9f50-39f7bd9a0ed8","resolution":{"observed_at":"2026-08-05T18:07:37.989006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-05T18:07:38.087352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.087352Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:7583d4dc2e18fda88a602ea45b7782ead3bd7af26d321275c161db9b3754bc68","observation_id":"cae37ac2-9563-4ddf-8242-04849e1be2f6","resolution":{"observed_at":"2026-08-05T18:07:38.087352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T18:07:38.172306Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.172306Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:d5cacb594c9d838bbaac6402244103c1abb510889f3d58b08d2c2bbc173af087","observation_id":"d63e078c-a1b5-4155-b924-cf874720bb9b","resolution":{"observed_at":"2026-08-05T18:07:38.172306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-08T20:36:21.234658Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-05T18:07:38.304671Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.304671Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:8dd200f37aaa43a09e517dc7f38b346f0221c75e1812488075aa9a791d3adebf","observation_id":"ba37e8dd-908c-49b5-80b4-1145ef7ce8ee","resolution":{"observed_at":"2026-08-05T18:07:38.304671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:43.844872Z","title":null,"venue":null,"work_id":"a88074c5-c343-4aec-993a-4a4653cc720e","year":2024},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.421542Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:a8bb6ec2ea29f691201eea22442d7d6854e3780729ae1ed89bd547e761473303","observation_id":"a5eba188-0cd9-498c-a42f-1855bc88e910","resolution":{"observed_at":"2026-08-05T18:07:43.920401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-05T18:07:38.547812Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.547812Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:da0aafd7cac18b58883beca42a1289e1fe5491d59103757b08599f4f181d1380","observation_id":"9457f708-cd6d-4f19-9497-710ad78f8529","resolution":{"observed_at":"2026-08-05T18:07:38.547812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12681","last_updated":"2022-04-16T04:21:26Z","snapshot_observed_at":"2026-08-04T04:22:15.975890Z","submitted_at":"2021-11-24T18:31:20Z","title":"VIOLET : End-to-End Video-Language Transformers with Masked Visual-token Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12681","snapshot_observed_at":"2026-08-05T18:07:38.649205Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.649205Z"},"links":{"cited_paper":"/paper/2111.12681","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:51acb3a80fa481e443031691bb235853b941e1e284213161ae559524fe8fde4a","observation_id":"85ada825-88a6-496d-b8f1-1a9fce6c9643","resolution":{"observed_at":"2026-08-05T18:07:38.649205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00910","last_updated":"2022-06-02T19:00:07Z","snapshot_observed_at":"2026-08-02T01:24:41.962675Z","submitted_at":"2021-07-02T09:00:13Z","title":"Learned Token Pruning for Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00910","snapshot_observed_at":"2026-08-05T18:07:38.793573Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.793573Z"},"links":{"cited_paper":"/paper/2107.00910","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:1c70ca3ef8b21185f5d4e2f3bda3d682542422e9dcede0679727b46772223de5","observation_id":"211541c3-9676-404d-a13d-6b8e034b8658","resolution":{"observed_at":"2026-08-05T18:07:38.793573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08209","last_updated":"2022-12-06T19:19:35Z","snapshot_observed_at":"2026-07-06T11:10:17.453429Z","submitted_at":"2021-05-18T00:22:46Z","title":"BookSum: A Collection of Datasets for Long-form Narrative Summarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08209","snapshot_observed_at":"2026-08-05T18:07:38.945155Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:38.945155Z"},"links":{"cited_paper":"/paper/2105.08209","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:e2afff1bfbb59135b191532f8449f6e835e3e124d0e6d730c2e6655bd6dd25f2","observation_id":"633dd6e5-4628-4dc7-bcaa-536ef4cc85fc","resolution":{"observed_at":"2026-08-05T18:07:38.945155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10959","last_updated":"2018-04-29T16:13:44Z","snapshot_observed_at":"2026-07-06T06:36:17.283404Z","submitted_at":"2018-04-29T16:13:44Z","title":"Subword Regularization: Improving Neural Network Translation Models with Multiple Subword Candidates","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10959","snapshot_observed_at":"2026-08-05T18:07:39.022747Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.022747Z"},"links":{"cited_paper":"/paper/1804.10959","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:ccdae2cfd7a0755617fd9948b5adafadde89d80404e975afbb62827c8265578b","observation_id":"b5f858e3-f0c2-4f86-b749-1a863314f112","resolution":{"observed_at":"2026-08-05T18:07:39.022747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:43.707791Z","title":"https://openreview.net/pdf?id=dMdxHd0tRf Quickmerge++: Token merging with autoregressive prior","venue":null,"work_id":"7a1ef839-332d-4455-a3c3-fa70d156b5f8","year":null},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.092834Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:e9b55cf77f2ea5dc170494b171f42d45c28f05ca1196fe8c08b9700b27702e19","observation_id":"8dfbe177-8eae-498f-a04b-eceb46252b89","resolution":{"observed_at":"2026-08-05T18:07:43.761348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:39.177536Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.177536Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:6e26d55e58459abe95b40d20576b596cb4670b8737b34482c8ba6967a63760c1","observation_id":"3b9abf43-6eea-466c-9ef6-ad8a45aa48de","resolution":{"observed_at":"2026-08-05T18:07:39.177536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:43.558387Z","title":null,"venue":null,"work_id":"4bcbd3e2-7ac0-4a4f-b3f5-6e199bf36394","year":2025},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.228050Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:35e50711e747bb270db2a817011be260c3226d5f85b4aab95bd66c53a5e2c14d","observation_id":"41153489-9e05-4651-9026-bd74d5bd1e68","resolution":{"observed_at":"2026-08-05T18:07:43.620220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:43.395294Z","title":null,"venue":null,"work_id":"6315abbc-0f04-4149-a4d9-dfc25947bae8","year":2025},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.312620Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:754a792881b2f1bbbdc3a18dae3f4dd1075883c4dd0a4381fc8b29e6e5c9dae3","observation_id":"47b2d7a1-683e-4c20-bbb3-14cf45a646df","resolution":{"observed_at":"2026-08-05T18:07:43.472315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:43.228781Z","title":null,"venue":null,"work_id":"c0390280-a375-4e2d-8b67-0ac72fe51630","year":2025},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.414089Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:5ff4a7749f7a25629ccd88c068d9b8081a9bf2b7391c732ddd216329b366b2eb","observation_id":"6137810e-75b5-4683-aae1-2d1c0367ea6a","resolution":{"observed_at":"2026-08-05T18:07:43.279772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01990","last_updated":"2025-04-14T07:09:15Z","snapshot_observed_at":"2026-08-09T16:07:31.365117Z","submitted_at":"2024-09-03T15:35:01Z","title":"Designing Large Foundation Models for Efficient Training and Inference: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01990","snapshot_observed_at":"2026-08-05T18:07:39.465068Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.465068Z"},"links":{"cited_paper":"/paper/2409.01990","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:f14d77dc0cc4c8695f3ce61e968e6c41a6351880978d1edaf0820a7ccc895877","observation_id":"25f22337-0668-46b0-ac68-ce0c46574b32","resolution":{"observed_at":"2026-08-05T18:07:39.465068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:39.562301Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.562301Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:14d90206c6d5c3e28e85ae7b0a20e613d0e29e2176d2648a46786f118f1a2256","observation_id":"a1e4f6fd-6f74-4c7b-a216-3e02a848e7c5","resolution":{"observed_at":"2026-08-05T18:07:39.562301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04186","last_updated":"2016-09-14T09:31:40Z","snapshot_observed_at":"2026-08-05T20:24:17.610356Z","submitted_at":"2016-09-14T09:31:40Z","title":"Neural Machine Translation with Supervised Attention","version":1},"cited_work":{"arxiv_id":"1609.04186","doi":null,"metadata_source":"pith","pith_arxiv_id":"1609.04186","snapshot_observed_at":"2026-08-05T18:07:42.651682Z","title":"Neural Machine Translation with Supervised Attention","venue":"cs.CL","work_id":"16626974-cd24-49cf-8cf3-471ef39f1daa","year":2016},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.657701Z"},"links":{"cited_paper":"/paper/1609.04186","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:a9ba733e02921484534fdb35d8f0909d141db94b567a808d5d1c419c0c4f0dcb","observation_id":"914e7f33-327e-477c-ad22-87460706b8f3","resolution":{"observed_at":"2026-08-05T18:07:42.713806Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:43.033257Z","title":null,"venue":null,"work_id":"51d2ce8b-4a98-416e-900e-09d6b52440e0","year":2024},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.788284Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:4033d6df507f6baa11ee4006161998e9c0d152355d8ab052972dd3b94a4830db","observation_id":"f9a8f315-4927-4ae4-a80d-cc0bbc8bad66","resolution":{"observed_at":"2026-08-05T18:07:43.148584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07381","last_updated":"2024-06-11T15:49:08Z","snapshot_observed_at":"2026-08-07T17:12:05.138495Z","submitted_at":"2024-06-11T15:49:08Z","title":"World Models with Hints of Large Language Models for Goal Achieving","version":1},"cited_work":{"arxiv_id":"2406.07381","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07381","snapshot_observed_at":"2026-08-05T18:07:42.487530Z","title":"World Models with Hints of Large Language Models for Goal Achieving","venue":"cs.AI","work_id":"b7351a6d-456a-43fc-b781-2af344dd5f5e","year":2024},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.860495Z"},"links":{"cited_paper":"/paper/2406.07381","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:32eb67fd88210b408f610625e809d3689081a776615f9d1564b62e9cbef67192","observation_id":"ef6da243-5754-45dc-8108-8302b450bd7d","resolution":{"observed_at":"2026-08-05T18:07:42.561711Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-05T18:07:39.947367Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.947367Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:889eecc99ce05e467ef925b7d983edfe7d706e661c5677419d9e7031a7a939b2","observation_id":"72a97c64-3a18-42af-a6a4-58988929efcc","resolution":{"observed_at":"2026-08-05T18:07:39.947367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-05T18:07:39.994180Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:39.994180Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:f47b4f747d8d92da7c84d90d028570801a6d0e23d3e8a56d0f894a7577e6e9e3","observation_id":"6227270c-a6fe-4f36-a384-70365be32d0a","resolution":{"observed_at":"2026-08-05T18:07:39.994180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-08-09T11:59:51.650526Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-08-05T18:07:40.090807Z","title":"Rae, Anna Potapenko, Siddhant M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:40.090807Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:2da1585e86fa6f10285bbfd10c829268018783cc8549b3ce10fc5f1fae5409ce","observation_id":"adb9c764-4364-469c-80c3-c8b0d9920fde","resolution":{"observed_at":"2026-08-05T18:07:40.090807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-05T18:07:40.170338Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:40.170338Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:a30ae69d4807d7e8ba48080fe474b1d93df70f082a43c4a216d1835be32024eb","observation_id":"068104a3-15f0-473a-b2bc-307fa8026d00","resolution":{"observed_at":"2026-08-05T18:07:40.170338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00287","last_updated":"2023-04-27T13:16:38Z","snapshot_observed_at":"2026-08-08T18:35:30.583627Z","submitted_at":"2023-04-01T10:39:46Z","title":"Vision Transformers with Mixed-Resolution Tokenization","version":2},"cited_work":{"arxiv_id":"2304.00287","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.00287","snapshot_observed_at":"2026-08-05T18:07:42.289240Z","title":"Vision Transformers with Mixed-Resolution Tokenization","venue":"cs.CV","work_id":"8b2b94a9-3272-4f03-9ec1-6abaf24f14fc","year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:40.279621Z"},"links":{"cited_paper":"/paper/2304.00287","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:fed237202112667ac5727cd29b7742d1a45eece52c508481a2639057ece8b73b","observation_id":"b70de1e4-31e7-4325-9763-547d31e2aca4","resolution":{"observed_at":"2026-08-05T18:07:42.339253Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:40.641184Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:40.641184Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:1b8f4db0ae55324d3f65b67825816350ef55ceec5db7b273149a3b622d3a0be9","observation_id":"aaccd53e-7f9f-48b2-89c8-5ef44f339107","resolution":{"observed_at":"2026-08-05T18:07:40.641184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:07:40.769200Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:40.769200Z"},"links":{"citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:d32b068adf293f515cba15ab687964cabaf97cc351f7ab4a8e7247c64a5bb81c","observation_id":"0b7f72e8-50da-4880-8c67-cf34321f7a87","resolution":{"observed_at":"2026-08-05T18:07:40.769200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T18:07:40.934995Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:40.934995Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:8af32d5711349b480150074100836093760ff007f8686892b1b76abc8ee64413","observation_id":"2e501358-530b-4f59-9587-505e06c45fdd","resolution":{"observed_at":"2026-08-05T18:07:40.934995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03170","last_updated":"2023-11-30T17:15:34Z","snapshot_observed_at":"2026-08-03T15:34:30.347712Z","submitted_at":"2023-07-06T17:52:10Z","title":"Focused Transformer: Contrastive Training for Context Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03170","snapshot_observed_at":"2026-08-05T18:07:41.031022Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:41.031022Z"},"links":{"cited_paper":"/paper/2307.03170","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:8b3d403c68def814d12dfffe5c2b45458b04ba8ef3ca91df98e69c4537383041","observation_id":"e0246169-7889-49bb-9dbf-ac7b22468975","resolution":{"observed_at":"2026-08-05T18:07:41.031022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-05T18:07:41.102041Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:41.102041Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:e3ab59b1bd0c142b56249913353512047d31d5627a6e410128073eb6befffeea","observation_id":"e6095f0d-720c-45aa-977f-91d4e2df6d41","resolution":{"observed_at":"2026-08-05T18:07:41.102041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.14142","last_updated":"2020-04-25T03:36:26Z","snapshot_observed_at":"2026-08-05T20:24:24.761048Z","submitted_at":"2019-10-30T21:17:26Z","title":"Discourse-Aware Neural Extractive Text Summarization","version":2},"cited_work":{"arxiv_id":"1910.14142","doi":null,"metadata_source":"pith","pith_arxiv_id":"1910.14142","snapshot_observed_at":"2026-08-05T18:07:42.072569Z","title":"Discourse-Aware Neural Extractive Text Summarization","venue":"cs.CL","work_id":"052bfc89-2b97-4580-8459-87c5eeee5e41","year":2019},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:41.270987Z"},"links":{"cited_paper":"/paper/1910.14142","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:1de720525804c87e4d0cc8ba792bf750267b8e524c7b0ed18019408d6c359e5a","observation_id":"46facd0f-7b7f-4d97-b492-cc068625d9c3","resolution":{"observed_at":"2026-08-05T18:07:42.147315Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.11618","last_updated":"2021-05-25T02:28:51Z","snapshot_observed_at":"2026-08-09T07:00:29.796573Z","submitted_at":"2021-05-25T02:28:51Z","title":"TR-BERT: Dynamic Token Reduction for Accelerating BERT Inference","version":1},"cited_work":{"arxiv_id":"2105.11618","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.11618","snapshot_observed_at":"2026-08-05T18:07:41.764109Z","title":"TR-BERT: Dynamic Token Reduction for Accelerating BERT Inference","venue":"cs.CL","work_id":"898a60ef-b3a5-446a-98db-266934418a44","year":2021},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:41.473560Z"},"links":{"cited_paper":"/paper/2105.11618","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:6d51e7e1f1aff7286e3c6a117baaa2e4e62a91ee836b6003e23d3ff88a94ea04","observation_id":"aee5a756-cf6e-4a66-947d-ce91c80f51df","resolution":{"observed_at":"2026-08-05T18:07:41.928491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14048","last_updated":"2023-12-18T19:10:00Z","snapshot_observed_at":"2026-08-06T19:19:02.165567Z","submitted_at":"2023-06-24T20:11:14Z","title":"H$_2$O: Heavy-Hitter Oracle for Efficient Generative Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14048","snapshot_observed_at":"2026-08-05T18:07:41.620884Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:41.620884Z"},"links":{"cited_paper":"/paper/2306.14048","citing_paper":"/paper/2508.15190"},"observation_digest":"sha256:c9d67cf05a7cf2c154a9d4ab2d8e504460cc6c0b0e2abdb672f48a5c38b25192","observation_id":"a10cb385-0e8f-4ad3-a298-d0579c54ee75","resolution":{"observed_at":"2026-08-05T18:07:41.620884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.15190","last_updated":"2025-08-21T03:01:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T12:57:13.644439Z","submitted_at":"2025-08-21T03:01:53Z","title":"SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":5,"verified_fuzzy":1},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2508.15190."}