{"as_of":"2026-08-08T10:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a568dd007fc54b5c385b52a143a6b79f41c817d0bb297472752785e28b30f589","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:08:09.488803Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:15:07.167572Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T13:15:07.167572Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00925","last_updated":"2025-08-31T16:21:21Z","snapshot_observed_at":"2026-08-06T23:39:11.301413Z","submitted_at":"2025-08-31T16:21:21Z","title":"DTRNet: Dynamic Token Routing Network to Reduce Quadratic Costs in Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T13:15:07.167572Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2509.00925"},"observation_digest":"sha256:afb475915933909aecb05d844a7fec017c13f9d7b0ab4026f4589bc9fa632ad7","observation_id":"4040624e-1a52-449c-ad62-3e59d3d9a76d","resolution":{"observed_at":"2026-08-05T13:15:07.167572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":"2507.03865","doi":"10.48550/arxiv.2507.03865","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":"ArXiv.org","work_id":"31d45eea-ebd3-4a43-aa7a-0441e22a75d9","year":null},"citing_paper":{"arxiv_id":"2602.01203","last_updated":"2026-05-27T09:56:04Z","snapshot_observed_at":"2026-08-04T22:42:52.512248Z","submitted_at":"2026-02-01T12:45:39Z","title":"Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T08:47:29.236561Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2602.01203"},"observation_digest":"sha256:e9e283136344891d1ad01ff5724f78a9845eab13c756c808ece4d548243917e9","observation_id":"1b256f7d-5bfb-4f70-a411-d8e74ae2a03f","resolution":{"observed_at":"2026-05-16T08:47:37.280027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-03T05:50:25.027494Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01203","last_updated":"2026-05-27T09:56:04Z","snapshot_observed_at":"2026-08-04T22:42:52.512248Z","submitted_at":"2026-02-01T12:45:39Z","title":"Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T05:50:25.027494Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2602.01203"},"observation_digest":"sha256:b5bdbc312cad68aa27bd3d54e1bab09bead786a97ca89fba665e98740263e79f","observation_id":"e4d1dbc0-a3f4-46bd-87cd-26436f2198d6","resolution":{"observed_at":"2026-08-03T05:50:25.027494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":"2507.03865","doi":"10.48550/arxiv.2507.03865","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":"ArXiv.org","work_id":"31d45eea-ebd3-4a43-aa7a-0441e22a75d9","year":null},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:35059a7557fa73756ed9e3ef782329edebcea2aef6e8fe1eb94fdc6b5d1d6602","observation_id":"df018183-1fe6-4e00-831b-dc59de7a9fd1","resolution":{"observed_at":"2026-06-28T23:32:46.707032Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":"2507.03865","doi":"10.48550/arxiv.2507.03865","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":"ArXiv.org","work_id":"31d45eea-ebd3-4a43-aa7a-0441e22a75d9","year":null},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:ca771f695f5fceb3477a0fedb1143a73e2b512d9fd40c619f6f3a84987223123","observation_id":"e37ca751-0043-4a4b-9ad3-43f1489a797d","resolution":{"observed_at":"2026-06-28T23:32:47.283100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03865/citation-record","integrity":"/paper/2507.03865/integrity","json":"/paper/2507.03865/citation-record.json","paper":"/paper/2507.03865"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:06.520040Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.520040Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:23445a2e9b4084510b656fc1da2f104907acf2450b7f70381b81aa97f4acc2fd","observation_id":"8025c31f-e790-499d-bb46-40311bd8d76e","resolution":{"observed_at":"2026-08-06T20:08:06.520040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.141286Z","title":"Fast and robust early-exiting framework for autoregressive language models with synchronized parallel decoding","venue":null,"work_id":"2c2ec33a-bb70-4dfb-ab24-862be492f371","year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.540763Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:0484dd98a326db6eab3c6e1892e523390f7ee26eaadcdf8a972f9c22bda8a27f","observation_id":"3271328d-b004-4830-869d-45401ba497cd","resolution":{"observed_at":"2026-08-06T20:08:11.144777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.131893Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"161d39a8-01de-498f-bc55-26fb465bcfcd","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.575951Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:8244575e78b776078e2f04137fed29f16a68a05a00c8b528995d2a2bc8fc4373","observation_id":"4861d466-5830-4fd9-b861-0622edabd0d0","resolution":{"observed_at":"2026-08-06T20:08:11.134965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:06.665742Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.665742Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:e9d1ca6bc00de149736d0fd9887e9a63a89ae5936f813b5ef10592d7f8c8cd22","observation_id":"a3febf6d-418c-4022-a485-f1c4592d3c68","resolution":{"observed_at":"2026-08-06T20:08:06.665742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:06.694850Z","title":"Spectral filters, dark signals, and attention sinks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.694850Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:9d7e9577e764af1567f1e8259bdb4bf5210f96964b6143e76336ef2eca483b22","observation_id":"7b46542b-851f-463d-8eef-d25b67658055","resolution":{"observed_at":"2026-08-06T20:08:06.694850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T20:08:06.728594Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.728594Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:86dcaf1f057cec64d829603180c704a325665bb70ff9e8e90a9919fe9133d7e6","observation_id":"7e3cbe33-ce91-4136-8db3-9c084ff0c855","resolution":{"observed_at":"2026-08-06T20:08:06.728594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.116320Z","title":"Ee-llm: Large-scale training and inference of early-exit large language models with 3d parallelism","venue":null,"work_id":"bfb4beb5-b4a0-4494-81a1-af340fe90d09","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.784271Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:53cb8287f235809b596279dbfc0931ed34641584f009a4203fc9fb1dac5396ab","observation_id":"3871d836-3f1b-46ac-99f7-e2d643164297","resolution":{"observed_at":"2026-08-06T20:08:11.119715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T20:08:06.826197Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.826197Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:f9c86de73256a03770df3652b279dcf34363c821f56d9077eace888cf6324e7d","observation_id":"6a2e375d-4bd9-46bc-b2f7-ceee1f13df11","resolution":{"observed_at":"2026-08-06T20:08:06.826197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02628","last_updated":"2023-07-05T19:59:09Z","snapshot_observed_at":"2026-07-06T15:50:49.116859Z","submitted_at":"2023-07-05T19:59:09Z","title":"SkipDecode: Autoregressive Skip Decoding with Batching and Caching for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02628","snapshot_observed_at":"2026-08-06T20:08:06.884228Z","title":"Skipdecode: Autoregressive skip decoding with batching and caching for efficient llm inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.884228Z"},"links":{"cited_paper":"/paper/2307.02628","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:9195a40c2cffe496e4bda5fa786c42354a24ec56e365b069ca22107c72680986","observation_id":"8fe2c9d0-f948-465b-942a-3381ee8bc030","resolution":{"observed_at":"2026-08-06T20:08:06.884228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T20:08:06.940790Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.940790Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:9d583e9d3b2bf5ec6a33105027cd4b5c9464b4e4a13064ebc6ff2366e24f7938","observation_id":"22d001fd-06b5-44b3-9188-35a713a1b314","resolution":{"observed_at":"2026-08-06T20:08:06.940790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.107011Z","title":"Layerskip: Enabling early exit inference and self-speculative decoding","venue":null,"work_id":"64dd408c-7ba7-446b-bed0-ffcdc3d9e487","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.986186Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:284943ab1a43af93c438373e6322db55a82e6004da33c5ab1beed965012c85d3","observation_id":"cf401c8b-e256-4a47-9367-6c7a4db9f037","resolution":{"observed_at":"2026-08-06T20:08:11.110224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.096141Z","title":"When attention sink emerges in language models: An empirical view","venue":null,"work_id":"5e076050-f72b-42cc-ba0e-815b15426daf","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.062613Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:b5d6851a44777630562ac6f716ec031b4722bb77abb2528d6f9cb86165f17069","observation_id":"1c73407b-f2ef-4a55-b6bb-09fa8cbfb7b4","resolution":{"observed_at":"2026-08-06T20:08:11.099806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:07.136253Z","title":"J., yelong shen, Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.136253Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:ef4e0b74ac9ba01df2ca8ac2119a4192077c980fdaa95b0b26d3dede0da7fd1b","observation_id":"870b8fee-af36-484a-8381-11b1f0f59ac2","resolution":{"observed_at":"2026-08-06T20:08:07.136253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T20:08:07.195766Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.195766Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:b289148c271c0bc85d1e80223c60301dcb46df4b1d7b7e80eef739b107f86127","observation_id":"3133fe33-7106-4036-8df3-ea59d7c6b30b","resolution":{"observed_at":"2026-08-06T20:08:07.195766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T20:08:07.249338Z","title":"Q., Sablayrolles, A., Roux, A., Mensch, A., Savary, B., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.249338Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:39e1f5b2a8fca1bb5fd865de30b30b2f12d7fd60b9dc7ceeb586bbf44083f57a","observation_id":"52bdaca1-fa16-4b5d-b930-9629ec47723e","resolution":{"observed_at":"2026-08-06T20:08:07.249338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.078608Z","title":"D-llm: A token adaptive computing resource allocation strategy for large language models","venue":null,"work_id":"af30881d-8c74-4a94-a10f-ac35cc621b79","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.288318Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:3e456a68e59ba6ffe320824e22169888ff658d9c94466159c29abe596a2f466f","observation_id":"c5ab7db0-7fb5-4b79-a78f-e3774e77afb1","resolution":{"observed_at":"2026-08-06T20:08:11.082034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-08-07T23:10:12.222808Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-08-06T20:08:07.404789Z","title":"Shortened llama: A simple depth pruning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.404789Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:9a86ddd4cf606fa3adbb3f770aec636bd24d15f61a4faed60471debd81da84bc","observation_id":"b92bd581-f141-4ed6-955b-46c974e5ccc7","resolution":{"observed_at":"2026-08-06T20:08:07.404789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.068607Z","title":"B io M istral: A collection of open-source pretrained large language models for medical domains","venue":null,"work_id":"afb89b9f-4633-45a6-82e1-1915fb796c35","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.480577Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:c4f2e2c6462f87e405359941a2a462b690c7707f63d1c1f545e2addb4ea35958","observation_id":"d0c73403-f92f-4756-93ab-f13daf0b7375","resolution":{"observed_at":"2026-08-06T20:08:11.071971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16747","last_updated":"2024-06-24T15:55:59Z","snapshot_observed_at":"2026-08-06T03:54:10.668995Z","submitted_at":"2024-06-24T15:55:59Z","title":"Sparser is Faster and Less is More: Efficient Sparse Attention for Long-Range Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16747","snapshot_observed_at":"2026-08-06T20:08:07.633297Z","title":"Sparser is faster and less is more: Efficient sparse attention for long-range transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.633297Z"},"links":{"cited_paper":"/paper/2406.16747","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:58c6a36a9449765e700f91fc2f6480de07d41a7a0e71b6b51d79ef492c153773","observation_id":"00e02adc-9716-4445-82a2-57fffb6784c8","resolution":{"observed_at":"2026-08-06T20:08:07.633297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-06T20:08:07.685132Z","title":"Shortgpt: Layers in large language models are more redundant than you expect","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.685132Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:b6a79bec8adda1375a82388d137514205818440467e4c2c10c70c932fad07895","observation_id":"ebc7bd35-3c72-41ea-8248-cfa28d1b62d4","resolution":{"observed_at":"2026-08-06T20:08:07.685132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.057931Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"93c1e2b1-b424-47ed-8f00-bb37fb8c55bf","year":2022},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.752189Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:abbd9b845f7c501859201aad911dd4d41b6d49a6025fffca11d1ea3934a87f16","observation_id":"b5ce3c25-d6bf-44cd-8c55-7a4c02fc4a5f","resolution":{"observed_at":"2026-08-06T20:08:11.061210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.046577Z","title":"Using an llm to help with code understanding","venue":null,"work_id":"1f2ba12d-6ba0-49b8-ac0b-30b75558fd86","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.806617Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:70040223d397991cfc5d3623814347734179ff13b288773863f4fb3b4e2a26a1","observation_id":"7e696759-321d-482e-a7b2-db9808987c1a","resolution":{"observed_at":"2026-08-06T20:08:11.050576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:07.846759Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.846759Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:df04de5ed4a5cad35fd7850974efd5313037e17c4dc540639a49df1b0e938c62","observation_id":"e3f9296e-de56-4039-9696-d66615f753ec","resolution":{"observed_at":"2026-08-06T20:08:07.846759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-06T20:08:07.957269Z","title":"C., and Santoro, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.957269Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:e8c7431d30a322399cd7f8b1260409d4c2d5a5cef7664e30d976e94e6766c1b6","observation_id":"57f4bdd9-3066-46f7-b105-9bcddaf9047a","resolution":{"observed_at":"2026-08-06T20:08:07.957269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:07.997272Z","title":"L., Bhagavatula, C., and Choi, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.997272Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:a256a8bb8b1e92074195356d11e87df80985105c36fe051770ab535dae9b727b","observation_id":"e5224ed9-8b43-4c75-ac39-c02ce6f43d03","resolution":{"observed_at":"2026-08-06T20:08:07.997272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.024373Z","title":"Q., Tay, Y., and Metzler, D","venue":null,"work_id":"3c5f98db-c544-4877-9de0-b015ae02fa72","year":2022},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.188012Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:8c41b3b3f32e9567531d962636ff4ae8a165f9b20da1ae7fe90a4196667e8fae","observation_id":"67011f70-86fa-4438-b248-fe500a267bcb","resolution":{"observed_at":"2026-08-06T20:08:11.027343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16286","last_updated":"2024-07-23T08:40:27Z","snapshot_observed_at":"2026-08-06T09:55:47.794512Z","submitted_at":"2024-07-23T08:40:27Z","title":"A deeper look at depth pruning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16286","snapshot_observed_at":"2026-08-06T20:08:08.244465Z","title":"A., Dong, X., Heinrich, G., Breuel, T., Kautz, J., Krueger, D., and Molchanov, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.244465Z"},"links":{"cited_paper":"/paper/2407.16286","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:c7b016a053fddf5eefdb6790649a411137cab7273d48d716843ac40689ffeb76","observation_id":"06e44b8d-493f-4b07-9890-2f66f876fd32","resolution":{"observed_at":"2026-08-06T20:08:08.244465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12016","last_updated":"2024-10-04T06:26:20Z","snapshot_observed_at":"2026-07-06T18:32:32.228906Z","submitted_at":"2024-06-17T18:33:44Z","title":"Prefixing Attention Sinks can Mitigate Activation Outliers for Large Language Model Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12016","snapshot_observed_at":"2026-08-06T20:08:08.298473Z","title":"Prefixing attention sinks can mitigate activation outliers for large language model quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.298473Z"},"links":{"cited_paper":"/paper/2406.12016","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:eb9bbe8888c00571a7dd7ea325384b627e52921d9a304a5a5d2c28f831edb00c","observation_id":"e2bb6b72-cc2a-47c0-9b84-e450ce09f459","resolution":{"observed_at":"2026-08-06T20:08:08.298473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.912591Z","title":"Sleb: Streamlining llms through redundancy verification and elimination of transformer blocks","venue":null,"work_id":"33eeafc7-fa1e-4e9b-bf2f-f7b9e996bb5b","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.393078Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:adef25557b179bcb5404ad13398976d56360384ce0b70b8c4b30a4a571079932","observation_id":"32042cfd-8cb9-4108-b8ba-e4bf8c82d96f","resolution":{"observed_at":"2026-08-06T20:08:10.915706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.902993Z","title":"Z., and Liu, Z","venue":null,"work_id":"fa6d734d-b568-45bf-a7dc-8a48e269ffc3","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.446045Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:fcebc2417b538cefff33a32a91a1f2f711b254aa607d0f0c96936c31d6b09009","observation_id":"c8970a42-2ccc-4f37-8dd1-ff8b0dd3fc6e","resolution":{"observed_at":"2026-08-06T20:08:10.906428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.868281Z","title":"Razorattention: Efficient kv cache compression through retrieval heads","venue":null,"work_id":"26b1bc50-cb7f-40f1-91ff-055d89be491a","year":2025},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.512199Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:2a01eaf9bcabfb9c7a21976a7c9b541d0a8ca1d3e1cafd147f983e8ae02eedea","observation_id":"6fc4520c-285e-49a0-b59a-02cabd591125","resolution":{"observed_at":"2026-08-06T20:08:10.896623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.649259Z","title":"J., Ting, D","venue":null,"work_id":"e6c1f989-7b37-4706-a9b9-5f7285ddd6b0","year":1930},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.610825Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:d8d1317604147dc9c3e162c42aee054f4527a6b03caf91ae021abecb77cb330f","observation_id":"3846996a-fad5-4ef1-9520-6dc86ad22fcc","resolution":{"observed_at":"2026-08-06T20:08:10.740169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T20:08:08.722523Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.722523Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:ac0b0a692d33a54b802469c6bbbcc1f9ad58016d15a672252b9af7bda7fc5ad7","observation_id":"4533b7cf-cd02-4b68-9921-77c3bb68dc7f","resolution":{"observed_at":"2026-08-06T20:08:08.722523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-06T20:08:08.837488Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.837488Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:63753d41a46a4e8d7e2df3ad56217325f662fef53da1feb575b5fd3ff683b551","observation_id":"bd2fa558-17d1-4cef-9907-f074a86bf813","resolution":{"observed_at":"2026-08-06T20:08:08.837488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.472968Z","title":"T., Peng, R., Wu, Q., and Wang, C","venue":null,"work_id":"c3a2ef19-9c33-4419-8abb-b1f8ff4b720d","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.895926Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:e62da21cf82db18a770058318557c3a4ec9c94bfae74a41730cd0fa633476698","observation_id":"2877ea30-5aea-4eb7-8810-eddfceecbbbc","resolution":{"observed_at":"2026-08-06T20:08:10.551322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.285719Z","title":"Duoattention: Efficient long-context llm inference with retrieval and streaming heads","venue":null,"work_id":"e555d158-9021-4b4b-a681-882688d518b3","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.003068Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:b5ec801068cb923aece0ec805f78e1e152a3459a39dfa9dbdcdc204496ee60cf","observation_id":"13964cca-0020-4437-8b2f-7895d5678333","resolution":{"observed_at":"2026-08-06T20:08:10.339924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.129247Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"63a177a5-6036-4343-bbdd-3b0dd95335b8","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.106850Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:6ebda92ada282d625c6be05ee922175c6c1ed2ea13d9001403c18740b74ef8e3","observation_id":"8527fb09-f508-40c1-a700-609a7a9bc288","resolution":{"observed_at":"2026-08-06T20:08:10.169486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:09.965158Z","title":null,"venue":null,"work_id":"7bc3c3c6-d472-4940-b8c6-7657d7b42fb8","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.248931Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:74b298dc8ae3f2f2d1013b29c65bc2fdcd66d90bf74492cd5861c71b95f5a6fc","observation_id":"3ee6e21e-26f5-49f1-a821-95061880a634","resolution":{"observed_at":"2026-08-06T20:08:10.029542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:09.729193Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics, pp.\\ 4791--4800, 2019","venue":null,"work_id":"606dbf5b-2b16-48a9-964d-ca3a203156ab","year":2019},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.372102Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:40059e5e9e13dff0c5b13bc7af94751371c6fd9435840fc7dfc337c7cff7aa22","observation_id":"7f2a254e-64b3-4b64-a42b-e0c7054921df","resolution":{"observed_at":"2026-08-06T20:08:09.806985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-06T20:08:09.488803Z","title":"Pyramidkv: Dynamic kv cache compression based on pyramidal information funneling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.488803Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:6fb1cf69de773de205623f17c4210bf8cb9170b679fc15e711bfcec3eecd4d25","observation_id":"ae04f335-09c4-4713-9b2e-f61df35db73e","resolution":{"observed_at":"2026-08-06T20:08:09.488803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:22:26.944755Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 5 inbound Pith citation observations for arXiv:2507.03865."}