{"as_of":"2026-08-19T14:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:add530b92dcc3a8c02ddcc4344b7df7accc3da2dd15bd32926b7a33f43315c08","coverage":[{"denominator":2,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:43:48.474937Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:21:29.458359Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-11T01:57:51.165925Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2509.22166","last_updated":"2026-04-24T11:44:43Z","snapshot_observed_at":"2026-07-06T22:30:50.642382Z","submitted_at":"2025-09-26T10:27:55Z","title":"Motivating Next-Gen Accelerators with Flexible (N:M) Activation Sparsity via Benchmarking Lightweight Post-Training Sparsification Approaches","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T13:36:55.938673Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2509.22166"},"observation_digest":"sha256:45b362e7d68daeddbec27e54fc0f4b617764f4a0e2994a1a894ed1915074ab4a","observation_id":"2e1dac95-2868-46bb-aa47-e2a6dd506406","resolution":{"observed_at":"2026-05-18T13:41:25.963890Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2603.28680","last_updated":"2026-05-14T23:18:45Z","snapshot_observed_at":"2026-08-16T02:22:22.843094Z","submitted_at":"2026-03-30T16:59:15Z","title":"A Techno-Economic Framework for Cost Modeling and Revenue Opportunities in Open and Programmable AI-RAN","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T00:41:18.795730Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2603.28680"},"observation_digest":"sha256:84a2ddda77a85c15b3fd33e452b2269779d058d265ab2e4ef02b2e81c62ecfaf","observation_id":"a72bb78f-99c1-4ada-aa8e-fcb66231a207","resolution":{"observed_at":"2026-05-14T00:43:32.112169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2603.28680","last_updated":"2026-05-14T23:18:45Z","snapshot_observed_at":"2026-08-16T02:22:22.843094Z","submitted_at":"2026-03-30T16:59:15Z","title":"A Techno-Economic Framework for Cost Modeling and Revenue Opportunities in Open and Programmable AI-RAN","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T16:54:58.406395Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2603.28680"},"observation_digest":"sha256:ae5c40756407cc46263a020cae8ba5e1c8abae2810f4a9e6a2e0a86075210155","observation_id":"f2329126-04e4-4dd8-9b45-7dde365fa7df","resolution":{"observed_at":"2026-05-19T16:57:40.200797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2604.02473","last_updated":"2026-04-02T19:08:47Z","snapshot_observed_at":"2026-08-11T14:47:41.877761Z","submitted_at":"2026-04-02T19:08:47Z","title":"Analyzing Reverse Address Translation Overheads in Multi-GPU Scale-Up Pods","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T20:37:49.558450Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2604.02473"},"observation_digest":"sha256:1ec28b789fb6d7402b384d060834d71ca268ffd682857f7bb42e2ca49f9fbc14","observation_id":"d9dea4af-5767-436c-aa02-d6ee6dc4ae9a","resolution":{"observed_at":"2026-05-13T20:38:14.423669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2604.08290","last_updated":"2026-04-09T14:27:02Z","snapshot_observed_at":"2026-08-13T09:20:00.166690Z","submitted_at":"2026-04-09T14:27:02Z","title":"Tokalator: A Context Engineering Toolkit for Artificial Intelligence Coding Assistants","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T17:34:16.075235Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2604.08290"},"observation_digest":"sha256:958d222eb527cb0d3d6af9c228d9383383647957b7e0bc567809f34f0879b911","observation_id":"e8c8a6e4-0338-4c8e-8f8e-2b827045b8b8","resolution":{"observed_at":"2026-05-11T06:36:03.158798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2605.01160","last_updated":"2026-05-01T23:37:50Z","snapshot_observed_at":"2026-08-15T03:27:42.587562Z","submitted_at":"2026-05-01T23:37:50Z","title":"The Productivity-Reliability Paradox: Specification-Driven Governance for AI-Augmented Software Development","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-09T18:29:18.485336Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2605.01160"},"observation_digest":"sha256:6aaad555599cb0d7a6d1683106b5925477c5bf2f47c4d1ee852bee5324762ae6","observation_id":"97493b5c-aa08-4af4-81b6-0f5dcdc1aa20","resolution":{"observed_at":"2026-05-11T16:11:12.070833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2606.02430","last_updated":"2026-06-01T16:04:51Z","snapshot_observed_at":"2026-08-07T20:16:33.113391Z","submitted_at":"2026-06-01T16:04:51Z","title":"Not All Errors Are Equal: A Systematic Study of Error Propagation in Large Language Model Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T12:36:23.320194Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2606.02430"},"observation_digest":"sha256:f1dc462cfc0e9467c882622fd7ea99c5e3d587b0453297894d227d959b921e88","observation_id":"dd6cd589-49bd-437a-93f3-2fc4e4b46384","resolution":{"observed_at":"2026-07-02T01:06:24.637089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2606.11690","last_updated":"2026-06-10T06:07:24Z","snapshot_observed_at":"2026-08-15T23:42:03.346964Z","submitted_at":"2026-06-10T06:07:24Z","title":"Beyond Per-Token Pricing: A Concurrency-Aware Methodology for LLM Infrastructure Cost Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T08:45:42.781160Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2606.11690"},"observation_digest":"sha256:bb4999fba42a4411b594c778ade1f0df1d62ddb6732b53b6ee79bb0c20712b7b","observation_id":"1adaf6bc-9594-4451-8151-2bf8b9e2e8e5","resolution":{"observed_at":"2026-07-03T12:48:11.782979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2607.05876","last_updated":"2026-07-08T02:47:41Z","snapshot_observed_at":"2026-08-05T07:46:13.093303Z","submitted_at":"2026-07-07T06:11:54Z","title":"Think Before You Grid-Search: Floor-First Triage for LLM Serving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T22:38:12.637901Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2607.05876"},"observation_digest":"sha256:13d7278cbb210dc307f08e0b5276aa367f810e029f8e7378c8606788d9dfa17d","observation_id":"122dca54-a96d-4745-ba2a-23dba8e89d7b","resolution":{"observed_at":"2026-07-08T22:45:40.141713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":"2506.04645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-11T01:57:51.165925Z","title":"Inference economics of language models","venue":"cs.LG","work_id":"04d45cee-6be3-4821-b7f4-3da22b7e0cf4","year":2025},"citing_paper":{"arxiv_id":"2607.05876","last_updated":"2026-07-08T02:47:41Z","snapshot_observed_at":"2026-08-05T07:46:13.093303Z","submitted_at":"2026-07-07T06:11:54Z","title":"Think Before You Grid-Search: Floor-First Triage for LLM Serving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T01:55:09.658053Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2607.05876"},"observation_digest":"sha256:1926579b4878b8b4b5e90eaa08cffcfe7396c75201580beb6133f9700c3ac9c3","observation_id":"d8fd2f96-9403-41d8-a630-009a86a578d4","resolution":{"observed_at":"2026-07-11T01:57:51.196297Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-08-01T12:03:18.785055Z","title":"Inference economics of language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19704","last_updated":"2026-07-22T03:06:57Z","snapshot_observed_at":"2026-08-18T05:28:31.879685Z","submitted_at":"2026-07-22T03:06:57Z","title":"Efficient Clustering with Provable Guardrails for LLM Inference at Scale","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T12:03:18.785055Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2607.19704"},"observation_digest":"sha256:cb39589291a80bf9dc7f1f06d05d6b8b107e90840038fa314e47011e227dcf8f","observation_id":"987461ec-5ba4-481e-bfc2-a79665687c7f","resolution":{"observed_at":"2026-08-01T12:03:18.785055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-07-30T12:53:41.155145Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23777","last_updated":"2026-07-26T17:55:40Z","snapshot_observed_at":"2026-07-30T23:56:43.497541Z","submitted_at":"2026-07-26T17:55:40Z","title":"Scale Weight Decay and Train Better","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-30T12:53:41.155145Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2607.23777"},"observation_digest":"sha256:ea33320fe0666b13c56558197e97d1184ea062d0149234e2df841e88089c32df","observation_id":"c8dc26db-bf8f-4bb6-b57e-7126535a1c92","resolution":{"observed_at":"2026-07-30T12:53:41.155145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04645","snapshot_observed_at":"2026-08-15T15:21:29.458359Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00867","last_updated":"2026-08-01T21:01:52Z","snapshot_observed_at":"2026-08-17T10:38:11.849133Z","submitted_at":"2026-08-01T21:01:52Z","title":"NUNA: Characterizing and Mitigating Non-Uniform Network Access in Multi-Die GPU Scale-Up Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:21:29.458359Z"},"links":{"cited_paper":"/paper/2506.04645","citing_paper":"/paper/2608.00867"},"observation_digest":"sha256:3b7898f5079f4dec7319522fed46f5da160a8fd0067753977441610174f85347","observation_id":"9931379b-adf8-4bd2-87e6-95d5d15fe743","resolution":{"observed_at":"2026-08-15T15:21:29.458359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04645/citation-record","integrity":"/paper/2506.04645/integrity","json":"/paper/2506.04645/citation-record.json","paper":"/paper/2506.04645"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T10:43:48.385356Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.385356Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2506.04645"},"observation_digest":"sha256:4ad529c6b0e49f162cb7a48c5785ff1bc0a192ee1efcac8275a20485cba2bdf1","observation_id":"1a6db3ea-157f-4845-9f1e-2529f6abccbe","resolution":{"observed_at":"2026-08-07T10:43:48.385356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17192","last_updated":"2023-05-18T20:28:20Z","snapshot_observed_at":"2026-08-16T07:08:26.126605Z","submitted_at":"2022-11-30T17:33:28Z","title":"Fast Inference from Transformers via Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17192","snapshot_observed_at":"2026-08-07T10:43:48.474937Z","title":"Leviathan, Yaniv, Matan Kalman, and Yossi Matias (2023).Fast Inference from Transformers via Speculative Decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.474937Z"},"links":{"cited_paper":"/paper/2211.17192","citing_paper":"/paper/2506.04645"},"observation_digest":"sha256:a12ed507329d6c1ee8f2693fb7ca325a10d496e9507b423535b4d4343cbf1b94","observation_id":"35eb7c2d-c09b-4705-ad24-12896af4fd21","resolution":{"observed_at":"2026-08-07T10:43:48.474937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04645","last_updated":"2025-06-05T05:28:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T15:21:17.609398Z","submitted_at":"2025-06-05T05:28:09Z","title":"Inference economics of language models"},"reference_resolution":{"displayed":2,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":2},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 2 of 2 outbound references and 13 inbound Pith citation observations for arXiv:2506.04645."}