{"as_of":"2026-08-05T13:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af0d1412b4449ab8f18d2809560b458d5713e4081fbe66faf2ab022e17a73c81","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T07:49:07.128814Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T07:06:53.318182Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T08:55:35.141369Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"cited_work":{"arxiv_id":"2605.20315","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20315","snapshot_observed_at":"2026-07-01T08:55:35.141369Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","venue":"cs.CL","work_id":"0dc83b0d-fbc6-40d0-bd43-cf378694acb4","year":2026},"citing_paper":{"arxiv_id":"2606.29708","last_updated":"2026-06-30T03:13:37Z","snapshot_observed_at":"2026-07-07T00:03:41.292432Z","submitted_at":"2026-06-29T02:24:13Z","title":"Demystifying the Design Space and Best Practices for Heterogeneous LLM Inference and Serving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T05:37:13.211613Z"},"links":{"cited_paper":"/paper/2605.20315","citing_paper":"/paper/2606.29708"},"observation_digest":"sha256:f97182b2851f7fed642064000860769180745dbdd782f894c69f3e4ce725b230","observation_id":"25b1ed1e-ee39-4a35-97c2-0c3c676a14e3","resolution":{"observed_at":"2026-06-30T14:04:45.308390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"cited_work":{"arxiv_id":"2605.20315","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20315","snapshot_observed_at":"2026-07-01T08:55:35.141369Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","venue":"cs.CL","work_id":"0dc83b0d-fbc6-40d0-bd43-cf378694acb4","year":2026},"citing_paper":{"arxiv_id":"2606.29708","last_updated":"2026-06-30T03:13:37Z","snapshot_observed_at":"2026-07-07T00:03:41.292432Z","submitted_at":"2026-06-29T02:24:13Z","title":"Demystifying the Design Space and Best Practices for Heterogeneous LLM Inference and Serving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-01T07:06:53.318182Z"},"links":{"cited_paper":"/paper/2605.20315","citing_paper":"/paper/2606.29708"},"observation_digest":"sha256:95bae7607fdf0d211cf46b55dfd906ebe81814c2fc6d565b5f6faa2996441024","observation_id":"7ab5af06-553c-44c1-9326-0796ec6c9ade","resolution":{"observed_at":"2026-07-01T08:55:35.142489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"cited_work":{"arxiv_id":"2605.20315","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20315","snapshot_observed_at":"2026-07-01T08:55:35.141369Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","venue":"cs.CL","work_id":"0dc83b0d-fbc6-40d0-bd43-cf378694acb4","year":2026},"citing_paper":{"arxiv_id":"2606.29986","last_updated":"2026-06-29T09:00:38Z","snapshot_observed_at":"2026-08-02T15:33:15.275147Z","submitted_at":"2026-06-29T09:00:38Z","title":"HBM Is Not All You Need: Efficient Disaggregated LLM Serving across Memory-heterogeneous Accelerators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T04:26:36.990118Z"},"links":{"cited_paper":"/paper/2605.20315","citing_paper":"/paper/2606.29986"},"observation_digest":"sha256:67cab1c4e64213bf546007f0edbc59d04c1b95a5a346ed3a1ecac1c119cd7494","observation_id":"efe7403d-7d97-4a79-9285-2f95ab49a841","resolution":{"observed_at":"2026-06-30T17:14:57.498059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.20315/citation-record","integrity":"/paper/2605.20315/integrity","json":"/paper/2605.20315/citation-record.json","paper":"/paper/2605.20315"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Artificial Analysis Long Context Reasoning Benchmark (LCR)","venue":null,"work_id":"9ba3842c-0ad2-417d-a6f8-4eff725d1365","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:6548f97afcff4e744fbd28c1334c4d75d87879533278eb4f0687013bf5cbbb6b","observation_id":"2a385ae5-409d-4994-a3d1-b1d0e5a84019","resolution":{"observed_at":"2026-05-21T07:49:50.378024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-04T21:07:04.238345Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":"2412.15204","doi":"10.48550/arxiv.2412.15204","metadata_source":"pith","pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","venue":"cs.CL","work_id":"9fac250b-241e-41ce-9177-469deaf03040","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:f1b6dbe2088fdcccaf9a643ea4f7c33f0be699412b48c049f44c0c09f27dbeca","observation_id":"bfd33b8f-ffec-4025-a15d-5fc5cd592954","resolution":{"observed_at":"2026-05-21T07:49:49.972396Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":"2506.07982","doi":"10.48550/arxiv.2506.07982","metadata_source":"pith","pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","venue":"cs.AI","work_id":"3a498b1a-455f-4667-b572-c5216c99a89c","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:7743927382c3d45b9c34dd680bc8a865ff467b58b4a9adba4f8990041efcbcdb","observation_id":"d60d51c5-5ca8-4497-8691-803ab1ee0d02","resolution":{"observed_at":"2026-05-21T07:49:49.969634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00674","last_updated":"2026-05-15T17:10:37Z","snapshot_observed_at":"2026-07-06T23:14:01.852096Z","submitted_at":"2026-05-01T13:56:34Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","version":2},"cited_work":{"arxiv_id":"2605.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.00674","snapshot_observed_at":"2026-07-10T09:37:00.861422Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","venue":"cs.CL","work_id":"a302077a-ac03-4988-adce-c84a57db5425","year":2026},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2605.00674","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:4fe54fd9d94f8170f6248d5894b0069b8ffce3960348c6a5236a2eec47e5b4d9","observation_id":"8d9f0956-f6e6-4d79-bdd7-042c0ceaf012","resolution":{"observed_at":"2026-05-21T07:49:49.966881Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LLM.int8(): 8-bit matrix multiplication for transformers at scale","venue":null,"work_id":"e514096b-0314-4540-9e6d-e6a7c381af3d","year":2022},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:05dd4ce13bb59c19c1599380de80ddaf89c21095c4de3c62b193a2e894fc3177","observation_id":"7c328ebc-0313-47e2-8c9c-a44f3d222cbd","resolution":{"observed_at":"2026-05-21T07:49:50.375486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.411941Z","title":"Castro, Denis Kuznedelev, Andrei Panferov, Eldar Kurtic, Shubhra Pandit, Alexandre Noll Marques, Mark Kurtz, Saleh Ashkboos, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":"d080b730-66af-4604-8766-7465dd5b34cf","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:b111e802831d7050d2bf9d93cd0da47f210c7269d373229f5d0a681a1003ee79","observation_id":"83876ccb-db30-41d5-8d14-038885cbb3dc","resolution":{"observed_at":"2026-05-21T07:49:49.960736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.06199","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashprefill: Instantaneous pattern discovery and thresholding for ultra-fast long-context prefilling","venue":null,"work_id":"5875ba44-471e-4447-8b2a-0b4799acac78","year":2026},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:ff1f85c74fdf5c3a51908a7bf4641ab5c2529cb00244096e5cb0af919f12bc26","observation_id":"5e6cc91b-ea7b-49d7-8ecd-c3bf82c89e4b","resolution":{"observed_at":"2026-05-21T07:49:49.964034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-07-31T03:44:36.976336Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":"2210.17323","doi":"10.48550/arxiv.2210.17323","metadata_source":"pith","pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":"cs.LG","work_id":"19ed8c44-202a-48f6-8169-637d5a5f2408","year":2022},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:4ec8f5a3fbfe748d640d4ea075d59516473f0d1db9f20a6e3c404ec0c969a01d","observation_id":"f9fff8a0-bbce-40e1-b314-09dfad0454a7","resolution":{"observed_at":"2026-05-21T07:49:49.954601Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemma 4 model card","venue":null,"work_id":"346a9355-975e-4e64-a06f-89f024194685","year":2026},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:af201f8c5043a9c8a2f8f456c396c841663edb9cae946a81e30212681b125d6b","observation_id":"0a4e6f92-18fa-4e0f-bd71-822871563cd5","resolution":{"observed_at":"2026-05-21T07:49:50.369854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:14:30.575750Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":"b1e6b0f6-8514-45e3-8ada-200c47bc849c","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:22568d34694b2d9dd58f2ed4d5aa48662b2f8a5a1bf3c3d7c3a51d1647b963bd","observation_id":"a7a730a8-ebf4-45e5-a14d-ea7649504a96","resolution":{"observed_at":"2026-05-21T07:49:50.372980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minference 1.0: Accelerating pre-filling for long-context llms via dynamic sparse attention.Advances in Neural Information Processing Systems, 37:52481–52515","venue":null,"work_id":"d0e54fa8-5324-4fcb-867e-439b583b9c90","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:5135cd4580eb22696c403637f8faee258d4b0dc0bf33985aa037c6ea7e7eb9aa","observation_id":"ee3db034-e5b2-4b0a-b032-591650e2d55a","resolution":{"observed_at":"2026-05-21T07:49:50.332349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:40:35.456516Z","title":"Longllmlingua: Accelerating and enhancing llms in long context scenarios via prompt compression","venue":null,"work_id":"46ac5bec-09c3-4480-8607-a57376a83721","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:76c5c5fdf325ce1143ae5ce382a9d67ae643c830a8255ee63800b31f9080d9e0","observation_id":"8004bb3a-0bed-422c-a1d0-3bd81e3c2bda","resolution":{"observed_at":"2026-05-21T07:49:50.326906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:532fe107846d1566960f7fdf8b15b79c9661717b76787df55d0ac61dc35430ee","observation_id":"8cb856c8-3ed2-4fc2-ac3c-6fe52c7753b2","resolution":{"observed_at":"2026-05-21T07:49:49.945471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"4560cd69-4ab2-42ed-bbe6-f33764255efb","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:acf6648baaecfa89765089c9847816ef25a140bdf06c4ad6c1732223ea4c4865","observation_id":"abc28438-7dda-45df-b37f-5c2852826b12","resolution":{"observed_at":"2026-05-21T07:49:50.353536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:24:01.262844Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"ba38df18-25de-4771-8903-3ff55d99b09f","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:d1625921073f008e8f1a10b07eb2c849ebdae86403fff30fa71b86d3b8e23d40","observation_id":"90fb5a9d-bbc2-4524-9a97-b6bfe4c67954","resolution":{"observed_at":"2026-05-21T07:49:50.356126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03035","last_updated":"2025-02-24T14:34:37Z","snapshot_observed_at":"2026-07-06T20:17:06.835639Z","submitted_at":"2025-01-06T14:23:02Z","title":"Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":"2501.03035","doi":"10.48550/arxiv.2501.03035","metadata_source":"pith","pith_arxiv_id":"2501.03035","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantization meets reasoning: Exploring llm low-bit quantization degradation for mathematical reasoning","venue":"cs.CL","work_id":"4588f59b-42bc-44af-8c3e-5031be977d8f","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2501.03035","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:f4c91a9870439700b7f761cbfe2ba4e9317bc1d98d7e0b426f39a6d810ec7625","observation_id":"158e9f64-0ce8-4f9e-8897-f3016a719d5b","resolution":{"observed_at":"2026-05-21T07:49:49.951742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:03.410928+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:03.410928+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:32:39.114869Z","title":"Let’s verify step by step","venue":null,"work_id":"7c9f7d5c-e081-4728-8d71-07bae6642366","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:d4307991d86958ba90f574d2944e93f08f1b3ee51288470828db22e9996888a2","observation_id":"966e5100-4c5b-4625-8d49-4e5b9fba6d3d","resolution":{"observed_at":"2026-05-21T07:49:50.348042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T17:05:09.008702Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration.Proceedings of machine learning and systems, 6:87–100","venue":null,"work_id":"2446ee30-3b81-412e-826d-a75cd7821fdc","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:967ade190142e12ddad7b72b2d506aa8f3d587f7ad1234f56a1f11274de6fbd1","observation_id":"92b365b2-bff3-4f2f-ab30-d9ec586a32e3","resolution":{"observed_at":"2026-05-21T07:49:50.350994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.06052","last_updated":"2026-06-08T08:05:28Z","snapshot_observed_at":"2026-08-04T11:16:34.304112Z","submitted_at":"2025-10-07T15:46:34Z","title":"MixReasoning: Switching Modes to Think","version":2},"cited_work":{"arxiv_id":"2510.06052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.06052","snapshot_observed_at":"2026-06-09T03:07:04.833097Z","title":"Mixreasoning: Switching modes to think","venue":null,"work_id":"1a44e89e-ef97-405e-9a03-fbdef6cccfbd","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2510.06052","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:9abfc6a91d76c25db26c09560705682a9cb6fd5a2391c5b4204f6ffd63f5f108","observation_id":"56797825-8cc6-46a0-8dcd-f8dca6ba2c0c","resolution":{"observed_at":"2026-06-09T03:07:04.833097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":"2503.21460","doi":"10.1145/3573051.3596191","metadata_source":"pith","pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","venue":"cs.CL","work_id":"4aff48d9-c46d-41d9-904b-52251e559596","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:4d21c2a267cbfb46e8df8fab795943c8b5b087aca41ad71776b0c72607580093","observation_id":"758707e8-05c7-4f5a-8b56-31daaf3cf52c","resolution":{"observed_at":"2026-05-21T07:49:49.938591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm-pruner: On the structural pruning of large language models.Advances in neural information processing systems, 36:21702–21720","venue":null,"work_id":"abf5ec7c-e913-4143-b94a-1edb17204fea","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:eed98bf6310379b14230748533c6ac88dfaba74987729a5277892c1b2674aabb","observation_id":"640f6f26-8c8d-4ce5-b575-2edd0f7c2c9f","resolution":{"observed_at":"2026-05-21T07:49:50.367035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:a7aca218ec37c73c5e9f7564cff5b8525bb17725cdb30c026a203c17e7109147","observation_id":"6415345b-ed10-4db1-9c3f-9387d04bcf93","resolution":{"observed_at":"2026-05-21T07:49:49.931375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing nvfp4 for efficient and accurate low- precision inference","venue":null,"work_id":"b90f263b-1485-4643-a62b-98586858f8aa","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:c6bf1f4891c514b14533b92a30020b44f0d460f03c9689677d4db55e8714995b","observation_id":"0b4853b3-0cfe-415d-9688-3c6b64e32a4a","resolution":{"observed_at":"2026-05-21T07:49:50.341227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Enhancing distributed inference performance with the nvidia inference transfer library","venue":null,"work_id":"b1402b4e-a70b-45cf-92c7-9aadfa2cbfd3","year":null},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:dea9297e7a534e83a5f35bb2ced56fa8632bbda9c53da526c5b7830766ac82a5","observation_id":"58ddcb9f-a327-44fe-900d-144b6f22b243","resolution":{"observed_at":"2026-05-21T07:49:50.313218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":"2310.08560","doi":"10.48550/arxiv.2310.08560","metadata_source":"pith","pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemGPT: Towards LLMs as Operating Systems","venue":"cs.AI","work_id":"2698f5ad-c84c-40ca-b839-0912dae10ba2","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:fdf43a9aacafc0e526011ab90bd0726752a6136a5a9a3fb74f6d97f09653fe0b","observation_id":"a9885126-92b7-4362-bfbf-91e10aa528d8","resolution":{"observed_at":"2026-05-21T07:49:49.957577Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18677","last_updated":"2024-05-20T15:37:36Z","snapshot_observed_at":"2026-07-06T16:55:05.210009Z","submitted_at":"2023-11-30T16:24:42Z","title":"Splitwise: Efficient generative LLM inference using phase splitting","version":2},"cited_work":{"arxiv_id":"2311.18677","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.18677","snapshot_observed_at":"2026-07-11T01:57:51.633849Z","title":"Splitwise: Efficient generative llm inference using phase splitting","venue":"cs.AR","work_id":"ce7902cc-fd2e-4179-b84b-1f819931e7ae","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2311.18677","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:99bf259bea8b8ddc02a3bb9c4a82dd2d391e7b1826c759f5b0ff3873edde4671","observation_id":"64f81343-78c1-42a8-8efd-ee22672adb86","resolution":{"observed_at":"2026-05-21T07:49:49.924669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Splitwise: Efficient generative llm inference using phase splitting","venue":null,"work_id":"acb038c0-8f5e-438e-86cb-937f03242185","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:201f0fffe1a1d4f30d6eaed3bad43baa05c6acdba7aa508e0e6b322db8cfab45","observation_id":"03ff802a-6c80-47b0-b22c-0eafdd6b0eee","resolution":{"observed_at":"2026-05-21T07:49:50.363770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:32:26.114385Z","title":"The berkeley function calling leaderboard (bfcl): From tool use to agentic evaluation of large language models","venue":null,"work_id":"d324b310-02e6-4416-b78d-c5a15c277b5d","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:6e4cc76c591f3839e71d9516424d8b323b74965c362a213a4727982c5c8df717","observation_id":"0413313e-6ec5-4d57-89c4-a587c93ba989","resolution":{"observed_at":"2026-05-21T07:49:50.335327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yarn: Efficient context window extension of large language models","venue":null,"work_id":"31b78456-f1d5-470c-a31d-454d48b403ef","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:42a00d03ccaaf88339ba3af59e58798fa6a0bcdafced241ce28917ab7cf959ca","observation_id":"af2343a7-ab13-46d5-8779-0b74ef1a22a4","resolution":{"observed_at":"2026-05-21T07:49:50.358780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swiftkv: Fast prefill- optimized inference with knowledge-preserving model transformation","venue":null,"work_id":"75617a3e-1913-4cb2-8453-6f35c571fa97","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:f069b147303bdb664384b282793328699081242014e85d150b0475a865f72769","observation_id":"2d11e57d-a088-41c6-9ef7-db38a1ebaa7d","resolution":{"observed_at":"2026-05-21T07:49:50.360965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:14:30.537124Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":"cc4c64ce-0924-409b-b18c-3cb7c4f8ec8c","year":2026},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:d6121adc8f903acbdc69a8b2683b81b43b25f31296840fc9f4ba80ad2fc144b0","observation_id":"4f816f20-a4cf-4c42-a24a-c331a75ff4b1","resolution":{"observed_at":"2026-05-21T07:49:50.344987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":"2302.04761","doi":"10.48550/arxiv.2302.04761","metadata_source":"pith","pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","venue":"cs.CL","work_id":"9bce40c8-cfd7-4983-80e0-c3bd4402322a","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:c7234818a72488795e1ff488508a99378ed56e9cb3ddca3742e0449ce1f94b4e","observation_id":"8e1723f9-b021-43fb-8365-6503ae1224c6","resolution":{"observed_at":"2026-05-21T07:49:49.948681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:11.107254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:11.107254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.16104","doi":"10.48550/arxiv.2603.16104","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient llm serving for agentic workflows: A data systems perspective","venue":"arXiv (Cornell University)","work_id":"206c386f-6b84-4157-b2af-9ef1e981ab2f","year":2026},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:b3820e64c44f450c57fef2a59bab341e1d53ecf5af5c5d7a778fd593a96d3d61","observation_id":"c33454c0-104a-41b1-84aa-e3a8e5d1aa77","resolution":{"observed_at":"2026-05-21T07:49:49.942271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long- memeval: Benchmarking chat assistants on long-term interactive memory","venue":null,"work_id":"b7f50811-5fce-4c68-88cc-577ea6d52a93","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:f4a46a7242293f4de3e54e27be4dc4d1c01a32103aeb89263d74fce906073bc3","observation_id":"214e712c-589e-4792-a522-7a3d145eb1a2","resolution":{"observed_at":"2026-05-21T07:49:50.338241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09505","last_updated":"2026-04-12T10:29:26Z","snapshot_observed_at":"2026-07-06T22:28:48.082201Z","submitted_at":"2025-09-11T14:49:50Z","title":"Combating the Memory Walls: Optimization Pathways for Long-Context Agentic LLM Inference","version":3},"cited_work":{"arxiv_id":"2509.09505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09505","snapshot_observed_at":"2026-07-10T11:37:03.208226Z","title":"Combating the Memory Walls: Optimization Pathways for Long-Context Agentic LLM Inference","venue":"cs.AR","work_id":"7fa56561-f354-41d2-b5bc-dc36836819a4","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2509.09505","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:c7b0e1ced2ed066245d7f46889075624ce2dafac3c719d014c2ff090578bd831","observation_id":"dea70fbf-ce22-4e69-9d02-f5783188a110","resolution":{"observed_at":"2026-05-21T07:49:49.917837Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"4d7b8520-0e62-4eac-83eb-25a08a2c3a95","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:85b35f30aa9b0ab7059cbe0319c29347e7a39b7a94a3dee2f1dba8ad21f112e4","observation_id":"93a4fce7-f10d-403b-ae33-47e4d9f178d4","resolution":{"observed_at":"2026-05-21T07:49:50.316161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":"2502.12110","doi":"10.48550/arxiv.2502.12110","metadata_source":"pith","pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A-MEM: Agentic Memory for LLM Agents","venue":"cs.CL","work_id":"3b98feb2-fdb1-479a-bbe4-2c298a4592e2","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:6997f46ed9369f7bc304ddda713ba6424b7d81233f54551f298c1d77b0b17537","observation_id":"8e16447e-4d6f-47e2-81ac-3273a059a3e1","resolution":{"observed_at":"2026-05-21T07:49:49.920887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:58ffa417901a1bf2f3efdc15fd2e19a8381c0b2940fdba037dbf3fab39296e54","observation_id":"5b15b1b7-44ac-45a5-9a97-c39f280756c2","resolution":{"observed_at":"2026-05-21T07:49:49.928093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:24:54.955583Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering.Advances in Neural Information Processing Systems, 37:50528–50652","venue":null,"work_id":"0621aa9d-3c5d-4171-ba59-3d6fb78d570d","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:97df0a984bf24bb5bf2bbbdabdcbdb7e4d73f382eade5404c69ee0c2cfefe2cd","observation_id":"0c304cd2-c41b-49a0-aa34-45a9e3b0478d","resolution":{"observed_at":"2026-05-21T07:49:50.324073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":"2405.15793","doi":"10.48550/arxiv.2405.15793","metadata_source":"pith","pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","venue":"cs.SE","work_id":"01826cd9-a652-403c-a2ec-531da9fe2b6a","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:8d85026281d4aeefe6aca4b43c070f11ef07b81eddea7b3369a2bde289679999","observation_id":"082ef578-7e54-4091-a4f7-222a2731af2d","resolution":{"observed_at":"2026-05-21T07:49:49.905664Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:24.962823+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:24.962823+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":"2210.03629","doi":"10.48550/arxiv.2210.03629","metadata_source":"pith","pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","venue":"cs.CL","work_id":"407a2351-25f1-497d-b611-f77d0292a8e6","year":2022},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:c1a168e48f2be2cb653c79122b62c13bb0db58f42739f2feeee671594fa77e20","observation_id":"18f6fe46-d908-4334-9e9f-5d0516f1bd76","resolution":{"observed_at":"2026-05-21T07:49:49.908832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T07:20:47.299833Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"25b7630b-0793-4c04-bc81-1ca0da2d735b","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:813f8e7cc89feed267d79ccb7148d463851463539617c55d39a5ec80506f7be7","observation_id":"816b3edc-6414-470e-91e7-529ab802c486","resolution":{"observed_at":"2026-05-21T07:49:50.318808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qspec: Speculative decoding with complementary quantization schemes","venue":null,"work_id":"ab988200-228f-48f3-8e02-8049f5605c7c","year":2025},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:379d1ff44fd34dcfa28d34ce3f73eba40d064ece225282d95fd3b8e70f443b74","observation_id":"0c5816a9-3477-49f3-b916-015fa4e878ec","resolution":{"observed_at":"2026-05-21T07:49:50.321487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19102","last_updated":"2024-04-16T06:08:05Z","snapshot_observed_at":"2026-08-05T04:04:11.667434Z","submitted_at":"2023-10-29T18:33:05Z","title":"Atom: Low-bit Quantization for Efficient and Accurate LLM Serving","version":3},"cited_work":{"arxiv_id":"2310.19102","doi":"10.48550/arxiv.2310.19102","metadata_source":"pith","pith_arxiv_id":"2310.19102","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving","venue":"cs.LG","work_id":"73affba1-cd5f-4b84-8ad9-911fddcb545a","year":2023},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2310.19102","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:588b9ab0afff8b56acb80d9b0d47e3ed180c5abd6c2e0740cd33caaa4fc063bc","observation_id":"d27ba4df-1089-46e6-9ff2-471ec59aa2f9","resolution":{"observed_at":"2026-05-21T07:49:49.914962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distserve: Disaggregating prefill and decoding for goodput-optimized large language model serving","venue":null,"work_id":"446116fb-c0dc-4bb0-b9e1-cb5f487df5a9","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:7326193eefd7ebd003e58ef54f3c967c7e39d99529af50dbd1c260daa7fcbd42","observation_id":"c85e2897-eba7-4a5e-903e-a2a0ff37827c","resolution":{"observed_at":"2026-05-21T07:49:50.329713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":"2404.14294","doi":"10.48550/arxiv.2404.14294","metadata_source":"pith","pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on Efficient Inference for Large Language Models","venue":"cs.CL","work_id":"4e58b7d0-2870-4ddb-955f-798b34deb447","year":2024},"citing_paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:07.128814Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2605.20315"},"observation_digest":"sha256:5e976c2b0746917c4fb2720cc14135a6687efac759d7966a51883c8a0051db3f","observation_id":"96d6637d-aae8-4ddc-a106-0be1a467de59","resolution":{"observed_at":"2026-05-21T07:49:49.911867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:38.535897+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:38.535897+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.20315","last_updated":"2026-05-19T17:50:17Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-19T17:50:17Z","title":"Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":20,"verified_fuzzy":24},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 3 inbound Pith citation observations for arXiv:2605.20315."}